# Palabra, lexema, morfema y las unidades que construyen una palabra

## El problema de definir la palabra

Después de trabajar con sonidos, fonemas, rasgos y sílabas, el libro cambia de escala y entra en la morfología, el estudio de la estructura interna de las palabras y de los procesos con que las lenguas crean, modifican y relacionan formas léxicas. La unidad más intuitiva de este nivel sería la palabra. En la escritura ordinaria parece fácil identificarla, porque «paciente deprimido» contiene dos palabras separadas por un espacio. Esa estrategia funciona solo porque existe una convención ortográfica. El habla no contiene espacios, como mostró el capítulo 11. Distintas tradiciones de escritura segmentan, además, de manera diferente expresiones lingüísticamente comparables.

Definir la palabra como una unidad con significado tampoco basta. En *niñas* pueden distinguirse la base léxica *niñ-*, el género y el número, por lo que la palabra contiene más de una unidad de significado o función. *Dámelo* es una sola palabra gráfica que contiene un verbo y dos pronombres, mientras que *ha comido* tiene dos palabras ortográficas que forman una única construcción verbal. La comparación entre lenguas agrava el problema, porque algunas condensan en una sola forma información que el español distribuye entre varias palabras y otras son mucho más analíticas. La palabra no es una unidad universalmente simple ni definible por un único criterio (Haspelmath y Sims, 2010).

Para avanzar hay que distinguir al menos tres conceptos, la palabra, el lexema y el morfema. Este capítulo examina qué problema resuelve cada uno y por qué la segmentación morfológica es una hipótesis analítica, no una operación mecánica de cortar palabras.

## Palabra ortográfica y palabra fonológica

La palabra ortográfica es una secuencia delimitada por espacios u otros signos gráficos. «El paciente duerme bien» contiene cuatro. El criterio es operativo para el procesamiento de textos, los recuentos, la edición y los corpus escritos. No define, sin embargo, una unidad lingüística universal, porque la escritura es secundaria respecto de la capacidad lingüística y puede representar de maneras distintas estructuras semejantes.

La palabra fonológica se define por propiedades prosódicas, como ser un dominio de acento, de reducción, de procesos fonológicos o de silabificación. En español, algunas palabras funcionales carecen de acento propio y se apoyan en otra unidad, como *me* en *me dijo* o *la* en *la casa*. Esos elementos tienen independencia sintáctica y ortográfica, mientras que su comportamiento prosódico es dependiente, como anticipó el capítulo 14. Una expresión puede contener, así, varias palabras sintácticas dentro de un único dominio prosódico.

## Palabra morfosintáctica y palabra semántica

Desde la gramática, una palabra es una unidad que participa en relaciones sintácticas y admite ciertas operaciones morfológicas. *Gatos* funciona como sustantivo plural dentro de una oración. La sintaxis ordinaria no puede insertar otra palabra entre su raíz y su marca de plural. Nadie dice *gat-grande-os* por *gatos grandes*. La palabra es, así, un dominio de integridad relativa, un criterio que se conoce en inglés como *lexical integrity*, según el cual las reglas sintácticas no operan libremente dentro de la estructura interna de las palabras. La integridad léxica es una generalización y un problema teórico, sin que todas las gramáticas la formulen del mismo modo. La imposibilidad de insertar material dentro de *gatos* aporta un contraste útil que no decide por sí solo cómo analizar los compuestos, los clíticos o las construcciones de otras lenguas.

La palabra tampoco coincide con una unidad conceptual. Una sola palabra, como *desgraciadamente*, incorpora relaciones derivativas y evaluativas complejas, mientras que varias palabras pueden formar una unidad semántica convencional, como *tomar una decisión*, *echar de menos* o *tener en cuenta*. Estas expresiones tienen distintos grados de idiomaticidad y convencionalización. La relación entre léxico y sintaxis es más gradual de lo que sugeriría una separación estricta entre palabras y frases.

## Criterios para identificar palabras

Un criterio clásico sostiene que una palabra puede moverse como unidad. *Ayer* ocupa posiciones distintas en «Ayer Juan llegó» y «Juan llegó ayer». El criterio no funciona, sin embargo, para todas las clases de palabras, porque un artículo carece de esa libertad. Un constituyente de varias palabras, como *el médico joven*, también se desplaza. La movilidad identifica constituyentes y no exclusivamente palabras.

Otro criterio sostiene que no puede insertarse material dentro de una palabra, porque *rápidamente* no admite *rápida muy mente*. El criterio favorece el análisis de la forma como una unidad morfológica, pero algunas lenguas tienen morfología discontinua que desafía una definición estricta de la inseparabilidad. Las pausas tampoco son una prueba fiable. En la conversación puede aparecer una pausa entre artículo y sustantivo, como en «la... casa», o dentro de una palabra por vacilación, como en «des... afortunadamente», porque su posición depende de la planificación y no de una frontera gramatical. El acento ayuda en las lenguas en que cada palabra tiene un único acento principal, aunque existen palabras inacentuadas, compuestos con varias prominencias y clíticos. La palabra debe identificarse, por tanto, por la convergencia de varios criterios, sin una prueba única.

## Lexema y forma de palabra

El lexema es una unidad léxica abstracta que aparece en distintas formas flexionadas. *Canto*, *cantas*, *cantamos* y *cantaban* son realizaciones de un mismo lexema, que por convención se escribe en versalitas o mayúsculas, CANTAR, para distinguirlo de una forma concreta (Booij, 2012). CANTAR no es exactamente la palabra ortográfica *cantar*, porque el infinitivo funciona solo como etiqueta de una unidad abstracta del léxico. La forma de palabra es, en cambio, una realización gramatical específica del lexema, como *cantábamos*, que contiene información de persona, número, tiempo, aspecto y modo. Varias formas corresponden al mismo lexema. La distinción permite describir los paradigmas flexivos.

Los diccionarios organizan sus entradas en torno a los lexemas. La entrada *comer* representa *como*, *comes*, *comíamos* o *comerán*, sin una entrada independiente para cada forma, porque la gramática genera o relaciona el paradigma. La interacción entre léxico y morfología muestra que el lexema no es una cadena de letras almacenada. Es una unidad abstracta con propiedades semánticas, sintácticas y morfológicas.

## Homonimia léxica

Una misma forma puede corresponder a lexemas diferentes. *Banco* designa un asiento o una institución financiera, dos lexemas que pueden representarse como BANCO₁ y BANCO₂. La identidad formal no garantiza la identidad léxica, un punto que la semántica desarrolla.

## El morfema

El morfema suele definirse como la unidad mínima de significado o de función gramatical (Aronoff y Fudeman, 2011). En *gatos* puede segmentarse *gat-o-s*, donde *gat-* aporta el contenido léxico, *-o* la información de género o clase y *-s* el plural. El morfema es una unidad abstracta. La forma fonológica que lo realiza se llama morfo. La aparente simplicidad de esta definición se quiebra, sin embargo, rápidamente.

El morfema no coincide con la sílaba. La *-s* de *gatos* es un morfema pese a no formar sílaba propia. En *imposible*, la frontera entre *im-* y *posible* no coincide con una división silábica sencilla, porque la fonología y la morfología segmentan la cadena según principios diferentes. Tampoco coincide con la palabra. Un morfema puede ser una palabra independiente, como *pan*, o estar ligado a otra base, como la *-s* del plural. Los morfemas libres pueden formar una palabra por sí solos; los ligados necesitan asociarse a una base. La distinción es útil, si bien categorías como los clíticos desafían una frontera nítida.

## Raíz, base y afijo

La raíz es el núcleo morfológico en torno al cual se organiza una palabra y suele portar su contenido léxico. En *nacionalizar*, *nacion-* puede identificarse como raíz en un análisis determinado, aunque el concepto se define de maneras distintas según la teoría. En las lenguas semíticas, las raíces pueden ser discontinuas; una raíz no corresponde necesariamente a una secuencia continua.

Una base es cualquier forma a la que se aplica un proceso morfológico. *Nación* funciona como base de *-al* en *nacional*; *nacional* es, a su vez, la base de *nacionalizar*. La base depende de la operación analizada, sin equivaler necesariamente a la raíz.

Un afijo es un elemento ligado que se añade a una base. El prefijo la precede, como en *infeliz*; el sufijo la sigue, como en *felizmente*. Un infijo se inserta dentro de la base, como el *-um-* del tagalo, que convierte *sulat* 'escribir' en *sumulat* 'escribió'. Un circunfijo rodea la base con dos partes, como el participio alemán *gespielt*, formado sobre *spielen* 'jugar' con *ge-* y *-t* (Lieber, 2016). El español usa sobre todo prefijos y sufijos, dentro de una diversidad tipológica mucho mayor.

## Flexión y derivación

La morfología distingue dos grandes funciones. La flexión crea formas gramaticales de un mismo lexema, como *niño* y *niños*. La derivación crea lexemas nuevos o modifica propiedades léxicas, como *nación* y *nacional*. La diferencia parece simple; existen, sin embargo, casos fronterizos.

La flexión suele responder a exigencias gramaticales, producir paradigmas, conservar la categoría léxica y ser muy productiva. *Niño* y *niños* pertenecen al mismo lexema nominal, lo mismo que *canto*, *cantaba* y *cantaré* son formas de CANTAR. La derivación puede crear un lexema nuevo, cambiar la categoría, modificar el significado y ser menos productiva, como el paso del adjetivo *feliz* al sustantivo *felicidad*. No toda derivación cambia la categoría, porque *hacer* y *rehacer* son ambos verbos. Flexión y derivación se distinguen, por eso, mediante un conjunto de propiedades; ninguna basta por sí sola.

## Alomorfía y supleción

La relación entre morfema y sonido tampoco es biunívoca, porque un mismo morfema puede tener varias realizaciones, un fenómeno llamado alomorfía. El plural inglés se realiza como [s] en *cats*, como [z] en *dogs* y como [ɪz] en *horses*, según el contexto fonológico, como vio el capítulo 13. Estas formas pueden tratarse como alomorfos del mismo morfema o relacionarse mediante operaciones fonológicas, según el modelo. El hecho observado es la distribución. Elegir un mecanismo requiere hipótesis adicionales.

En otros casos, la forma no puede derivarse con una regla fonológica simple. El inglés *go* tiene el pasado *went*; el español *ir* reúne *voy*, *fui* e *iba*, como mostró el capítulo 5. Este fenómeno se llama supleción, porque un mismo paradigma usa formas de orígenes históricos distintos. La supleción muestra que el léxico puede almacenar relaciones que no se reducen a la composición regular de morfemas.

## Morfema cero

La oposición entre *gato* y *gatos* plantea cómo representar el singular. Una posibilidad es postular un morfema cero, sin forma audible, que expresaría el singular y mantendría la simetría del paradigma. Algunos análisis del español tratan del mismo modo la persona y el número de la tercera persona singular en *canta*, frente a *cantas* o *cantan* (Real Academia Española y Asociación de Academias de la Lengua Española, 2009). El recurso debe usarse con cuidado. Si se postulan morfemas cero cada vez que falta material, la teoría se vuelve imposible de refutar. Un morfema cero necesita, por eso, evidencia estructural independiente.

La ausencia de un sufijo no demuestra, por sí sola, la presencia de un cero, porque puede describirse simplemente una forma no marcada. La decisión depende del modelo. Una ausencia puede analizarse como estructura, aunque no toda ausencia es una entidad. La morfología reproduce aquí un problema general de las ciencias, el de cuándo postular algo no observable para explicar un patrón.

## Exponencia acumulativa y segmentación

Una forma puede expresar varias funciones sin ser insegmentable. Un análisis convencional de *cantábamos* distingue la raíz *cant-*, la vocal temática *-a-*, la marca *-ba-* del imperfecto de indicativo y la terminación *-mos* de primera persona del plural (Real Academia Española y Asociación de Academias de la Lengua Española, 2009). La exponencia acumulativa, término de Matthews (1991), aparece porque *-mos* realiza a la vez la persona y el número. No cabe concluir que toda la secuencia *-ábamos* sea una pieza indivisible por el solo hecho de que el verbo exprese varios rasgos. Otros modelos relacionan formas completas del paradigma, aunque deben explicitar esa decisión.

El problema opuesto es segmentar demasiado. Si se insiste en asignar un segmento a cada función, pueden inventarse fronteras sin respaldo. Una forma puede expresar múltiples rasgos; un rasgo puede manifestarse en múltiples posiciones, de modo que la correspondencia entre forma y función no es necesariamente biunívoca.

## Morfología no concatenativa

La morfología introductoria presenta las palabras como una raíz a la que se añaden afijos, un modelo que funciona bien para muchas formas del español sin describir toda la diversidad de las lenguas. Existen procesos de modificación interna, de reduplicación, de cambio tonal y de plantillas consonánticas y vocálicas, que componen la morfología no concatenativa (Spencer, 1991).

Las lenguas semíticas son el ejemplo clásico. En árabe, muchas relaciones léxicas se organizan en torno a raíces consonánticas discontinuas, como *k-t-b*, asociada a la escritura, que se combina con distintos patrones vocálicos en *kataba* 'escribió', *kitāb* 'libro', *kātib* 'escritor' o *maktab* 'oficina'. La forma final no se obtiene añadiendo un sufijo a una raíz continua, lo que muestra que un morfema no equivale necesariamente a una cadena segmental continua.

En la reduplicación se copia una parte o la totalidad de una forma para expresar pluralidad, intensidad, aspecto o distribución. El indonesio forma el plural de *rumah* 'casa' como *rumah-rumah*. El tagalo marca el aspecto futuro copiando la primera sílaba, como en *susulat* 'escribirá'. El español no usa la reduplicación en su morfología estándar, aunque la conversación la emplea para señalar el sentido prototípico de una palabra, como en «¿café café o descafeinado?». La reduplicación muestra que los procesos morfológicos operan sobre la estructura fonológica.

## Clíticos

Los clíticos ocupan una posición intermedia entre la palabra independiente y el afijo. En *me lo dijo*, *me* y *lo* se comportan sintácticamente como pronombres y dependen prosódicamente del verbo. En *dímelo* aparecen unidos a él en la escritura, de manera que el mismo elemento se escribe separado o unido según su posición. El proclítico se apoya en la palabra siguiente, como en *me dijo*; el enclítico, en la anterior, como en *dime*. Los clíticos tienen propiedades sintácticas, morfológicas y prosódicas a la vez. Por eso han ocupado un lugar de primer orden en los debates sobre las interfaces gramaticales.

## Compuestos, frases e idiomaticidad

*Lavaplatos* es una palabra compuesta, mientras que *lava platos* puede ser una secuencia de verbo y sustantivo. La forma gráfica ayuda sin explicar toda la diferencia, que puede estudiarse mediante el acento, la pluralización, el significado, la cohesión interna y la productividad. El plural *los lavaplatos* no altera el compuesto, lo que muestra que dos bases léxicas pueden formar una unidad morfológica nueva.

Algunas expresiones de varias palabras tienen un significado no composicional. *Echar de menos* no significa lanzar algo de menos, lo que plantea si esas expresiones pertenecen al léxico o a la sintaxis. Algunas teorías tratan el léxico como un depósito de unidades complejas, mientras que otras hablan de construcciones almacenadas de distintos tamaños. La frontera entre palabra y frase no coincide siempre con la frontera entre léxico y gramática.

## Productividad

Un proceso morfológico es productivo cuando puede aplicarse sistemáticamente a bases nuevas. Cuando apareció WhatsApp, los hablantes formaron *wasapear* con el mismo sufijo verbal *-ear* de *tutear* o *golpear*. Cualquier hispanohablante comprende, además, una forma inédita como *descontextualizable*. La productividad muestra que la morfología no consiste en memorizar palabras existentes, porque los hablantes tienen un conocimiento generativo.

La productividad no es una propiedad de todo o nada (Bauer, 2003). Un sufijo puede ser muy productivo, limitado o lexicalizado. Puede aplicarse, además, solo a ciertas categorías o a bases con determinadas propiedades fonológicas, como un patrón que acepta bases nominales y rechaza las verbales. La productividad debe medirse, por tanto, según la frecuencia, las restricciones, la aparición de palabras nuevas y su aceptabilidad.

## Bloqueo y lexicalización

A veces una forma regular no se usa porque ya existe otra convencional para el mismo concepto, un fenómeno llamado bloqueo. Aronoff (1976) observó que el inglés forma *curiosity* sobre *curious*, mientras que *furiosity* no se forma sobre *furious*, porque *fury* ya ocupa ese lugar. El léxico no es independiente de las reglas productivas. Las palabras almacenadas pueden restringir las nuevas formaciones.

Una expresión inicialmente composicional puede adquirir, con el tiempo, un significado propio, un proceso llamado lexicalización. *Bolsillo* conserva el sufijo diminutivo de *bolso*, pese a que su significado actual no es el de un bolso pequeño. La historia explica el origen de la forma, mientras que la competencia actual puede almacenarla como un lexema independiente. Reaparece aquí la distinción entre explicación histórica y análisis sincrónico.

## Morfología y significado

La relación entre *feliz* e *infeliz* sugiere que *in-* expresa negación, aunque incluso los prefijos más transparentes tienen distintos alcances y sentidos. En *imposible*, *inexacto* o *incapaz*, su contribución se aproxima a la negación, con matices que dependen del tipo de base. La morfología construye significado sin funcionar como un diccionario de afijos con definiciones rígidas.

La derivación transforma, además, la arquitectura conceptual. *Normal* designa una propiedad, *normalidad* una abstracción nominal y *normalizar* un proceso o una acción. Esa transformación tiene consecuencias en la escritura científica.

## Nominalización y agentes ocultos

La nominalización convierte verbos o adjetivos en sustantivos, como en *decidir* y *decisión*, *evaluar* y *evaluación* o *normal* y *normalidad*. Permite hablar de procesos como objetos del discurso. La ciencia depende mucho de ella. Conceptos como *regulación*, *integración*, *clasificación* o *interpretación* permiten construir teorías abstractas.

La nominalización tiene también riesgos. «El comité rechazó la solicitud» nombra al agente, mientras que «Se produjo el rechazo de la solicitud» lo elimina. La nominalización puede volver opacas las relaciones de agencia, responsabilidad y causalidad; no es una simple cuestión de estilo. Modifica qué información queda gramaticalmente en primer plano.

## Neologismo y parafasia morfológica

Un neologismo es una forma nueva respecto de un repertorio lingüístico determinado. Una palabra nueva puede ser completamente normal, porque la innovación léxica es constante. Para considerar clínicamente significativo un neologismo hay que estudiar su estructura, su contexto, su función, su inteligibilidad y su relación con otros fenómenos. *Neuroconectado* puede ser una creación técnica, una metáfora, un término idiosincrásico o parte de un sistema delirante. La forma por sí sola no lo decide.

La morfología permite describir si un neologismo usa procesos productivos, raíces existentes y afijos convencionales. *Hiperpensamiento* es nuevo en ciertos contextos y morfológicamente transparente, porque se segmenta en *hiper-* y *pensamiento*. Una forma como *tralumancia* puede no mostrar una segmentación reconocible. Ambas innovaciones son lingüísticamente diferentes, como anticipó el capítulo 12 al distinguir las formas inexistentes de las fonológicamente imposibles.

En los trastornos neurológicos pueden aparecer errores de flexión, de derivación o de selección de morfemas. Una persona puede producir una raíz correcta con una terminación verbal inadecuada, como «ayer como» por «ayer comí», lo que sugiere que el léxico, la morfología y la sintaxis pueden disociarse parcialmente. La morfología clínica necesita describir el patrón antes de inferir el mecanismo.

## Morfología y escritura científica

La ciencia usa la morfología para crear términos como *psicopatología*, *neurocognitivo*, *multidimensional* o *intersubjetividad*, que condensan conceptos. Una forma compleja no garantiza, sin embargo, un concepto preciso, porque pueden generarse palabras bien formadas que carecen de una definición clara. La sofisticación morfológica puede producir una ilusión de rigor.

Un texto académico puede acumular *operacionalización*, *dimensionalización*, *conceptualización* y *sistematización*. Cada palabra puede ser legítima. El problema aparece cuando reemplaza acciones simples sin añadir una distinción conceptual. «Analizamos cómo cambia el diagnóstico» no es menos riguroso que «Realizamos una operacionalización de la modificación diagnóstica», porque el rigor depende del contenido, no del número de sufijos.

## Tokenización, morfemas y sistemas de IA

Los modelos de lenguaje dividen el texto en unidades llamadas *tokens*, que no coinciden necesariamente con los morfemas. Los algoritmos de segmentación subléxica, como la codificación por pares de bytes, reúnen fragmentos frecuentes de caracteres a partir de un corpus (Sennrich et al., 2016). Un análisis lingüístico de *desorganización* propondría *des-*, *organiz-* y *-ación*, mientras que un tokenizador puede producir otra división, porque ambas segmentaciones responden a objetivos diferentes.

Los sistemas computacionales tropiezan con dificultades particulares en las lenguas con mucha aglutinación, flexión rica o polisíntesis, en las que una sola palabra equivale a una frase de otra lengua. El turco *evlerimizde* 'en nuestras casas' reúne en una palabra la raíz *ev* 'casa', el plural *-ler*, el posesivo *-imiz* y el locativo *-de*. Un sistema basado en un vocabulario de palabras completas sufriría una gran dispersión. La segmentación subléxica mejora su capacidad de generalización. Esa segmentación tiene costos desiguales. Petrov et al. (2023) mostraron que un mismo texto traducido a distintas lenguas puede requerir hasta quince veces más *tokens* en unas que en otras, con consecuencias sobre el costo, la latencia y la cantidad de contexto que el modelo puede procesar.

Los modelos generativos pueden producir palabras inexistentes y morfológicamente plausibles, del mismo modo que un hablante entiende *descontextualizable* sin haberla visto antes. Humanos y modelos explotan regularidades subléxicas, aunque esa semejanza de conducta no demuestra que ambos representen los morfemas del mismo modo.

## El estatus teórico del morfema

La definición clásica del morfema fue muy influyente. Algunas teorías actuales cuestionan, sin embargo, que sea siempre la unidad básica. La supleción, la exponencia acumulativa, los morfemas cero, los cambios internos, la alomorfía y las formas discontinuas motivaron teorías en las que la palabra completa o el paradigma ocupan un lugar preferente. En los enfoques basados en palabras, la unidad principal es la relación entre palabras completas (Blevins, 2016). *Cantar*, *canté* y *cantaremos* pueden relacionarse mediante patrones paradigmáticos sin segmentar cada rasgo en un morfema autónomo, lo que evita algunas segmentaciones artificiales.

Los modelos realizacionales distinguen, por su parte, los rasgos morfosintácticos de las reglas que los realizan fonológicamente (Matthews, 1991). Un rasgo de plural puede recibir formas distintas según el contexto, de modo que el morfema deja de ser una pieza almacenada con forma y significado inseparables. Estos modelos representan mejor la exponencia acumulativa y la alomorfía.

## Cómo segmentar una palabra

Segmentar una palabra no se reduce a cortar donde parece. El análisis busca primero las secuencias recurrentes con una función semejante en otras palabras. Después compara formas relacionadas, como *gato*, *gatos*, *gata* y *gatas*, e identifica qué cambio formal coincide con qué cambio gramatical. Evalúa luego si el patrón se aplica a palabras nuevas, busca contraejemplos en los que la misma secuencia aparezca sin la misma función y evita, por último, postular unidades sin evidencia.

*Desigualdades* puede segmentarse en *des-*, *igual*, *-dad* y *-es*, aunque cada frontera debe justificarse. *Igual* es la base léxica; *des-* aporta oposición o negación según la base; *-dad* forma un sustantivo abstracto; *-es* marca el plural. La estructura es jerárquica, porque *des-* se une primero a *igual*, *-dad* nominaliza después *desigual* y el plural se añade al final. Esa jerarquía no puede reemplazarse arbitrariamente por otra en la que *-dad* y *-es* formen una unidad previa.

En *inutilizable*, una lectura transparente se analiza como *in-* más *utilizable*, «que no es utilizable». *Utilizable* se relaciona a su vez con UTILIZAR mediante la base verbal *utiliza-* y el sufijo *-ble*, sin añadir *-ble* al infinitivo intacto. La jerarquía propuesta une primero *utiliza-* con *-ble* y después el prefijo. Defender otra estructura exigiría mostrar otra interpretación y las formas intermedias pertinentes. Los corchetes de un análisis de este tipo expresan una hipótesis de composición, no una historia etimológica demostrada. El ejemplo distingue la forma de cita del verbo, la base de la derivación y el alcance del prefijo.

## Morfología, paradigma, sintagma, fonología y semántica

Las formas flexivas forman paradigmas. CANTAR reúne *canto*, *cantas*, *canta*, *cantamos* y *cantan*. Cada forma adquiere parte de su función por oposición a las demás, como estudió el capítulo 6. Los morfemas se combinan, además, en un orden restringido. En español es frecuente la secuencia de raíz, derivación y flexión, como en *nacionales*. Bybee (1985) propuso que los afijos más pertinentes para el significado de la raíz tienden a situarse más cerca de ella, lo que explica que la derivación preceda a la flexión. Si esa estructura jerárquica procede de la sintaxis general o de un componente morfológico específico es una cuestión teórica abierta. La distinción entre lo sintagmático y lo paradigmático atraviesa, así, varios niveles.

Los morfemas cambian de forma según el contexto fonológico. La fonología depende, a su vez, de las fronteras morfológicas, en la interacción llamada morfofonología que examinó el capítulo 16 con el prefijo *in-*. La derivación modifica el significado y la flexión expresa relaciones gramaticales, aunque la correspondencia entre forma y significado no es perfecta, porque existen la polisemia, la lexicalización y la irregularidad. La ecuación entre un morfema y un significado resulta demasiado simple. La morfología es un sistema de correspondencias más complejo.

## Síntesis

La morfología estudia cómo las lenguas organizan la estructura interna de las palabras y cómo relacionan formas dentro del léxico y de la gramática. La palabra carece de una definición universal única. Sus versiones ortográfica, fonológica, morfosintáctica y semántica pueden no coincidir. Su identificación exige la convergencia de varios criterios. El lexema es una unidad léxica abstracta que aparece en múltiples formas flexionadas; la forma de palabra, una realización gramatical específica del lexema. El morfema es una unidad abstracta de función gramatical o de significado, cuya relación con la forma no siempre es biunívoca. La raíz, la base y el afijo cumplen papeles distintos. La flexión y la derivación se distinguen por un conjunto de propiedades. La alomorfía muestra que un morfema puede tener varias realizaciones; la supleción, que un paradigma puede reunir formas no relacionadas fonológicamente; la exponencia acumulativa, que una forma puede expresar varios rasgos a la vez. La morfología no concatenativa muestra que los procesos no se reducen a añadir prefijos y sufijos. Los clíticos desafían la frontera entre palabra y afijo. Los compuestos y las expresiones idiomáticas muestran que léxico y sintaxis no son compartimentos separados. La productividad muestra que los hablantes generan formas nuevas; la lexicalización, que una forma composicional puede adquirir propiedades idiosincrásicas. En la clínica, la morfología permite diferenciar las innovaciones léxicas, los errores flexivos y los neologismos estructurados. En la escritura científica, ayuda a comprender cómo las nominalizaciones y los tecnicismos modifican la agencia y la abstracción. En la inteligencia artificial, recuerda que los *tokens* y los morfemas son unidades distintas. Segmentar una palabra es formular una hipótesis sobre las correspondencias sistemáticas entre forma, función, paradigma y estructura, algo muy distinto de dividirla visualmente.

El capítulo 18 estudia la flexión nominal, con el género, el número y el caso. Muestra, además, por qué las categorías gramaticales no deben confundirse con propiedades de los referentes.

## Referencias

Aronoff, M. (1976). *Word formation in generative grammar*. MIT Press.

Aronoff, M. y Fudeman, K. (2011). *What is morphology?* (2.ª ed.). Wiley-Blackwell.

Bauer, L. (2003). *Introducing linguistic morphology* (2.ª ed.). Edinburgh University Press.

Blevins, J. P. (2016). *Word and paradigm morphology*. Oxford University Press.

Booij, G. (2012). *The grammar of words: An introduction to linguistic morphology* (3.ª ed.). Oxford University Press.

Bybee, J. L. (1985). *Morphology: A study of the relation between meaning and form*. John Benjamins.

Haspelmath, M. y Sims, A. D. (2010). *Understanding morphology* (2.ª ed.). Routledge.

Lieber, R. (2016). *Introducing morphology* (2.ª ed.). Cambridge University Press.

Matthews, P. H. (1991). *Morphology* (2.ª ed.). Cambridge University Press.

Petrov, A., La Malfa, E., Torr, P. H. S. y Bibi, A. (2023). Language model tokenizers introduce unfairness between languages. En *Advances in Neural Information Processing Systems 36*. https://proceedings.neurips.cc/paper_files/paper/2023/hash/74bb24dca8334adce292883b4b651eda-Abstract.html

Real Academia Española y Asociación de Academias de la Lengua Española. (2009). *Nueva gramática de la lengua española*. Espasa.

Sennrich, R., Haddow, B. y Birch, A. (2016). Neural machine translation of rare words with subword units. En *Proceedings of the 54th Annual Meeting of the Association for Computational Linguistics* (Vol. 1, pp. 1715–1725). Association for Computational Linguistics. https://doi.org/10.18653/v1/P16-1162

Spencer, A. (1991). *Morphological theory*. Blackwell.
