Breaking
USFlash flood in Nepal and Tibet kills hundreds, leaves thousands missing as glacier instability worsensPLKradzież skarbu z Villena – złodzieje zabrali większość kolekcji z muzeumTRElazığ'da Yıldırım Çarpmasıyla 10 Yaşındaki Kız Çocuğu Hayatını KaybettiKR아이슬란드 EU 가입 국민투표 앞두고 여론 뒤집혀…반대 51.6%, 찬성 48.4%BRColar com mais de 670 diamantes que pertenceu à rainha egípcia é roubado de museu em VienaINनेपाल में बाढ़ से कई भारतीय लापता, कैलाश मानसरोवर यात्रा पर चर्चाSEKung Harald V av Norge avliden – minnesord från idrottsstjärnorINMeta settles youth mental health and data privacy claims with 52 attorneys general for $18 billionARالهيئة السعودية للزكاة والضريبة والجمارك تحبط محاولة تهريب 1.95 مليون حبة إمفيتامين مخبأة في عدسDEUgandas jüngster König Oyo Nyimba Kabamba Iguru Rukidi IV im Alter von 34 Jahren gestorbenUSFlash flood in Nepal and Tibet kills hundreds, leaves thousands missing as glacier instability worsensPLKradzież skarbu z Villena – złodzieje zabrali większość kolekcji z muzeumTRElazığ'da Yıldırım Çarpmasıyla 10 Yaşındaki Kız Çocuğu Hayatını KaybettiKR아이슬란드 EU 가입 국민투표 앞두고 여론 뒤집혀…반대 51.6%, 찬성 48.4%BRColar com mais de 670 diamantes que pertenceu à rainha egípcia é roubado de museu em VienaINनेपाल में बाढ़ से कई भारतीय लापता, कैलाश मानसरोवर यात्रा पर चर्चाSEKung Harald V av Norge avliden – minnesord från idrottsstjärnorINMeta settles youth mental health and data privacy claims with 52 attorneys general for $18 billionARالهيئة السعودية للزكاة والضريبة والجمارك تحبط محاولة تهريب 1.95 مليون حبة إمفيتامين مخبأة في عدسDEUgandas jüngster König Oyo Nyimba Kabamba Iguru Rukidi IV im Alter von 34 Jahren gestorben
BackEl uso de IA generativa reduce la complejidad lingüística y homogeniza el lenguaje, según un estudio
El uso de IA generativa reduce la complejidad lingüística y homogeniza el lenguaje, según un estudio
Developing
El País Tecnología2 hours agoTech3 min readSpain

El uso de IA generativa reduce la complejidad lingüística y homogeniza el lenguaje, según un estudio

Quick Look

Un estudio de la Universidad del Sur de California publicado en Nature Human Behaviour revela que el uso de modelos de lenguaje grandes como ChatGPT ha reducido la complejidad lingüística de los textos en internet entre un 21% y un 50%, eliminando marcadores personales y sociales que reflejan identidad, género y personalidad, y generando sesgos hacia estilos asociados a hombres mayores y políticamente liberales, lo que preocupa a expertos en lingüística forense y sociolingüística por su impacto en la detección de autoría y diagnósticos de salud mental.

AI-generated summary

Why It Matters

Antes de la llegada de la IA generativa, ya existía preocupación por la homogeneización del lenguaje como amenaza a la diversidad y el pensamiento libre, ejemplificada por la neolengua de 1984 de George Orwell. El estudio parte de la premisa que las personas expresan ideas similares de distintas maneras, lo que revela contexto social, personalidad y salud.

Font size

Los textos creados con IA generativa tienden a sonar planos o predecibles, pese a que poco a poco mejoran para ser menos distinguibles de un producto humano y, a veces, lo consiguen. El motor detrás de esa “inteligencia” son los modelos de lenguaje grandes o LLM (por las siglas en inglés de large language models), a los que se entrena con enormes cantidades de textos para que aprendan a poner una palabra detrás de otra por probabilidad estadística hasta parecer, casi, escritos por una persona. Sin embargo, cuando se analizan, se encuentran sesgos de sobrerrepresentación de ciertas palabras, signos de puntuación e incluso rasgos distintivos de grupos sociales mayoritarios. El resultado, tan parecido a lo humano, es sorprendente, pero la pérdida de riqueza lingüística también es un hecho y los posibles riesgos son tema de debate e investigación.

Antes de que la IA llegase a nuestras vidas, la homogeneización del lenguaje ya era una amenaza para la diversidad, las democracias y el pensamiento libre. En 1984, George Orwell planteó un futuro distópico en el que la neolengua, impuesta por El Partido en el poder, conseguía anular el pensamiento crítico de la ciudadanía. Al margen de su uso como herramienta de control, la pérdida de matices distintivos en el lenguaje puede diluir los rasgos que nos identifican incluso individualmente, algo que un nuevo estudio sobre el uso extendido de los LLM ha explorado y publica hoy en Nature Human Behaviour.

Las personas expresamos ideas similares de diferentes maneras y esto ofrece información sobre nuestro contexto social, personalidad e incluso salud. Esta es la premisa bajo la que un grupo de investigadores de la Universidad del Sur de California (Estados Unidos) han hecho una serie de experimentos con los que han hallado que, desde que empezamos a usar ChatGPT en 2022, la complejidad lingüística de lo que escribimos en internet se ha reducido entre un 21% y un 50%. Para ello analizaron más de 800.000 textos de distintas plataformas como Reddit, el foro con una sección donde se escriben historias creativas, un repositorio de artículos científicos en abierto o Patch News, un portal de noticias comunitarias, todos en inglés.

Como explican los autores en el artículo, “la diversidad transforma el lenguaje, de mero medio de intercambio de información a expresión única de individuos y sociedades, lo que permite analizar los productos culturales y las tendencias sociales”. Calcularon que, en un 87% de los casos, el significado de los textos se mantenía cuando le pedían a varias IAs generativas (GPT-3.5, Llama 3 70B y Gemini Pro) que reescribieran los textos recopilados de internet. Cuando les ordenaron reformularlos, mejorar su claridad o fluidez, o hacerlos más académicos, naturales o concisos, varios índices estimaron una pérdida en la complejidad de las nuevas versiones. “En nuestros experimentos, el significado permaneció casi intacto, pero cada persona expresa la misma idea de distintas maneras y eso es lo que vimos que se perdía”, explica el primer autor del estudio, Zhivar Sourati.

Las particularidades que caracterizan a la persona detrás de cada texto fueron, de media, un 6% menos identificables. “Por ejemplo, una oración que comienza con ‘creo que esto demuestra…’ puede cambiarse a ‘esto sugiere…’, donde el contenido es el mismo, pero vimos que los pronombres personales como ‘yo’, ‘nosotros’ y ‘tú’ se usan mucho menos”, cuenta Sourati a EL PAÍS. También se eliminan palabras coloquiales como ‘eh’ o ‘sabes’ y se ve afectada la expresión emocional. “La IA no elimina la emoción; de hecho, los textos reescritos contienen, en promedio, un lenguaje ligeramente más emotivo, pero la forma personal de expresarla desaparece”, añade el investigador.

Un problema para forenses y sociolingüistas

Estos matices que la IA lima sirven como marcadores culturales a la sociolingüística o incluso para hacer diagnósticos de salud mental. También permiten hacer su trabajo a quienes, como Sheila Queralt, se dedican a la lingüística forense. La perito judicial explica por correo a EL PAÍS que esto es especialmente importante cuando tienen que analizar la autoría de un escrito, porque “una parte de la información que utilizamos para caracterizar la producción de un escritor no reside únicamente en lo que dice, sino en cómo lo formula y en los patrones de variación que aparecen en sus textos”. Sin embargo, Queralt matiza que “el estudio no permite concluir que la IA vaya a hacer que todos acabemos escribiendo igual”, sino que atenúa, transforma u homogeniza determinadas señales lingüísticas.

En este sentido, Sourati explica que “las personas extrovertidas usan más palabras relacionadas con la vida social, como ‘amigos’, ‘fiesta’ o ‘nosotros’ y con emociones positivas; quienes valoran la lealtad usan más palabras relacionadas con la familia, mientras que las personas de mente abierta tienden a usar palabras más elaboradas y complejas”. Además, añade que existen diferencias entre hombres y mujeres: ellos usan menos palabras relacionadas con la vida social y la ansiedad que ellas.

Un hallazgo especialmente preocupante es que estos cambios no son aleatorios, sino que, en los conjuntos de datos analizados, observaron un sesgo constante en los textos reescritos por LLM. Los estilos de escritura a menudo se alineaban con “individuos mayores, varones y políticamente liberales, que exhiben una valencia moral positiva y menor empatía”, describe el artículo. Como explica Sourati, se atenuaron asociaciones entre “uso de pronombres y extroversión, entre palabras relacionadas con la amistad y la lealtad como valor moral, y entre palabras orientadas al futuro, como ‘voy a’ o ‘pronto’ y la edad de quien las escribe”. Sin embargo, vieron que se mantenía el vínculo entre palabras que expresaban emociones negativas y neuroticismo, entre palabras relacionadas con religión y pureza, y entre palabras sociales y género.

IAs que fingen no serlo

Estos sesgos amenazan el funcionamiento de métodos empleados en psicología o sociolingüística que se basan en señales léxicas, que pueden volverse menos fiables con la expansión del uso de los LLM para comunicarnos por escrito. Esto también se vuelve problemático en los contextos judiciales en los que trabaja Queralt, que dirige el Laboratorio SQ–Lingüistas Forenses. Aquí se enfrentan a otro problema añadido por la IA: los humanizadores de textos, que buscan esquivar las herramientas de detección de IA de las que se valen en su laboratorio o en el estudio de Sourati.

Un estudio reciente que ha hecho Queralt, a través del proyecto CorpIdentIA, pone a prueba a los “humanizadores de IA”. En él evaluaron tres herramientas detectoras —GPTZero, Originality.ai y Copyleaks—, que, según sus resultados, funcionan bastante bien tanto frente a los textos puramente humanos como a los generados completamente con IA. Pero no así con los híbridos, los que mezclaban ambos lenguajes. “Probablemente estos escenarios representan mejor muchos de los usos actuales de la IA: una persona puede escribir un texto y pedir a un modelo que lo corrija o reformule, o puede partir de un texto generado mediante IA y modificarlo posteriormente”, explica la investigadora.

Con GPTZero, prácticamente uno de cada dos textos generados mediante IA y posteriormente humanizados, el 52,2%, fue clasificado como humano; Originality.ai identificó correctamente el 65,56%, y Copyleaks, el 72,22%. “Desde el punto de vista lingüístico encontramos que ‘humanizar’ un texto no significa necesariamente hacerlo lingüísticamente más humano”, apunta Queralt. Algunos de estos sistemas introducen irregularidades gramaticales, ortográficas y otras pequeñas transformaciones que rompen la regularidad del texto sin modificar profundamente su contenido u organización. En algunos casos, incluso empeoran su naturalidad lingüística, pero consiguen que resulte menos detectable para determinados sistemas.

“En nuestro estudio, uno de los textos originales decía: ‘No me apetece perder tiempo ni energía en trámites’, y después de pasar por uno de los humanizadores se convirtió en: ‘Me disipan perder el tiempo y la energía en לענו/rrijgs’”, señala Queralt. Ahí está la diferencia entre un error humano espontáneo y un un caso de “corrupción textual extrema”, como lo llama el estudio. “La variabilidad humana no equivale a introducir ruido aleatorio en un texto”, resume Queralt sobre la paradoja que encuentran aquí los lingüistas: un texto puede ser muy poco natural y que, sin embargo, un detector automático no lo identifique como IA.

Un reflejo exagerado de tendencias humanas

Para quienes están estudiando el impacto social de la IA, hay muchos retos por delante de cara a anticipar consecuencias y desarrollar políticas que nos protejan. Pero también hay cautela y tratan de reducir la alarma. Para Ezequiel López, investigador en ciencias computacionales en el Instituto Max Planck para el Desarrollo Humano de Berlín, escribir se está convirtiendo en “una tarea de colaboración entre humano y máquina, sobre todo cuando va a leernos una tercera persona, porque nadie quiere parecer inculto o escribir mal, y a cambio aceptamos la homogeneización”.

Sin embargo, López explica que los modelos son máquinas estadísticas que reflejan o incluso exageran objetivos y tendencias que teníamos en el mundo sin estos modelos. “Por ejemplo, al hablar públicamente, tendemos a evitar significarnos políticamente o emplear lenguaje negativo, y las IAs generativas de texto, en parte, reflejan estos estándares sociales que llevamos décadas desarrollando, creo que con fuerte influencia de la cultura comunicativa estadounidense”, apunta el investigador. Advierte que el problema podría ser que la sociedad siga siendo sexista, pero desaparezca del lenguaje, y opina que seguramente se están “separando un poco la burbuja de la comunicación online de la realidad”.

What to Watch

AI outlook — possibilities, not facts

  • El uso de humanizadores de texto aumentará para evadir detectores de IA, pese a su bajo rendimiento lingüístico

    Likely · Within months

  • Los sesgos lingüísticos de los LLM serán objeto de mayor regulación en contextos judiciales y educativos

    Possible · Within years

Open Questions

  • ¿Cómo afectará la reducción de complejidad lingüística a la educación y el desarrollo cognitivo a largo plazo?
  • ¿Existen diferencias en el impacto de la IA según el idioma o la cultura lingüística?
  • ¿Podrían los humanizadores de texto mejorar para preservar la autenticidad lingüística sin ser detectados como IA?
  • ¿Qué políticas podrían mitigar los sesgos lingüísticos de los modelos de lenguaje grandes?

Related Topics

This article was originally published by El País Tecnología.

Related Stories

Los Juegos Mundiales de Robots Humanoides en Pekín muestran avances en velocidad y autonomía, pero el reto es la utilidad cotidiana
Developing·12 minutes ago

Los Juegos Mundiales de Robots Humanoides en Pekín muestran avances en velocidad y autonomía, pero el reto es la utilidad cotidiana

En los segundos Juegos Mundiales de Robots Humanoides en Pekín, 666 equipos y 2.056 máquinas de 16 países compiten en 51 categorías, 21 de las cuales simulan aplicaciones reales como cargar vehículos eléctricos o manipular medicamentos. Aunque robots como Tiangong Ultra han superado el récord de velocidad de Usain Bolt en 100 metros, el desafío ahora es trasladar capacidades menos vistosas como la percepción, la destreza y la autonomía al mundo real, para que los humanoides sean útiles en fábricas, hospitales y la vida cotidiana.

El País Tecnología
2 min read
Meta enfrenta multa millonaria por adicción en adolescentes y se repite el patrón con la IA
Developing·1 hour ago

Meta enfrenta multa millonaria por adicción en adolescentes y se repite el patrón con la IA

Meta deberá pagar casi 15.500 millones de euros por la adicción causada en adolescentes, una multa considerada tardía e insuficiente. El artículo advierte que se repite el mismo patrón con la IA, donde las empresas priorizan el desarrollo sobre la seguridad. Además, menciona la devaluación del rublo por Rusia para financiar la guerra, el cambio de estrategia de Shein ante una valoración bursátil reducida, y reflexiona sobre la proliferación de impostores en la sociedad actual.

El País Economía
2 min read
Meta acuerda pagar casi 18.000 millones de dólares para retirar demandas por efectos en salud mental de jóvenes
Developing·2 hours ago

Meta acuerda pagar casi 18.000 millones de dólares para retirar demandas por efectos en salud mental de jóvenes

Meta acordó pagar casi 18.000 millones de dólares a fiscales generales de 29 estados de EE UU para retirar demandas que acusan a sus plataformas de dañar la salud mental de menores. El acuerdo incluye restricciones de diseño como límite de dos horas diarias de uso, desconexión nocturna y sin notificaciones en horario escolar, además de reforzar verificación de edad. Analistas señalan que el impacto real está en los cambios de producto, no en el pago, y que podría establecer un estándar para otras redes como TikTok y YouTube.

El País Tecnología
2 min read
Estudio vincula microtransacciones en videojuegos gratuitos con patrones de gasto similares a las apuestas
Developing·2 hours ago

Estudio vincula microtransacciones en videojuegos gratuitos con patrones de gasto similares a las apuestas

Un estudio realizado en Austria con 2.300 estudiantes de entre 10 y 19 años revela que el 10% de los jugadores de videojuegos gratuitos concentra el 61,4% de todas las transacciones, un patrón de gasto extremadamente concentrado comparable solo al de las apuestas. Además, el 14% de estos grandes gastadores presenta síntomas de adicción comportamental. La investigación también destaca prácticas como la 'caza de ballenas' y la similitud entre mecanismos de azar en videojuegos (como loot boxes) y el desarrollo de conductas de juego por dinero en adolescentes, según un estudio longitudinal belga de 2022 a 2024. Se señala la dificultad regulatoria para abordar estos riesgos, especialmente en menores.

El País Tecnología
2 min read
El verano altera los algoritmos de redes sociales sin que estos cambien por diseño
Developing·2 hours ago

El verano altera los algoritmos de redes sociales sin que estos cambien por diseño

Los algoritmos de plataformas como TikTok, Instagram y Spotify no modifican su lógica por el verano, pero responden a cambios masivos en el comportamiento de los usuarios durante esta estación, amplificando contenidos veraniegos como viajes, bikinis o música optimista, lo que genera sesgos en la visibilidad de ciertos cuerpos y tipos de contenido, según expertos de la UPM y la LSE.

El País Tecnología
2 min read
More on this topicia generativa