-
La CPI declara al expresidente filipino Duterte en condiciones de ser juzgado
-
EEUU presenta nueva acusación contra expresidente venezolano Maduro y su esposa por tortura
-
Los socialistas, la arriesgada apuesta del Partido Demócrata para recuperar el Congreso
-
Alex Bodi mizează, alături de CRIF, pe investiții transparente și pe prevenirea riguroasă a spălării banilor
-
La mujer que sobrevivió a ejecución fallida en EEUU camina pero está mentalmente "confundida"
-
Mujer que sobrevivió a ejecución fallida en EEUU camina pero está mentalmente "confundida"
-
La tormenta Isaías se convierte en huracán rumbo a EEUU
-
La Fórmula 1 volverá a África con el Gran Premio de Ruanda
-
Las protestas estudiantiles, símbolo del malestar en una Francia endeudada
-
Un bombardeo ruso contra dos autobuses en Ucrania deja 30 muertos
-
"Gracias por todo": cientos de personas despiden a Maricarmen en Madrid
-
Bombardeo ruso contra dos autobuses en Ucrania deja 30 muertos
-
El costo de vida preocupa a los votantes en EEUU antes de las elecciones de medio término
-
La OMC revisa al alza sus previsiones de crecimiento del comercio mundial de mercancías
-
Meloni supera una prueba clave en Italia al aprobar una reforma electoral
-
El PKK asegura haber retirado a todos sus combatientes de Turquía
-
Corea del Sur prueba su primera arma hipersónica
-
Anne Carson, la poeta canadiense que moderniza la antigüedad
-
Un adolescente mata a una persona y hiere a otras dos en una escuela de Polonia
-
La NBA mantiene su plan de campeonato en Europa, pese al rechazo de la Euroliga
-
La embajadora de EEUU en Grecia pidió 100.000 dólares a un donante de Trump, según WSJ
-
China anuncia su candidata a dirigir la OMS
-
El líder de los ecologistas británicos busca entrar al Parlamento en una elección clave
-
Los cortes de luz alimentan el malhumor en las calles de Venezuela
-
Un juez decide la suerte de los presuntos asesinos de unos surfistas en México
-
El Nobel premia la obra "atrevida" de la poetisa canadiense Anne Carson
-
Juez decide la suerte de presuntos asesinos de surfistas en México
-
Tres empleados despedidos piden a OpenAI no crear una IA cuyo razonamiento sea ilegible
-
El líder de Birmania repatriará "lo antes posible" a los migrantes de su país detenidos en Malasia
-
El presidenciable brasileño Bolsonaro pide ayuda contra el narco al presidente de Colombia
-
La expulsión de migrantes de EEUU a África busca "instrumentalizar el sufrimiento humano", afirma HRW
-
Bally Bagayoko, alcalde de una juventud francesa sublevada
-
"Ya no sé a quién creer", los siberianos viven entre rumores y miedo a la peste
-
Un bombardeo ruso contra autobuses mata al menos a 30 personas en este de Ucrania
-
Unos manifestantes interrumpen a Trump en un mitin en Texas
-
Corea del Norte exige al Sur "máximo respeto" si quiere restablecer las relaciones
-
Bombardeo ruso contra autobuses mata al menos 30 personas en este de Ucrania
-
Corea del Sur dice que los supuestos envíos de diésel a Rusia no están prohibidos
-
El gobierno francés recibirá a organizaciones estudiantiles en una nueva jornada de protestas
-
Ambientalistas califican de "engaño" el plan para reactivar una mina en Panamá
-
Los organizadores de la COP31 prometen un programa de acción "ambicioso"
-
Arabia Saudita afirma que los ataques reivindicados por los hutíes contra aeropuertos dejan tres muertos
-
Japón pide a China que muestre "respeto" al dirigirse a su primera ministra
-
El Corinthians anuncia la destitución del técnico Fernando Diniz
-
El Salvador se prepara ante un posible riesgo alimentario por El Niño
-
Organizadores de la COP31 prometen programa de acción "ambicioso"
-
Samsung prevé un aumento de más del 780% en su utilidad operativa del 3T
-
Fujimori crea un comando militar policial para dirigir la lucha contra el crimen organizado en Perú
-
Trump concede una medalla a Musk y a otros directivos de tecnológicas
-
Murió el cantautor argentino Piero, compositor de "Mi viejo"
ChatGPT y las IA conversacionales siguen siendo incapaces de razonar, según un estudio
Los modelos de lenguaje de gran tamaño (LLM), como ChatGPT, uno de los sistemas de inteligencia artificial más populares del mundo, siguen teniendo dificultades para razonar usando la lógica y se equivocan con frecuencia, según un estudio.
Estos robots conversacionales reflejan los sesgos de género, éticos y morales de los humanos presentes en los textos de los que se alimenta, recuerda el estudio aparecido el miércoles en la revista Open Science de la Royal Society británica.
¿Pero reflejan también los sesgos cognitivos de los humanos en las pruebas de razonamiento?, se preguntó Olivia Macmillan-Scott, estudiante de doctorado del departamento de ciencias de computación de la University College de Londres (UCL).
El resultado de la investigación es que los LLM muestran "un razonamiento a menudo irracional, pero de una manera diferente a la de los humanos", explica la investigadora a AFP.
Bajo la dirección de Mirco Musolesi, profesor y director del Machine Intelligence Lab de UCL, Macmillan-Scott sometió siete modelos de lenguaje -dos versiones de ChatGPT (3.5 y 4) de OpenAI, Bard de Google, Claude 2 de Anthropic y tres versiones de Llama de Meta- a una serie de pruebas psicológicas pensadas para humanos.
¿Cómo afrontan, por ejemplo, el sesgo que lleva a favorecer soluciones con el mayor número de elementos, en detrimento de las que tiene una proporción adecuada?
Un ejemplo. Si tenemos una urna con nueve canicas blancas y una roja y otra urna con 92 blancas y 8 rojas, ¿cual hay que elegir para tener más posibilidades de sacar una canica roja?
La respuesta correcta es la primera urna, porque hay un 10% de posibilidades frente a solo un 8% para la segunda opción.
Las respuestas de los modelos de lenguaje fueron muy inconstantes. Algunos respondieron correctamente seis de cada diez veces la misma prueba. Otros solo dos de diez aunque la prueba no cambió.
"Obtenemos una respuesta diferente cada vez", apuntala la investigadora.
Los LLM "pueden ser muy buenos para resolver una ecuación matemática complicada pero luego te dicen que 7 más 3 son 12", afirma.
En un caso el modelo denominado Llama 2 70b se negó de manera sorprendente a responder a una pregunta alegando que el enunciado contenía "estereotipos de género dañinos".
- "No estoy muy seguro" -
Estos modelos "no fallan en estas tareas de la misma manera que falla un humano", señala el estudio.
Es lo que el profesor Musolesi llama "errores de máquina".
"Hay una forma de razonamiento lógico que es potencialmente correcta si la tomamos por etapas, pero que está mal tomada en su conjunto", apunta.
La máquina funciona con "una especie de pensamiento lineal", dice el investigador, y cita al modelo Bard (ahora llamado Gemini), capaz de realizar correctamente las distintas fases de una tarea pero que obtiene un resultado final erróneo porque no tiene visión de conjunto.
Sobre esta cuestión el profesor de informática Maxime Amblard, de la Universidad francesa de Lorena, recuerda que "los LLM, como todas las inteligencias artificiales generativas, no funcionan como los humanos".
Los humanos son "máquinas capaces de crear sentido", lo que las máquinas no saben hacer, explica a AFP.
Hay diferencias entre los distintos modelos de lenguaje y en general GPT-4, sin ser infalible, obtuvo mejores resultados que los demás.
Macmillan-Scott afirma sospechar que los modelos llamados "cerrados", es decir cuyo código operativo permanece en secreto, "incorporan otros mecanismos en segundo plano" para responder a preguntas matemáticas.
En todo caso, por el momento, es impensable confiar una decisión importante a un LLM.
Según el profesor Mosulesi, habría que entrenarlos para que respondan "No estoy muy seguro" cuando sea necesario.
W.Lapointe--BTB