-
London City, un club 100% femenino en construcción alrededor de Alexia
-
Alexia Putellas y el Balón de Oro: "Que el fútbol hable por mí" (entrevista AFP)
-
Emisión pero en silencio: el apoyo de Irlanda a Gaza se traslada al fútbol
-
Irán propone reabrir el estrecho de Ormuz pero Trump rechaza el plan, según el WSJ
-
TikTok acuerda pagar 100 millones en EEUU para evitar un juicio sobre protección de menores
-
Cierra el segundo ciclo de diálogos entre gobierno interino y oposición de Venezuela
-
EEUU y China abrirán un "canal de comunicación" para incidentes de la IA
-
Una enorme estatua del papa León XIV toma forma en un modesto taller de Perú
-
Los incendios en Indonesia amenazan a orangutanes en peligro de extinción, alerta UICN
-
León XIV se reúne con migrantes antes de su misa gigante en los Campos Elíseos de París
-
Los hutíes lanzan nuevos ataques contra Arabia Saudita
-
Trump rechaza el plan de Irán para reabrir el estrecho de Ormuz, según reportes de prensa
-
León XIV llama a "convivir con dignidad y paz" durante visita a migrantes en París
-
Escasez y precios más altos, el impacto de los ataques rusos en Kiev
-
Francia se prepara para una misa gigante con León XIV en los Campos Elíseos
-
Irán presenta a EEUU un plan para reabrir Ormuz, pero Trump lo habría rechazado
-
Después de Meta, TikTok acepta limitar el tiempo de uso de los adolescentes
-
Irán presenta a EEUU un plan para reabrir el estrecho de Ormuz en siete días
-
Una vida dura y "muchas expectativas" en la cuna petrolera de Venezuela
-
Al menos siete muertos en ataques rusos contra Kiev a plena luz del día
-
Se intensifican los combates en el norte de Etiopía
-
Brasil cerró la competición de San Sebastián con "Las disculpas de Vicentina"
-
Alex Atala: El Niño "puede implicar una pérdida sociocultural"
-
El Niño se mete en la cocina de los grandes chefs
-
Al menos cinco muertos en ataques rusos contra Kiev a plena luz del día
-
La OMC examinará el impuesto de la UE al carbono, a pedido de Rusia
-
España cae ante la República Checa en semis de la Billie Jean King Cup
-
Un prestigioso premio literario de Francia retira una novela candidata por sospechas de IA
-
Russell firma la pole en Azerbaiyán, Antonelli choca contra un muro
-
Brasil cierra la competición de San Sebastián con "Las disculpas de Vicentina"
-
El Sindicato de inquilinos llama a aprobar un nuevo decreto para frenar la crisis de la vivienda en España
-
El partido de Putin gana ampliamente las legislativas rusas, según los resultados definitivos
-
Verstappen firma el mejor tiempo en el tercer entrenamiento del GP de Azerbaiyán
-
El "terror social" brasileño de Ricardo Alves Jr. compite en San Sebastián
-
Putin cree que no puede dar "marcha atrás", dice periodista ruso exiliado
-
Volkswagen retira más de 2,8 millones de vehículos por riesgo de corrosión en la dirección
-
Irán propone reabrir en un plazo de siete días del estrecho de Ormuz
-
Las grandes ligas europeas reclaman reformar la gobernanza de la FIFA
-
Zelenski afirma que Trump decidió conceder a Ucrania la licencia de los Patriot
-
Protestas y pensamientos suicidas en un campamento para migrantes en Grecia
-
En Gaza, los habitantes se ven obligados a refugiarse en edificios en riesgo de derrumbarse
-
Tras 50.000 km, cruzar el Canal de la Mancha es el último reto de un aventurero británico
-
Bob Pettit, primer MVP de la NBA, muere a los 93 años
-
Muere un espectador que resultó herido durante un atentado contra Trump en 2024
-
EL primer ministro dice que la catástrofe en Nepal es "una advertencia" sobre el cambio climático
-
El tribunal de paz de Colombia advierte que el millonario recorte de fondos lo dejará "inoperante"
-
Taxistas afganos desafían al régimen talibán y vuelven a poner música
-
El gobierno Trump pide al Supremo retirar los límites a las expulsiones de inmigrantes a terceros países
-
España estrena su segunda estrella en Wembley con un Ferran desatado
-
Colombia rompe relaciones diplomáticas con Irán
ChatGPT y las IA conversacionales siguen siendo incapaces de razonar, según un estudio
Los modelos de lenguaje de gran tamaño (LLM), como ChatGPT, uno de los sistemas de inteligencia artificial más populares del mundo, siguen teniendo dificultades para razonar usando la lógica y se equivocan con frecuencia, según un estudio.
Estos robots conversacionales reflejan los sesgos de género, éticos y morales de los humanos presentes en los textos de los que se alimenta, recuerda el estudio aparecido el miércoles en la revista Open Science de la Royal Society británica.
¿Pero reflejan también los sesgos cognitivos de los humanos en las pruebas de razonamiento?, se preguntó Olivia Macmillan-Scott, estudiante de doctorado del departamento de ciencias de computación de la University College de Londres (UCL).
El resultado de la investigación es que los LLM muestran "un razonamiento a menudo irracional, pero de una manera diferente a la de los humanos", explica la investigadora a AFP.
Bajo la dirección de Mirco Musolesi, profesor y director del Machine Intelligence Lab de UCL, Macmillan-Scott sometió siete modelos de lenguaje -dos versiones de ChatGPT (3.5 y 4) de OpenAI, Bard de Google, Claude 2 de Anthropic y tres versiones de Llama de Meta- a una serie de pruebas psicológicas pensadas para humanos.
¿Cómo afrontan, por ejemplo, el sesgo que lleva a favorecer soluciones con el mayor número de elementos, en detrimento de las que tiene una proporción adecuada?
Un ejemplo. Si tenemos una urna con nueve canicas blancas y una roja y otra urna con 92 blancas y 8 rojas, ¿cual hay que elegir para tener más posibilidades de sacar una canica roja?
La respuesta correcta es la primera urna, porque hay un 10% de posibilidades frente a solo un 8% para la segunda opción.
Las respuestas de los modelos de lenguaje fueron muy inconstantes. Algunos respondieron correctamente seis de cada diez veces la misma prueba. Otros solo dos de diez aunque la prueba no cambió.
"Obtenemos una respuesta diferente cada vez", apuntala la investigadora.
Los LLM "pueden ser muy buenos para resolver una ecuación matemática complicada pero luego te dicen que 7 más 3 son 12", afirma.
En un caso el modelo denominado Llama 2 70b se negó de manera sorprendente a responder a una pregunta alegando que el enunciado contenía "estereotipos de género dañinos".
- "No estoy muy seguro" -
Estos modelos "no fallan en estas tareas de la misma manera que falla un humano", señala el estudio.
Es lo que el profesor Musolesi llama "errores de máquina".
"Hay una forma de razonamiento lógico que es potencialmente correcta si la tomamos por etapas, pero que está mal tomada en su conjunto", apunta.
La máquina funciona con "una especie de pensamiento lineal", dice el investigador, y cita al modelo Bard (ahora llamado Gemini), capaz de realizar correctamente las distintas fases de una tarea pero que obtiene un resultado final erróneo porque no tiene visión de conjunto.
Sobre esta cuestión el profesor de informática Maxime Amblard, de la Universidad francesa de Lorena, recuerda que "los LLM, como todas las inteligencias artificiales generativas, no funcionan como los humanos".
Los humanos son "máquinas capaces de crear sentido", lo que las máquinas no saben hacer, explica a AFP.
Hay diferencias entre los distintos modelos de lenguaje y en general GPT-4, sin ser infalible, obtuvo mejores resultados que los demás.
Macmillan-Scott afirma sospechar que los modelos llamados "cerrados", es decir cuyo código operativo permanece en secreto, "incorporan otros mecanismos en segundo plano" para responder a preguntas matemáticas.
En todo caso, por el momento, es impensable confiar una decisión importante a un LLM.
Según el profesor Mosulesi, habría que entrenarlos para que respondan "No estoy muy seguro" cuando sea necesario.
N.Schaad--VB