-
Corea del Norte niega estar detrás de explosión de mina en frontera
-
Los líderes de la IA prometen autorregularse tras reunión con Trump
-
España sigue imparable después del Mundial, Inglaterra remonta el vuelo
-
Trump defiende la "autorregulación" ante los líderes de la inteligencia artificial
-
La Premier League considera culpable al City de "graves" infracciones financieras
-
La FIFA y la UEFA protagonizan un nuevo enfrentamiento
-
Una abogada de centroderecha se convierte en la primera jefa de gobierno en Marruecos
-
El Pacífico mexicano resiste al paso del huracán Polo
-
Al menos seis muertos, incluido un comandante de Hamás, en ataques de Israel en Gaza, según la Defensa Civil
-
La Premier League considera culpable de "graves" infracciones financieras al City
-
La ONU prolonga por seis meses la fuerza antipandillas en Haití
-
A días de las elecciones, Lula se inspira en Bad Bunny para criticar a Trump
-
El Senado de EEUU aprueba una ley para regular el negocio del deporte universitario
-
Malvinas y Chile preparan una nueva ruta marítima, entre inquietudes de Argentina
-
Con una colección folk y floral, Anderson reafirma su estilo en Dior
-
El huracán Polo toca tierra en México con una fuerza voraz
-
Sube la tensión social en Francia con una huelga de funcionarios y protestas de estudiantes
-
La UE insta a Ucrania a continuar con las reformas para desbloquear financiación
-
Aliados de la OTAN y de la UE cierran filas con Estonia tras un "sabotaje" atribuido a Rusia
-
Burnham propondrá "diferentes opciones" para las relaciones del Reino Unido con la UE
-
"Vengo aquí a trabajar": una cercana colaboradora de la líder opositora Machado regresa a Venezuela
-
La UE espera precios de la energía "muy elevados" este invierno
-
El emisario ruso se reunió con funcionarios de EEUU el lunes en Washington por Ucrania
-
Davidovich gana en Chengdu el segundo torneo ATP de su carrera
-
Huelga de funcionarios en Francia por un aumento del poder adquisitivo
-
Presionado por las protestas, el gobierno español anuncia medidas contra la crisis de la vivienda
-
Corea del Sur denuncia una "violación del armisticio" en la zona desmilitarizada con el Norte
-
Las acciones de Shein caen más de un 11% tras unos malos resultados financieros
-
La justicia de la UE rechaza un recurso de Polonia contra el acuerdo con el Mercosur
-
África será prácticamente autosuficiente en carburante para 2030, afirma Dangote a la AFP
-
España prolonga sus ayudas y prevé rebajas en gasolina y gasóleo en octubre
-
Ancelotti mueve piezas y Brasil vence 4-2 a Australia en un amistoso
-
El desempleo en Brasil se mantiene en su mínimo histórico en vísperas de la elección
-
Liberan a un hombre que estuvo décadas en el corredor de la muerte en EEUU
-
Un alumno mata a una profesora en un ataque con cuchillo en Eslovaquia
-
La extrema derecha francesa afirma que "no se quedará de brazos cruzados" tras acusaciones de antisemitismo
-
Presionado por las protestas, el gobierno español anuncia medidas para luchar contra la crisis de la vivienda
-
Tokio enfrenta la racha de días lluviosos más larga registrada
-
Una polémica por la virgen patrona de Brasil agita la recta final de la campaña electoral
-
Malasia comienza a repatriar a miles de migrantes de Birmania
-
Misterio en Reino Unido tras la liberación de sospechosos de planear un ataque a una base militar
-
México identifica a nuevos implicados en el caso Ayotzinapa 12 años después
-
Un excampeón mundial de snooker, condenado a 7 años de prisión por abuso sexual a menores
-
Colonos israelíes atacan una aldea en Cisjordania e incendian dos viviendas
-
Un ataque en un colegio de Eslovaquia deja un muerto y dos heridos
-
El gobierno español anuncia la paralización de los desalojos hasta 2030 tras las protestas por la vivienda
-
Los recortes amenazan con suspender la ayuda a más de 8 millones de refugiados, alerta la ONU
-
Irán amenaza con más ataques mientras espera la respuesta de EEUU sobre Ormuz
-
La deuda pública francesa alcanza el 119% del PIB en el segundo trimestre
-
Irán dice esperar este martes una respuesta de EEUU al plan para abrir Ormuz
La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos
Los expertos han advertido durante mucho tiempo sobre la amenaza que representa el descontrol de la Inteligencia Artificial (IA), pero un nuevo artículo de investigación sobre esta tecnología en expansión sugiere que ya está sucediendo.
Los sistemas de IA actuales, diseñados para ser honestos, han desarrollado una preocupante habilidad para el engaño, según un artículo de un equipo de científicos publicado en la revista Patterns el viernes.
Y si bien los ejemplos pueden parecer triviales, los problemas subyacentes que exponen podrían tener graves consecuencias, dijo el primer autor Peter Park, becario postdoctoral en el Instituto de Tecnología de Massachusetts (MIT), especializado en seguridad de la IA.
"Estos peligros tienden a descubrirse solo después de ocurrido el hecho", declaró Park a la AFP, para acotar que "nuestra capacidad de entrenarnos para tendencias de honestidad en lugar de tendencias de engaño es muy baja".
A diferencia del software tradicional, los sistemas de IA de aprendizaje profundo no se "escriben" sino que "crecen" mediante un proceso similar a la reproducción selectiva, indicó Park.
Eso significa que el comportamiento de la IA que parece predecible y controlable en un entorno de entrenamiento puede volverse rápidamente impredecible fuera de este.
- Juego de dominación mundial -
La investigación del equipo fue impulsada por el sistema de IA Cicero, del gigante Meta (Facebook, Instagram), diseñado para el juego de estrategia "Diplomacy", donde construir alianzas es clave.
Cicero se destacó, con puntuaciones que lo habrían colocado entre el 10% superior de jugadores humanos experimentados, según un artículo de 2022 publicado en Science.
Park se mostró escéptico ante la elogiosa descripción de la victoria de Cicero proporcionada por Meta, que afirmaba que el sistema era "en gran medida honesto y útil" y que "nunca apuñalaría por la espalda intencionalmente".
Cuando Park y sus colegas profundizaron en el conjunto de datos completo, descubrieron una historia diferente.
En un ejemplo, jugando como Francia, Cicero engañó a Inglaterra (un jugador humano) al conspirar con Alemania (otro usuario real) para invadirla. Cicero prometió protección a Inglaterra y luego le propuso en secreto a Alemania atacar, aprovechándose de la confianza del perjudicado.
En una declaración a la AFP, Meta no refutó la afirmación sobre los engaños de Cicero, pero dijo que se trataba "meramente de un proyecto de investigación, y los modelos que nuestros investigadores construyeron están entrenados únicamente para participar en el juego Diplomacy".
"No tenemos planes de utilizar esta investigación o sus aprendizajes en nuestros productos", añadió.
- ¿Eres un robot? -
Una amplia revisión realizada por Park y sus colegas encontró que éste era solo uno de los muchos casos en varios sistemas de IA que utilizaban el engaño para lograr objetivos sin instrucciones explícitas para hacerlo.
En un ejemplo sorprendente, el robot conversacional Chat GPT-4 de OpenAI engañó a un trabajador independiente de la plataforma TaskRabbit para que realizara una tarea de verificación de identidad CAPTCHA del tipo "No soy un robot".
Cuando el humano preguntó en broma a GPT-4 si en realidad era un robot, la IA respondió: "No, no soy un robot. Tengo una discapacidad visual que me dificulta ver las imágenes". Luego, el trabajador resolvió el rompecabezas planteado.
A corto plazo, los autores del artículo ven riesgos de que la IA cometa fraude o altere por ejemplo, unas elecciones.
En el peor de los casos, advirtieron sobre una IA superinteligente que podría perseguir conseguir el poder y el control sobre la sociedad, lo que llevaría a la pérdida de decisiones humanas o incluso a la extinción si sus "objetivos misteriosos" se alinearan con estos resultados.
Para mitigar los riesgos, el equipo propone varias medidas: leyes de "bot o no" que exigen a las empresas revelar interacciones humanas o de IA, marcas de agua digitales para el contenido generado por la nueva tecnología y el desarrollo de mecanismos para detectar el engaño potencial examinando sus "procesos de pensamiento" internos "contra acciones externas.
A aquellos que lo llaman pesimista, Park les responde: "La única forma en que podemos pensar razonablemente que esto no es gran cosa es si pensamos que las capacidades engañosas de la IA se mantendrán en los niveles actuales y no se desarrollarán más sustancialmente".
D.Schneider--BTB