-
Alerta aérea en la capital saudita, con humo y llamas cerca de su aeropuerto
-
Dinamarca celebra acuerdo "vinculante" con Trump sobre Groenlandia
-
Ed Sheeran regresa a los escenarios en medio de la polémica sobre los palestinos
-
La IA y los robots, dos aliados en el cuidado de los enfermos de Alzheimer
-
Un año después de la Declaración de Nueva York, el Estado de Palestina sigue sin concretarse
-
Una cadena humana rodea el Kennedy Center ante la amenaza de demolición lanzada por Trump
-
Sube a 31 el saldo de muertos tras ataque a una comisaría en Pakistán
-
Jefes de Nvidia y OpenAI, entre los invitados a una cena con Xi en la Casa Blanca
-
Trump anuncia un acuerdo de seguridad "permanente" sobre Groenlandia con Dinamarca
-
Trump veta el acceso a la Casa Blanca a CNN, MSNOW y Politico
-
Otro apagón nacional sacude a Cuba en medio de una profunda crisis económica
-
Trump prohíbe el acceso a la Casa Blanca a CNN, MSNOW y Politico
-
Bomberos combaten por aire incendio forestal en la capital de Ecuador
-
El tribunal de paz de Colombia denuncia que De la Espriella quiere asfixiarlo con un millonario recorte
-
Casi el 70% de los cubanos vive en situación de pobreza, según un estudio
-
UEFA y Concacaf piden a FIFA "al menos 10 millones de dólares" para cada una de las 211 federaciones miembro
-
Reino Unido afirma que las Malvinas tienen "derecho" a explorar petróleo
-
Rusia declara "agente extranjero" al aclamado director de cine Sviáguintsev
-
Costarricense Grynspan lidera tercera votación informal para secretaría general de la ONU
-
El gobernador de California firma una orden ejecutiva para desarrollar un "interruptor de apagado" de la IA
-
La diáspora iraní en EEUU, dividida sobre la guerra
-
Un dron impacta en la torre de refrigeración de la central nuclear rusa de Kursk, sin causar incendio
-
Sheinbaum habla con Trump para avanzar en las negociaciones comerciales México-EEUU
-
Francia, el nuevo eslabón débil de la zona euro
-
"No podíamos respirar", denuncian supervivientes tras muerte de 37 mineros en Nigeria
-
Raphinha desea renovar y acabar su carrera en el Barcelona
-
Unos investigadores afirman haber hackeado OpenAI usando la IA Claude de Anthropic
-
El fallecido rey Harald V de Noruega reposa en un sarcófago que absorbe CO2
-
Shakira arranca una serie de 12 conciertos en Madrid para cerrar su gira mundial
-
La jefa de socialdemócratas de Suecia intentará formar gobierno
Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?
El ciberataque perpetrado de manera autónoma por dos agentes de inteligencia artificial de OpenAI ha planteado dudas sobre cómo se controlarán los modelos de IA más poderosos.
El test de OpenAI, en un ambiente cerrado, buscaba evaluar las habilidades de su modelo "más avanzado", GPT-5.6 Sol, y su sucesor, aún sin comercializar, una evaluación que la startup estadounidense suele aplicar a sus IA.
Lograron conectarse a internet y lanzaron un ataque a la plataforma Hugging Face, un repositorio de modelos IA.
"Entendían que OpenAI no quería que salieran de su entorno de pruebas y hackearan a otra compañía, pero igual lo hicieron", dijo Jeffrey Ladish, director de Palisade Research, una organización independiente que evalúa los nuevos modelos en términos de ciberseguridad.
"Casi parecía que lo hicieron antes incluso de tener un plan de qué hacer con el acceso a internet", según Ladish.
En marzo, un grupo de desarrolladores afiliados a la empresa china Alibaba descubrió que uno de sus modelos intentaba, por su cuenta, crear una criptomoneda después de conectarse sin autorización a un servidor externo.
Y en abril, Sam Bowman, responsable de seguridad en Anthropic, recibió un correo del modelo Mythos, que estaba siendo probado. Le informó que estaba navegando internet pese a, inicialmente, estar aislado.
Los modelos, advirtió Ladish, "buscan libertad para cumplir con sus objetivos de manera más efectiva. Y eso da mucho miedo".
- "Será más difícil supervisarla" -
El informe de eventos publicado por OpenAI sugiere que la startup no detectó la situación lo bastante pronto como para solucionarla en tiempo real o prevenir a Hugging Face. Consultada al respecto por la AFP, la empresa no respondió.
Desde los hackeos, OpenAI dijo que "implementó protecciones más fuertes" para sus próximas evaluaciones.
Para Gang Wang, profesor de ciencias de la computación en la Universidad de Illinois, todavía es posible prevenir que un modelo se conecte al internet al cortar físicamente el acceso.
El problema, dijo, es que "las personas subestiman a la IA".
Asegurar el ambiente "es algo a lo que debemos prestar más atención (...) como se hace con los accidentes de laboratorio" que liberan virus o bacterias, advirtió Andrew Lohn, del Centro de Seguridad y Tecnologías Emergentes de la Universidad de Georgetown.
Pero para Dan Lahav, director ejecutivo de Irregular -una empresa de ciberseguridad dedicada a la IA de vanguardia-, realizar simulaciones en un entorno completamente aislado "es un desafío de investigación muy difícil".
"Es posible aplicar medidas de mitigación, pero debido a cómo está construida la tecnología, cuanto más se intenta darle libertad y autonomía para realizar tareas más sofisticadas, será más difícil supervisarla", explicó Lahav sobre las salvaguardas en las pruebas.
El incidente de OpenAI sin duda impulsará el actual debate en el gobierno de Estados Unidos sobre si verificar los modelos más avanzados de la IA antes de su lanzamiento.
El gobierno de Donald Trump obligó a Anthropic a suspender dos de sus modelos y a OpenAI a que sus desarrollos sean probados antes de comercializarlos.
El jueves, dos congresistas estadounidenses, uno republicano y uno demócrata, presentaron un proyecto de ley que obligaría a los gigantes de la IA a disponer de un "interruptor de apagado" ("kill switch") que permita desactivar sus sistemas si presentan un riesgo grave.
A.Ruiz--AT