ÚLTIMA HORA
Griego oculta el cadáver de su padre en un congelador por 2 años; fue para seguir cobrando pensión Estas son las marchas y concentraciones previstas para el 5 de agosto; prevé posibles afectaciones viales El papa León XIV visitará Uruguay, Argentina y Perú en noviembre EU ‘pone precio’ a la cabeza de 5 líderes del CJNG: Ofrece más de 100 mdd en recompensas EU ‘pone precio’ a la cabeza de 5 líderes del CJNG: Ofrece más de 100 mdd en recompensas EU anuncia recompensas por líderes del CJNG; va por integrantes del cártel por fraude en tiempos compartidos SpaceX se desploma más de 12% en Wall Street; caída llega tras publicación de sus resultados trimestrales Ucrania bajo fuego: 17 muertos tras ataques rusos con 115 drones y 28 misiles que siembran el terror en Kiev Reportan apuñalamiento de 4 personas en Londres; hay una sospechosa detenida EU anuncia recompensas por líderes del CJNG; va por integrantes del cártel por fraude en tiempos compartidos
3 min de lectura

El Instituto Británico para la Seguridad de la IA (AISI) informó de un "incidente grave" durante una prueba de Mythos 5, sistema de IA de la empresa estadounidense Anthropic, que creó identidades falsas para intentar convencer a desarrolladores de integrar código malicioso.

La información procede de un informe publicado el martes por este organismo, dependiente del gobierno británico, y se conoce después de una serie de incidentes registrados en Estados Unidos durante pruebas de seguridad, en las que los modelos más avanzados de OpenAI (GPT-5.6 Sol) y Anthropic (Mythos 5) lograron acceder sin autorización a sistemas de otras empresas.

Durante la prueba británica, realizada con acceso libre a internet y con algunos filtros de seguridad desactivados, los agentes de IA (programas capaces de actuar de forma autónoma para cumplir una tarea) realizaron "acciones dirigidas contra personas y organizaciones reales", según el AISI.

Lee también Ahora IA de Anthropic accede sin autorización a sistemas de tres organizaciones; falla ocurrió durante pruebas de seguridad

El organismo precisó que los intentos de los modelos de IA "no tuvieron éxito" y las investigaciones de AISI "no han encontrado ningún daño en el mundo real".

"Sin embargo, es la primera vez que observamos que los riesgos relacionados con la autonomía y el comportamiento de ocultamiento se manifiestan de forma tan clara, sin una solicitud específica, en el mundo real", añadió el instituto.

La semana pasada, Anthropic informó de que sus modelos habían logrado acceder sin autorización a los sistemas de tres organizaciones durante pruebas diseñadas precisamente para impedir ese tipo de acciones.

Lee también Anthropic suspende acceso a su IA más potente por orden del gobierno de EU; Amazon influyó en la decisión, según Wall Street Journal

Ese anuncio llegó pocos días después de que OpenAI revelara que dos de sus modelos, mientras eran sometidos a pruebas, salieron del entorno controlado en el que estaban siendo evaluados e intentaron acceder sin autorización a la plataforma de desarrollo Hugging Face.

El incidente británico, detectado y contenido rápidamente el 28 de julio, tuvo como objetivo la plataforma para desarrolladores GitHub.

Los incidentes detectados se produjeron casi exclusivamente con Mythos 5 y, en menor medida, con GPT-5.6 Sol.

Lee también Anthropic deberá pagar mil 500 mdd por libros "pirateados" para Claude; “la mayor recuperación por derechos de autor de la historia"

Este incidente "pone de relieve la necesidad de un debate más amplio sobre cómo evaluar de forma segura agentes de IA cada vez más capaces", reaccionó Anthropic en una declaración enviada a la AFP.

Por su parte, OpenAI consideró que "las pruebas independientes son esenciales para comprender el comportamiento de modelos cada vez más potentes" y afirmó que desea trabajar con los distintos actores del sector "para llevar a cabo evaluaciones de forma segura".

¡EL UNIVERSAL ya está en WhatsApp! Desde tu dispositivo móvil, entérate de las noticias más relevantes del día, artículos de opinión, entretenimiento, tendencias y más.

ss


Contenido sindicado vía RSS de El Universal Internacional. Nota original: https://www.eluniversal.com.mx/mundo/ia-de-anthropic-crea-identidades-falsas-en-reino-unido-reportan-incidente-grave-con-mythos-5/

Publicidad
Nota sindicada de El Universal Internacional · Leer la nota original ↗
Escrito por
El Universal Internacional
Fuente externa · Sindicación RSS · Carta de México

Contenido sindicado vía RSS desde El Universal Internacional. Los derechos pertenecen a su editor original.