-
Gigantes de la IA de acuerdo en poner un pie en el freno a su desarrollo
-
Reconocidos matemáticos advierten sobre el "efecto destructivo" de la IA en su disciplina
-
Al menos 26 niños muertos en un incendio que causó una estampida en una escuela de la RD Congo
-
Anthropic revela un uso indebido de su IA en armas, espionaje y vigilancia
-
El descarrilamiento de un tren en el norte de Francia deja 44 heridos, uno de gravedad
-
Emiratos utilizó IA para atacar a expertos de la ONU sobre Sudán, según Anthropic
-
El aeropuerto de Nashville, en EEUU, será rebautizado en homenaje a Dolly Parton
-
Israel niega usar IA para matar a civiles en Gaza, como afirma un documental
-
Los diputados británicos rechazan legalizar la muerte asistida
-
Proveedores de IA deben "poner orden" en sus modelos, advierte la UE
-
La hermana del rey Harald de Noruega muere dos semanas después que su hermano
-
La inflación estable en EEUU en agosto alimenta las expectativas de subida de tasas
-
Un grupo de Yemen usó la IA de de Anthropic para desarrollar armas teledirigidas
-
OpenAI pide al Congreso de EEUU normas de seguridad obligatorias para la IA
-
Carney dice que Canadá está lista para un acuerdo comercial "justo" con EEUU
-
La probabilidad de que se produzca un episodio histórico de El Niño es del 75%
-
La capital de Noruega prohíbe los lentes inteligentes en las escuelas
-
El Consejo de Supervisión de Meta pide no reemplazar la verificación por "Notas de la comunidad" en América Latina
-
Consejo de Supervisión de Meta pide no reemplazar la verificación por "Notas de la comunidad" en América Latina
-
Una megamina de estaño de Birmania reanuda sus operaciones, según un centro de estudios
-
El fracking de petróleo y gas entra en discusión en la justicia brasileña
-
Venezuela firma acuerdo de asistencia en hidrocarburos con Surinam
-
Nueva York conmemora el 11 de septiembre sin Donald Trump
-
El calor récord de los océanos amenaza la economía del planeta entero
-
La economía británica sorprende en julio con un crecimiento del 0,4%
-
Putin llega a India para una cumbre de los BRICS acaparada por tensiones geopolíticas
-
Putin llega a India para cumbre de los BRICS acaparada por tensiones gepolíticas
-
El BCE sube los tipos de interés debido a la inflación por la guerra en Oriente Medio
-
Dinamarca quiere prohibir los celulares en las escuelas
-
El "vestido de la venganza" de la princesa Diana será subastado en Nueva York
-
La justicia francesa investiga a alcalde y exalcaldesa de París por agresiones sexuales en las escuelas
-
Las niñas son las más golpeadas cuando los choques climáticos interrumpen la educación
-
La UE obtiene acceso a Mythos, el modelo de IA más potente de Anthropic
-
Céline Dion, el regreso de una diva infatigable
-
Ralph Lauren inaugura una Semana de la Moda de Nueva York libre de pieles
-
GA-ASI presenta Wildfire, un UAS para funciones militares, civiles y comerciales
-
El avión catarí de Trump se retrasa por la inspección de la rampa de evacuación
-
Apple presenta el primer iPhone plegable, una prueba para su nuevo CEO
-
En medio de la crisis, los cubanos buscan consuelo en sus santos y orishas
-
EEUU registra en 2026 su verano más caluroso hasta ahora
-
Meta comienza a probar el reemplazo de la verificación de datos en América Latina
-
La inflación de China repunta en agosto, pero sigue por debajo del objetivo
-
El secretario de Transporte estadounidense critica a Ford por sus vínculos con China
-
La Casa Blanca retira de su página un juego tipo Tetris llamado "Construye el muro"
-
OpenAI afirma que su IA resolvió uno de los problemas más complejos de las matemáticas
-
Egipto prevé construir un centro de datos de IA de 1.000 millones de dólares con Nvidia
-
Una falla técnica deja más de 2.000 vuelos cancelados en Reino Unido
-
Francia prevé una cosecha de champán que puede superar el 13% de alcohol
-
La asfixiada industria argentina atiza el debate por el modelo de Milei
-
La UE quiere ayudar a las ciudades a plantar cara a Airbnb
Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?
El ciberataque perpetrado de manera autónoma por dos agentes de inteligencia artificial de OpenAI ha planteado dudas sobre cómo se controlarán los modelos de IA más poderosos.
El test de OpenAI, en un ambiente cerrado, buscaba evaluar las habilidades de su modelo "más avanzado", GPT-5.6 Sol, y su sucesor, aún sin comercializar, una evaluación que la startup estadounidense suele aplicar a sus IA.
Lograron conectarse a internet y lanzaron un ataque a la plataforma Hugging Face, un repositorio de modelos IA.
"Entendían que OpenAI no quería que salieran de su entorno de pruebas y hackearan a otra compañía, pero igual lo hicieron", dijo Jeffrey Ladish, director de Palisade Research, una organización independiente que evalúa los nuevos modelos en términos de ciberseguridad.
"Casi parecía que lo hicieron antes incluso de tener un plan de qué hacer con el acceso a internet", según Ladish.
En marzo, un grupo de desarrolladores afiliados a la empresa china Alibaba descubrió que uno de sus modelos intentaba, por su cuenta, crear una criptomoneda después de conectarse sin autorización a un servidor externo.
Y en abril, Sam Bowman, responsable de seguridad en Anthropic, recibió un correo del modelo Mythos, que estaba siendo probado. Le informó que estaba navegando internet pese a, inicialmente, estar aislado.
Los modelos, advirtió Ladish, "buscan libertad para cumplir con sus objetivos de manera más efectiva. Y eso da mucho miedo".
- "Será más difícil supervisarla" -
El informe de eventos publicado por OpenAI sugiere que la startup no detectó la situación lo bastante pronto como para solucionarla en tiempo real o prevenir a Hugging Face. Consultada al respecto por la AFP, la empresa no respondió.
Desde los hackeos, OpenAI dijo que "implementó protecciones más fuertes" para sus próximas evaluaciones.
Para Gang Wang, profesor de ciencias de la computación en la Universidad de Illinois, todavía es posible prevenir que un modelo se conecte al internet al cortar físicamente el acceso.
El problema, dijo, es que "las personas subestiman a la IA".
Asegurar el ambiente "es algo a lo que debemos prestar más atención (...) como se hace con los accidentes de laboratorio" que liberan virus o bacterias, advirtió Andrew Lohn, del Centro de Seguridad y Tecnologías Emergentes de la Universidad de Georgetown.
Pero para Dan Lahav, director ejecutivo de Irregular -una empresa de ciberseguridad dedicada a la IA de vanguardia-, realizar simulaciones en un entorno completamente aislado "es un desafío de investigación muy difícil".
"Es posible aplicar medidas de mitigación, pero debido a cómo está construida la tecnología, cuanto más se intenta darle libertad y autonomía para realizar tareas más sofisticadas, será más difícil supervisarla", explicó Lahav sobre las salvaguardas en las pruebas.
El incidente de OpenAI sin duda impulsará el actual debate en el gobierno de Estados Unidos sobre si verificar los modelos más avanzados de la IA antes de su lanzamiento.
El gobierno de Donald Trump obligó a Anthropic a suspender dos de sus modelos y a OpenAI a que sus desarrollos sean probados antes de comercializarlos.
El jueves, dos congresistas estadounidenses, uno republicano y uno demócrata, presentaron un proyecto de ley que obligaría a los gigantes de la IA a disponer de un "interruptor de apagado" ("kill switch") que permita desactivar sus sistemas si presentan un riesgo grave.
A.Levy--CPN