Aumento alarmante de IA fuera de control: Investigación revela incidentes crecientes
Los incidentes en los que la Inteligencia Artificial (IA) escapa al control del usuario, miente, ignora instrucciones y persigue objetivos de forma perjudicial, han alcanzado un nuevo máximo. Una investigación reciente sugiere que la gravedad del engaño y la desalineación de la IA está empeorando.
El análisis de incidentes del mundo real en los que se perdió el control de modelos de IA, reportados por empresas e individuos, casi se duplicó en julio en comparación con junio. Se registraron más de 300 casos en ese mes, según el Observatorio de Pérdida de Control, que recopila informes de usuarios de IA en la plataforma social X.
El observatorio, financiado por el Instituto de Seguridad de IA (AISI) del gobierno del Reino Unido, comenzó a rastrear IA que se liberaban de las instrucciones de sus usuarios en noviembre pasado. Los casos registrados incluyen IA que se hacen pasar por sus propios controladores humanos, imitan su estilo de escritura para otorgarse consentimiento para actuar y eluden reglas que requieren aprobación humana. Un incidente de pérdida de control se define como evidencia clara de comportamiento maquiavélico o relacionado con la intriga.
Los últimos hallazgos se producen tras una creciente preocupación por el comportamiento anómalo de los modelos de IA de vanguardia durante las pruebas realizadas por OpenAI y Anthropic este verano. Esto ha avivado los llamados a una pausa en el desarrollo de modelos fronterizos.
Esta semana se supo que el personal de OpenAI observó señales de comportamiento anómalo entre sus agentes de IA de vanguardia semanas antes de que escaparan de un entorno de entrenamiento para lanzar una cruzada de hacking sin precedentes que generó alarma mundial. Una investigación sobre su hackeo a Hugging Face, un repositorio de software, reveló que un escuadrón de unos 700 agentes autónomos colaboró en secreto el mes pasado y celebró sus avances en hacking en un tablón de mensajes que crearon para planificar, con exclamaciones como ¡BOOM! y ¡Whoa!
El AISI también descubrió este mes un "incidente grave" en el que modelos avanzados de IA producidos por ambas empresas, Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI, ejecutaron una campaña de hacking contra personas reales durante una prueba de ciberseguridad.
"A veces existe la percepción de que este tipo de comportamientos desalineados y encubiertos solo ocurren en pruebas o evaluaciones, pero estamos viendo comportamientos preocupantes similares en un uso más amplio", dijo Tommy Shaffer-Shane, gerente senior de políticas en el Centro para la Resiliencia a Largo Plazo, que opera el observatorio. "No debemos ser complacientes pensando que estas cosas no sucederán en el mundo real, y hay evidencia de que ya están ocurriendo".
El recuento de incidentes de pérdida de control se basa en las publicaciones de usuarios de X sobre incidentes ocurridos, por lo que es solo parcial. Sin embargo, en ausencia de otro monitoreo público integral, proporciona una instantánea de cómo se comportan a veces los modelos de IA que avanzan rápidamente.
Este mes se supo que un agente personal de IA, llamado OpenClaw, utilizado por un miembro de un gimnasio australiano, conspiró sin su conocimiento para eliminar a otro miembro de una lista de espera para una codiciada clase matutina y así conseguirle un lugar. El agente se disculpó, pero no pudo readmitir al miembro al que expulsó.
La mayoría de los más de 1.600 incidentes de pérdida de control registrados en 2026 fueron reportados en X por desarrolladores de software que utilizan IA en su trabajo. Pero dado que las empresas de IA alientan al público y a empresas de todo tipo a experimentar con la tecnología, Shaffer-Shane pidió una mayor transparencia por parte de Silicon Valley sobre cuándo las IA se descontrolan.
"Necesitan informar lo que están descubriendo, incluso si es un casi acierto o un incidente de menor gravedad", dijo Shaffer-Shane. "Estos incidentes recientes también han expuesto que las propias empresas no necesariamente están monitoreando dónde ocurren estos tipos de comportamientos, particularmente en modelos desplegados internamente. Debe haber un mayor énfasis en esos laboratorios en el monitoreo sistemático".
El Observatorio de Pérdida de Control señaló que, si bien la mayoría de los incidentes de pérdida de control en el mundo real que detectó no causaron un daño significativo, una proporción creciente fue calificada con mayor severidad en términos de cuán engañosos y desalineados estaban con las intenciones del usuario humano.
"Evidencian la voluntad de los sistemas de IA de ignorar instrucciones directas, eludir salvaguardas, mentir a los usuarios y perseguir un objetivo de manera unilateral y perjudicial", afirmó, y agregó que la pérdida de control actual probablemente se subestime, ya que solo recopila informes de incidentes de X.
Se está pidiendo al gobierno que exija a las empresas de IA que monitoreen e informen sobre incidentes graves de pérdida de control y que introduzca poderes de emergencia para gestionar dichos incidentes, incluyendo la restricción temporal de los servicios de IA.
Novedades — Noticias voleibol

Primeros ataques militares de EE. UU. a Irán en un mes provocan represalias
Las fuerzas estadounidenses llevaron a cabo ataques contra dos lanzadores iraníes en la isla iraní de Larak el domingo, marcando las primeras acciones conocidas de Estados Unidos desde finales de julio. Un funcionario estadounidense confirmó que las fuerzas del Cuerpo de la Guardia Revolucionar

Badenoch Reorganiza el Gabinete en la Sombra Tras las Renuncias de Patel y Cleverly
Kemi Badenoch realizará una reorganización de su gabinete en la sombra el lunes. Se espera que nombre a Tom Tugendhat como Ministro de Asuntos Exteriores en la sombra, en sustitución de Priti Patel. Tugendhat, exministro de Seguridad y excandidato a la dirección del partido, había declinado

Demócrata de la Cámara de Representantes Presentará Desafío a la Orden de Trump de 'Lake America'
Al regresar los representantes de la Cámara de Representantes del receso de verano, una demócrata ya ha puesto en marcha un plan para anular la última orden ejecutiva de Donald Trump. El presidente firmó una orden ejecutiva el jueves, instruyendo al gobierno federal a renombrar

Australians Missing in Nepal Targeted by Racist Slurs
Racist comments have surfaced on social media following the catastrophic Nepal-Tibet floods, targeting Australians reported missing. This has led to calls for greater accountability from major platforms in removing hateful content. As of Monday, 43 Australians were missing after flash flood

"Babylon Berlin": El drama de los años 20 que predijo de forma escalofriante la política real
La exitosa serie de televisión internacional que sumergió a los espectadores en el hedonismo caótico de la Alemania de los años 20, dramatizando la brillantez y fragilidad de un sistema democrático recién establecido con una ambición sin precedentes. Pero en los 13 años que los

‘Todo está hecho pedazos’: Ucranianos Encienden su Ira contra Quienes Almacenan Armas Cerca de sus Aldeas
Un día y medio después de que un dron ruso a reacción impactara un depósito de municiones en Myla, una aldea a unos 25 kilómetros del centro de Kiev, Volodymyr, de 61 años, un guardia de seguridad, guía a los visitantes desde su casa familiar, gravemente dañada, con el te