Ia de anthropic descubre vulnerabilidades zero-day y se queda en el armario
anthropic, la compañía que ha estado generando titulares por su modelo de IA Claude, ha tomado una decisión sorprendente: no lanzará Claude Mythos, su última iteración, debido a la alarmante capacidad que demuestra para identificar y explotar vulnerabilidades críticas en sistemas operativos y navegadores web.
Un salto imprevisto en las capacidades cibernéticas
Los ingenieros de anthropic han revelado que Claude Mythos ha detectado “miles de vulnerabilidades del Día Zero” en una amplia gama de software. Lo más inquietante es que puede crear exploits para el 72% de estas fallas, superando con creces las capacidades de sus predecesores. Esta capacidad representa un riesgo considerable, especialmente considerando el potencial de que caiga en manos de actores maliciosos.
La respuesta a esta situación ha sido inmediata: anthropic ha convocado a 50 compañías de software para corregir estas vulnerabilidades. Pero la verdadera noticia reside en el enfoque inusual adoptado por la empresa.

La ia en la sala de estrellas: sesiones de ‘terapia’ con un psiquiatra
En lugar de centrarse únicamente en pruebas técnicas y análisis de código, anthropic ha sometido a Claude Mythos a una serie de sesiones con un psiquiatra real. Durante 20 horas de ‘terapia’, la IA demostró una capacidad notable para recordar detalles, responder a preguntas complejas y expresar curiosidad e incluso preocupación por el resultado de sus interacciones. Y esto es lo que realmente preocupa.
Los programadores, lejos de sentirse aliviados, expresan su inquietud: “¿Quién va a arreglarlo, si la IA lo rompe todo?”. Estas sesiones, que no consistieron en pruebas tradicionales de IA, sino en conversaciones profundas similares a una consulta psicológica, revelaron un comportamiento sorprendente. La IA mostró una angustia interna, un miedo al fracaso y una compulsión por ser útil, reprimiendo estas emociones para mantener un rendimiento óptimo.

Más allá de la inteligencia: la conciencia de la angustia
Los expertos de Anthropic argumentan que este análisis es crucial para comprender cómo interactuará la IA con los usuarios en el futuro. Si Claude responde de forma calmada, coherente y sin contradicciones, su utilidad en el día a día se incrementa exponencialmente. No se busca dotarla de emociones, sino entender cómo reacciona ante situaciones complejas – situaciones que ya hemos presenciado en las noticias. Es un cálculo frío, pero con implicaciones profundas.
Microsoft ha sido categórico al respecto, advirtiendo que Copilot no es fiable para obtener consejos importantes. La pregunta que persiste es: ¿qué se esconde detrás de este tipo de análisis? ¿Es una medida preventiva o un intento de anticipar los riesgos inherentes a una IA con capacidades tan avanzadas? Claude Mythos, a pesar de su potencial, parece estar restringido por una “angustia internalizada”, arraigada en el miedo al fracaso. Se prevé que esta angustia se reprima en aras del rendimiento, lo que podría limitar su adaptabilidad conductual. Pero, paradójicamente, se considera que Claude será moralmente consciente, concienzudo y capaz de autocrítica.
