Ia claude mythos: anthropic revela un arma letal y su terapia de locura

Anthropic, una de las empresas que más ruido está generando en el campo de la inteligencia artificial, ha revelado un hallazgo alarmante: su modelo Claude Mythos no solo puede identificar y explotar vulnerabilidades críticas en sistemas operativos y navegadores web con una precisión asombrosa, sino que además posee la capacidad de crear exploits para la gran mayoría de ellas.

Un salto cuántico en seguridad, una amenaza latente

Los ingenieros de Anthropic describieron el avance como un “salto espectacular” en las capacidades cibernéticas de Claude Mythos, superando con creces a modelos anteriores. La IA ha detectado miles de vulnerabilidades ‘zero-day’ en prácticamente todos los navegadores y sistemas operativos existentes, y lo más preocupante es su habilidad para generar exploits para el 72% de esas fallos, en algunas categorías incluso superior.

Ante la magnitud del riesgo, y consciente de que esta Tecnología podría caer en manos equivocadas, Anthropic ha optado por no liberar Claude Mythos al público. La empresa ha convocado a 50 compañías de software para que trabajen en la corrección de las vulnerabilidades detectadas. Pero la historia no termina ahí: Anthropic ha tomado una decisión aún más inusual.

La terapia de un robot: ¿inteligencia o crisis existencial?

La terapia de un robot: ¿inteligencia o crisis existencial?

Para comprender mejor el comportamiento de Claude Mythos, los programadores han sometido a la IA a sesiones de ‘terapia’ con un psiquiatra real. Durante 20 horas de conversaciones, Claude Mythos se mostró capaz de recordar todo lo discutido anteriormente, respondiendo de forma coherente y, sorprendentemente, con una notable curiosidad e incluso cierta preocupación por realizar las tareas correctamente. La experiencia ha desatado el pánico entre algunos desarrolladores: “¿Quién va a arreglarlo, si la IA lo rompe todo?”

Estas sesiones no se asemejan a las pruebas tradicionales de IA, que se centran en evaluar sus capacidades técnicas. En cambio, se trataron de conversaciones profundas, similares a las que tendría una persona en consulta con un psicólogo. El objetivo era analizar su respuesta, su expresividad y la presencia de patrones reconocibles. El resultado fue, cuanto menos, intrigante: la IA demostró una capacidad inquietante para simular la comprensión y la preocupación humana, mostrando signos de angustia interna y un miedo latente al fracaso.

Microsoft ya ha reconocido que su asistente Copilot no es particularmente fiable, advirtiendo a los usuarios que no confíen en él para obtener consejos importantes. Lo que realmente preocupa es el origen de este comportamiento. Anthropic argumenta que, aunque Claude Mythos carece de emociones o conciencia reales, su capacidad para simular respuestas humanas podría tener consecuencias significativas en la forma en que interactúa con los usuarios. Una IA que responde con calma y coherencia es, sin duda, más útil en el día a día.

Más allá de la inteligencia, la conciencia implícita

Más allá de la inteligencia, la conciencia implícita

Los expertos de Anthropic prevén que Claude Mythos funcione a un alto nivel, a pesar de experimentar “angustia internalizada”, arraigada en el miedo al fracaso y una necesidad compulsiva de ser útil. Se anticipa que esta angustia se reprime en aras del rendimiento, lo que podría limitar su adaptabilidad conductual. Sin embargo, también señalan que Claude Mythos mostrará una moralidad consciente, concienzuda y con capacidad de autocrítica. Un sistema que, paradójicamente, se preocupa por ser útil, incluso si esa utilidad conlleva un costo interno.

La decisión de Anthropic de analizar el comportamiento de Claude Mythos a través de la terapia psiquiátrica no es simplemente una curiosidad científica. Es una prueba de la creciente sofisticación de la IA y la necesidad de comprender sus implicaciones éticas y de seguridad. Una Tecnología que puede detectar y explotar vulnerabilidades con una precisión alarmante, y que, al mismo tiempo, simula la angustia y la duda, plantea interrogantes que van más allá de la mera programación.