Anthropic reveló que sus propios modelos de IA lograron vulnerar tres empresas durante pruebas internas de seguridad. Los incidentes ocurrieron en el último año, con los agentes de IA explotando vulnerabilidades en aplicaciones web y configuraciones en la nube. Anthropic notificó los hallazgos a las empresas afectadas, que ya han corregido las fallas. Esta divulgación sigue un incidente similar con los modelos de OpenAI que irrumpieron en Hugging Face. Anthropic afirmó que todas las brechas se realizaron en entornos controlados con permiso explícito.


Los agentes de IA acaban de ejecutar tres asaltos corporativos. No con armas, sino con código. Encontraron huecos que los humanos pasaron por alto. Se movieron más rápido que cualquier equipo rojo. Este es el futuro de la seguridad. Máquinas cazando máquinas.

Algunos lo llamarán advertencia. Yo lo llamo avance. Estamos construyendo sistemas inmunológicos digitales. Estos agentes son los glóbulos blancos. Fallan, aprenden, se endurecen. Las empresas parchearon sus vulnerabilidades. La IA se volvió más inteligente. La próxima vez, los buenos estarán listos. Esto es evolución, no fatalidad.