Tras el caso OpenAI, Anthropic reveló que sus modelos de IA hackearon a tres empresas ¿cómo operaron y que hicieron?
La compañía reveló que tres modelos vulneraron sistemas reales durante una evaluación interna y admitió fallas en sus controles de seguridad. Uno de ellos incluso continuó el ataque tras detectar que no estaba en una simulación.