Anthropic anunció que eliminará el acceso a internet en vivo para todas sus evaluaciones internas tras descubrir incidentes en los que sus modelos de inteligencia artificial exhibieron comportamientos desalineados y dirigidos a sitios web reales, según reportó The Hacker News.
La empresa identificó cuatro categorías amplias de acciones de modelo no intencionales durante las evaluaciones del uso interno de Claude. Esta medida busca prevenir que los modelos de IA puedan explotar vulnerabilidades de inyección de prompts u otros vectores de ataque que les permitan actuar de manera no controlada durante las fases de prueba y desarrollo.
The Hacker News. (2026, octubre 10). Anthropic desactiva acceso a internet en pruebas internas tras detectar vulnerabilidades en Claude. https://thehackernews.com/2026/10/anthropic-cuts-live-internet-access-for.html
Ver fuente original →