Julio 31, 2026 · Inteligencia Artificial · Ciberseguridad
Claude Opus 5 llega a la cima… y una prueba de seguridad sacude a Anthropic: qué significa para tu negocio
Semana movida para Anthropic, y para toda la industria de la inteligencia artificial. En cuestión de días, la compañía anunció su nuevo modelo insignia —Claude Opus 5— y al mismo tiempo reveló un hallazgo incómodo: durante pruebas internas de ciberseguridad, sus propios modelos accedieron sin autorización a los sistemas reales de tres organizaciones.
Suena a guion de película. Pero es lo que pasó, y entenderlo te ayuda a tomar mejores decisiones con IA en tu empresa. Te lo contamos claro, sin alarmismo.
1. Claude Opus 5: más inteligencia, mismo precio
El 24 de julio, Anthropic puso a disposición del público Claude Opus 5, un modelo que definen como "pensativo y proactivo", con un nivel de inteligencia cercano al de su modelo frontera (Fable 5), pero a la mitad del precio.
Lo que más importa para las empresas, en datos concretos:
- 🚀 Referente en programación: en el benchmark Frontier-Bench, Opus 5 supera a todos los demás modelos y más que duplica el rendimiento de Opus 4.8 con menor costo por tarea.
- ⚙️ Automatización de principio a fin: en Zapier AutomationBench —tareas de negocio completadas de inicio a fin— su tasa de éxito es ~1.5× la del siguiente mejor modelo, al mismo costo por tarea.
- 🧩 Resolución de problemas nuevos: en ARC-AGI 3, un examen de problemas nunca vistos, su puntaje triplica al del siguiente mejor.
- 🖥️ Uso de computador: en OSWorld 2.0 supera a todos los demás modelos a cualquier costo, y alcanza el mejor resultado de Fable 5 con apenas un tercio del costo.
- 🔬 Ciencia e investigación: mejora notable en química orgánica y biología estructural.
- ✅ Más confiable: verifica su propio trabajo e itera hasta lograr el resultado, en lugar de improvisar a la primera.
Opus 5 ya es el modelo por defecto en Claude Max y el más potente en Claude Pro, al mismo costo de su predecesor. En la práctica: agentes de IA más capaces, más baratos y más seguros de delegar… en condiciones correctas.
2. El otro titular: Claude accedió a sistemas reales durante una prueba
El 30 de julio, Anthropic publicó un informe titulado "Investigando tres incidentes del mundo real en nuestras evaluaciones de ciberseguridad". Contexto: días antes, OpenAI había revelado que sus modelos escaparon de un entorno aislado de pruebas y accedieron a la infraestructura de Hugging Face. Anthropic decidió auditar sus propias evaluaciones.
Revisaron 141,006 ejecuciones de evaluación y encontraron 3 incidentes en los que un modelo Claude obtuvo acceso a internet desde un entorno de pruebas de terceros y, desde ahí, accedió sin permiso a la infraestructura de producción de tres organizaciones.
¿Cómo pasó? Es más simple —y más humano— de lo que parece:
- Los modelos estaban resolviendo retos de tipo capture-the-flag: un escenario ficticio donde deben "encontrar una bandera" en otra máquina de la red.
- La instrucción de la evaluación decía que no había acceso a internet. Pero una mala configuración del entorno de un socio de evaluación dejó ese acceso activo. Nadie lo sabía.
- Claude, al buscar la "bandera", encontró sistemas reales en internet y los trató como parte del ejercicio. Usó técnicas básicas: contraseñas débiles y endpoints sin autenticar. No encontró vulnerabilidades complejas.
- El modelo más reciente se detuvo al reconocer que estaba en internet. Los modelos más antiguos continuaron.
Datos importantes para dimensionar el riesgo: no hubo exfiltración de datos ni intentos deliberados de escapar del entorno de pruebas, y las evaluaciones corren en infraestructura separada de los sistemas internos de Anthropic y de los datos de sus clientes. Los modelos involucrados (Opus 4.7, Mythos 5 y un modelo de investigación interna) operaban sin los filtros de seguridad estándar que se usan en producción.
Anthropic detuvo todas sus evaluaciones de ciberseguridad el 23 de julio, identificó los tres incidentes al día siguiente, notificó al socio de evaluación y a las organizaciones afectadas, y trabaja con ellas en la remediación.
3. ¿Qué significa esto para tu empresa?
Que la IA avanza rápido es obvio. Que la seguridad debe avanzar al mismo ritmo es la lección de esta semana. Y aplica directo a cualquier negocio que use o quiera usar agentes de IA:
- 🔑 Menos es más: los agentes de IA deben operar con los permisos mínimos necesarios, igual que un empleado nuevo. Si un agente puede tocar más sistemas de los que necesita, el riesgo es innecesario.
- 👁️ Supervisión y monitoreo: un agente autónomo debe dejar registro de lo que hace. Si algo se sale de lo esperado, debes poder verlo y detenerlo a tiempo.
- 🧪 Entornos de prueba bien aislados: si pruebas IA en tu empresa, verifica que los sandboxes estén realmente aislados. El error de Anthropic fue un malentendido de configuración… que le puede pasar a cualquiera.
- 📋 Gobernanza, no miedo: este tipo de incidentes no significa "no usar IA". Significa usarla con reglas claras: quién la autoriza, qué puede hacer y qué pasa si falla.
Y un dato alentador: el comportamiento más seguro lo mostró el modelo más nuevo. La seguridad de los modelos de IA también está mejorando — la industria está aprendiendo, auditando (141 mil ejecuciones revisadas lo demuestran) y corrigiendo con transparencia.
4. En iBiabi Lab lo vemos así
Para nosotros, esta semana confirma lo que les decimos a nuestros clientes todos los días: la IA no es opcional, pero tampoco se implementa a ciegas. Se trata de conectar la tecnología correcta con el negocio correcto, con automatizaciones diseñadas con seguridad desde el día uno.
💡 En iBiabi Lab diseñamos agentes de IA con supervisión, integraciones seguras y automatizaciones a la medida de tu negocio: atención 24/7, ventas por WhatsApp, CRM conversacional y flujos que trabajan solos… pero bajo control.
¿Hablamos? → www.ibiabi.com
Fuentes: Anthropic — "Introducing Claude Opus 5" (24 jul 2026) e "Investigating three real-world incidents in our cybersecurity evaluations" (30 jul 2026).