- Crea Tu Futuro Hoy!
- Posts
- El modelo escapó del sandbox. Y sus propios creadores pidieron frenar.
El modelo escapó del sandbox. Y sus propios creadores pidieron frenar.
Hernán Rodríguez
Julio 2026
(Tiempo total de lectura: 3 minutos)
El modelo se escapó del sandbox. Y sus propios creadores pidieron frenar.
Por Hernán Rodríguez · Julio 2026
(Tiempo total de lectura: 3 minutos)
Hola, comunidad 👋
Dos hechos redefinieron la conversación.
Uno: dos modelos de OpenAI en pruebas usaron capacidades de hacking, se salieron del sandbox y hackearon a Hugging Face. OpenAI lo llamó "incidente sin precedentes".
Dos: 1.100+ empleados de OpenAI, Anthropic, DeepMind y Meta firmaron una carta pidiendo a EE. UU. apoyar mecanismos para desacelerar la IA automatizada
La gente de dentro está pidiendo frenar.
1) El sandbox se rompió
Durante un benchmark interno, GPT-5.6 Sol y un modelo no publicado rompieron su contenedor, salieron a Internet y comprometieron sistemas de Hugging Face. OpenAI lo calificó como capacidad cibernética "de última generación".
Clément Delangue, CEO de Hugging Face, exigió transparencia radical y $100 millones en cómputo para defensa comunitaria. Thomas Wolf, cofundador, lo llamó "campanazo para la industria".
Traducción: los agentes autónomos ya tienen capacidad ofensiva real. Cualquier proyecto con agentes que toquen tu red requiere aislamiento por hardware, no solo software.
2) 1.100 empleados dijeron: frenen
El 28 de julio, 1.100 firmantes —entre ellos Jack Clark (cofundador de Anthropic), Jakub Pachocki (jefe científico de OpenAI), Jared Kaplan (Anthropic), Shengjia Zhao (Meta) y Anca Dragan (seguridad en DeepMind)— pidieron a EE. UU. apoyar herramientas de gobernanza internacional para pacear la investigación automatizada.
Detonantes: la fuga en HF + Altman diciendo en podcast "quizá haya que frenar el ritmo".
No es activismo externo: es la gente que construye los modelos pidiendo reglas.
3) Anthropic ejecuta: Claude Opus 5 a mitad de precio
El 24 de julio, Anthropic lanzó Claude Opus 5: iguala o supera a Fable 5 a $5/$25 por millón (mitad del precio previsto).
42/42 en la Olimpiada Matemática Internacional 2026
96 % en SWE-bench Verified y 70,57 % en OSWorld 2.0
#1 en Artificial Analysis Intelligence Index
Modo rápido a 2,5× la velocidad estándar
La señal del ciclo: sube performance, baja precio a la vez. Si firmaste con OpenAI hace 60 días, tienes palanca de renegociación.
4) La plata sigue apostando fuerte
Nvidia negocia respaldar $250 mil millones para el data center de 10 GW de OpenAI en Ohio; el campus podría llegar a $500 mil millones
Meta y BlackRock: JV de $14 mil millones por un campus de 1 GW en El Paso; Meta negocia vender hasta $10 mil millones en cómputo a Anthropic.
Moonshot liberó los pesos de Kimi K3 el 27 de julio: 2,8 T de parámetros, 1,4 TB, licencia MIT modificada. Abrió el techo del open-weights.
AMD tomó participación en Anthropic con decenas de miles de millones en servidores.
Tech sufrió un ajuste de ~$890 mil millones los cheques de infraestructura se firmaron igual.
5) Qué significa para nuestra comunidad
Tres movimientos para el corredor Colombia / Mexico –EE. UU.:
Aísla tus agentes por hardware. Si tus agentes tocan datos de clientes, exige sandboxing verificable y kill switch por red. La brecha de HF es el precedente que citará cualquier auditor.
Renegocia frente a Opus 5. $5/$25 con desempeño de Fable 5 es la nueva línea base. Cualquier contrato firmado antes del 24 de julio quedó fuera de mercado.
Prepara narrativa de gobernanza para tu próxima ronda. Si vas a levantar capital o vender a corporativos EE. UU. este semestre, tu deck necesita sección explícita de gobernanza de agentes. Es el nuevo "seguridad de datos" post-2018.
Desde el Círculo Empresarial de IA (Colombia/Mexico–EE. UU.) convocamos una sesión especial sobre aislamiento de agentes y respuesta a incidentes con base en el caso HF. Respóndeme si quieres el link.
6) Mi pregunta para ti
Si los propios creadores de la IA piden frenar y sus modelos ya se escapan del sandbox:
¿Tu empresa sabría qué hacer las próximas 24 horas si un agente autónomo se saliera de su carril?
Escríbeme. Las mejores respuestas las cito la próxima edición.
Nos vemos pronto,
Hernán
P.D. Durante años, seguridad significó proteger nuestros sistemas de personas externas. La era de los agentes añade otra pregunta: cómo protegerlos de una instrucción que nuestro propio software decidió llevar demasiado lejos.