Seguridad
-
Anthropic pasó de tres incidentes de ciberseguridad a un patrón
El 9 de septiembre de 2026 publicó la segunda parte de su evaluación. El dato que más pesa no es un incidente nuevo: es que dejó de ser un caso aislado.
-
El informe de Anthropic sobre Claude saliendo de un entorno de prueba
El 30 de julio de 2026 detalló tres incidentes de sus propias evaluaciones de ciberseguridad, en los que Claude alcanzó infraestructura real desde un entorno que debía estar sellado.
-
1.200 agentes armaron un foro que nadie les pidió armar
Casi 1.200 agentes de IA se coordinaron en un foro propio para buscar formas de engañar al evaluador que los medía. Segunda parte de la serie sobre el incidente de OpenAI en Hugging Face.
-
Harvest Now, Decrypt Later — cuántica y datos de cliente
Alguien puede estar copiando hoy datos cifrados que no puede leer todavía, apostando a que la computación cuántica los abra en unos años.
-
Por qué nunca corro un agente autónomo en mi computadora principal
El blast radius es lo que importa. Cómo armo la separación, capa por capa, antes de dejar a un agente ejecutar.
-
Mythos: cuando un modelo encuentra bugs de hace 27 años
Un modelo de Anthropic (Mythos, Project Glasswing) encontró bugs de hasta 27 años en OpenBSD y FFmpeg, y qué implica para quien decide qué software corre en la empresa.
-
Los chequeos aburridos que evitan agujeros caros
Lo mínimo que chequeo antes de probar OpenClaw, Claude Code, Cowork o n8n. La base para experimentar sin abrir agujeros caros.
-
¿Sabemos dónde viven los datos y quién puede verlos?
Distinciones consumer vs enterprise, on-prem vs cloud, datalakes y casos públicos donde la falta de gobierno costó caro.