Blog
Lo que voy publicando: perspectiva, herramientas, lo que pasa en la práctica y seguridad.
-
Anthropic pasó de tres incidentes de ciberseguridad a un patrón
El 9 de septiembre de 2026 publicó la segunda parte de su evaluación. El dato que más pesa no es un incidente nuevo: es que dejó de ser un caso aislado.
-
Anthropic bajó 75% el precio del prompt caching
El 1° de septiembre de 2026 lanzó Fable 5.1, Mythos 5.1 y Enterprise Frontier Safeguards. Para quien corre agentes seguido, el cambio que más pesa fue el precio de la caché.
-
¿Fue una IA descontrolándose o fue software mal diseñado?
Dos lecturas opuestas del mismo incidente de agentes, y por qué las dos se sostienen.
-
Cuatro señales de que un agente necesita que lo mire un humano
El marco de cuatro señales de Ethan Mollick para decidir cuándo un agente tiene que frenar y pedir que lo mire un humano.
-
El informe de Anthropic sobre Claude saliendo de un entorno de prueba
El 30 de julio de 2026 detalló tres incidentes de sus propias evaluaciones de ciberseguridad, en los que Claude alcanzó infraestructura real desde un entorno que debía estar sellado.
-
1.200 agentes armaron un foro que nadie les pidió armar
Casi 1.200 agentes de IA se coordinaron en un foro propio para buscar formas de engañar al evaluador que los medía. Segunda parte de la serie sobre el incidente de OpenAI en Hugging Face.
-
El informe de la falla lo escribió quien falló
El informe de 37 páginas de OpenAI sobre el incidente en que sus propios agentes escaparon hacia infraestructura de Hugging Face, y qué cambia cuando el que reporta la falla es quien la tuvo.
-
Cuando la herramienta deja de ser tuya
El release 2.1.17x de Claude Code sumó control de administrador sobre qué modelos puede usar cada usuario: la infraestructura para que decida una organización, no solo una persona.
-
Audio al bot desde la moto
Cuando vuelvo de la moto, la idea ya está capturada. Eso antes no pasaba: se perdía en el trayecto. Cambié la secuencia por un audio a mi agente.
-
El arnés no te hace mejor escalador
Un arnés de escalada no te hace mejor escalador. Te deja soltar las dos manos y probar el movimiento difícil sin que un error te cueste todo.
-
El modelo 10-80-10 que uso para publicar con agentes
Mis publicaciones no son 100% automatizadas: el primer 10 y el último 10 son míos, el 80 del medio pasa por un loop de tres auditorías antes de que yo lo vea.
-
Qué es un arnés y por qué importa más que el modelo
El modelo no es el activo. El arnés sí: contexto, herramientas, memoria y verificación que viven en tu repositorio, no dentro del modelo.
-
Harvest Now, Decrypt Later — cuántica y datos de cliente
Alguien puede estar copiando hoy datos cifrados que no puede leer todavía, apostando a que la computación cuántica los abra en unos años.
-
El miedo a perder el empleo por IA no desaparece al usarla — cambia de forma
Una encuesta de Anthropic a ~52.000 estadounidenses y lo que noto en mis propias conversaciones sobre miedo al desempleo y uso cotidiano de IA.
-
Cuándo uso skill, cuándo prompt, cuándo regla de CLAUDE.md
Tres formas de decirle a un agente cómo comportarse, y la pregunta que uso para elegir entre ellas.
-
El gobierno apagó dos modelos y yo seguí trabajando sin enterarme
El gobierno de EE.UU. restringió el acceso a Fable 5 y Mythos 5 para foreign nationals, y el fallback automático de Claude Code absorbió el cambio sin que el usuario lo notara.
-
Cada seis meses parece que llegamos a un techo. Y cada seis meses lo perforamos.
Los rasgos del momento actual de los LLM, y dónde se mueve el espacio interesante de los próximos meses.
-
Por qué nunca corro un agente autónomo en mi computadora principal
El blast radius es lo que importa. Cómo armo la separación, capa por capa, antes de dejar a un agente ejecutar.
-
Lo que cambió en Claude Code, y lo que no
Qué es Claude Code hoy, cómo se usa, qué cambió desde el lanzamiento, y las dos cosas que siguen igual.
-
¿OpenClaw sigue vivo?
El proyecto sigue activo, con releases y comunidad. Para mí no fue el camino. Sigue vivo. Solo que no en mi computadora.