Blog
Tu lista de bloqueo hace match dentro de las palabras
Perdí datos reales durante semanas por un término de bloqueo de tres letras que coincidía dentro de una palabra inocente. Los filtros de exclusión no dan error cuando se equivocan: simplemente quitan cosas, y ‘cero resultados’ es idéntico a ’no hay tales datos’. Una historia sobre matching por substring, límites de palabra, y por qué el filtro más peligroso es el que nunca ves dispararse.
Leer más →Cómo detectar cuando tu agente de IA se sale del guion
La conversación sobre seguridad de agentes se ha quedado en ’ten cuidado con la trifecta letal’. Bien, ya la tienes. ¿Y ahora cómo la detectas en producción? Este post baja al terreno de detection engineering: las cuatro señales que hay que instrumentar en un agente autónomo, el log que casi nadie captura, y detecciones concretas que puedes escribir hoy.
Leer más →LLMs en Detection Engineering: Dónde Aceleran y Dónde Mienten
Cómo un ingeniero solo usa LLMs para acelerar detection engineering sin bajar el listón: qué delegar, qué no, y cómo verificar cada salida antes de que toque producción.
Leer más →Un Ingeniero de Seguridad, un Equipo Entero: Cómo Opero como un SOC con IA (y Qué No Delego)
La tesis del arbitraje de inteligencia aplicada a security ops: qué partes del trabajo de un SOC se orquestan con agentes, qué jamás se automatiza, y la disciplina que evita el desastre.
Leer más →Audité 64 servidores MCP públicos con un linter que escribí. 63 salieron limpios
Un scanner estático (Python, cero dependencias, cero red) que audita configuraciones de servidores MCP y agentes contra el OWASP Agentic Top 10, con guía de detección para cada hallazgo. Lo validé contra 64 repos MCP públicos: 63 sin hallazgos serios. Este post cuenta qué encontré, por qué la mayoría del ruido inicial eran falsos positivos, y qué aprendí afinándolos — la parte honesta que los lanzamientos de herramientas se saltan.
Leer más →Hace un mes escribí que los health checks mienten. Esta semana me mintió el mío
En «Tu health check te está mintiendo» defendí que disponibilidad y corrección son preguntas distintas. Un mes después me tocó comerme mis palabras: dos agentes míos degradaron y murieron en silencio durante semanas. Esta es la parte que aquel post no contaba —cómo se siente estar del lado ciego— y la distinción que aprendí a golpes: fail-open contra fail-closed.
Leer más →Bleeding Llama (CVE-2026-7482): Tu LLM Local Es una Fuga de Memoria Sin Autenticar
Un out-of-bounds read en el cargador GGUF de Ollama permite a un atacante sin autenticar exfiltrar memoria del proceso — prompts, secretos, variables de entorno — en tres llamadas API. ~300.000 servidores escuchan en 0.0.0.0 por defecto. Todos te dicen que parchees. Nadie te dice cómo detectarlo. Esto sí.
Leer más →La reputación de IP es una señal de detección frágil — lo que aprendí construyendo un proxy residencial 4G
La mayoría de los WAF se apoyan mucho en la reputación de IP para separar humanos de bots. Construir el lado de la evasión —un móvil Android viejo como proxy residencial 4G— me mostró exactamente dónde se derrumba esa señal, y por qué el comportamiento de tasa y secuencia sobrevive a cualquier lista de IPs. Un post-mortem de detection engineering, con el stack completo incluido.
Leer más →Tu bypass 'imposible' tiene fecha de caducidad
Un geo-filtro que había documentado como ‘imposible de saltar, caso cerrado’ se volvió trivial sin que yo tocara nada, porque una variable que trataba como constante no lo era. Esto es una nota de campo sobre hacer ingeniería inversa al geo-filtro de un marketplace en tiempo real, los tres detalles no documentados que deciden si respeta tus coordenadas o las ignora en silencio, y la lección de fondo: todo bypass que escribes tiene caducidad, porque la infraestructura del otro lado se mueve mientras tus notas siguen quietas.
Leer más →Tu health check te está mintiendo
Disponibilidad y corrección son dos preguntas distintas, y casi toda la monitorización solo responde la primera. Te enseño cómo un sistema puede pasar todos los health checks mientras sirve datos rotundamente falsos, por qué el verde es el color más peligroso de un panel, y la consulta que convierte a un mentiroso en testigo.
Leer más →