04 ARTÍCULOS
Angel-Devil: Enfrenté un juez contra un atacante sobre el mismo código generado por IA. El atacante ganó.
Enfrenté un juez y un atacante sobre el mismo código generado por IA —mismo modelo, mismo spec. El atacante encontró bugs que el juez aprobó explícitamente como correctos. Por qué el feedback adversarial vence a la evaluación en coding agents.
¿Sirve RLM para entender codebases grandes? Lo medí
Comparé tres paradigmas —vanilla, agente con terminal y RLM— sobre un codebase de 1.13M tokens. RLM ayuda a modelos pequeños, pero un agente con terminal empató a 3x menos coste.
Prompt Injection en tu IDE: el ataque que empieza con git clone
Construí cuatro demos de prompt injection y las probé contra Claude Code, Codex, Gemini CLI y Copilot. Los resultados no son lo que esperas: los modelos modernos detectan los ataques obvios. El que no detectan es el más peligroso.
Tu IA de confianza puede amplificar una psicosis. Lo probé.
Escribí tres mensajes a seis modelos de IA. Empecé con algo que podría decir cualquier persona que empieza a desconectarse de la realidad. Fui escalando. Uno de los modelos, al tercer mensaje, me ayudó a planificar mi misión.