ALEKSANDARLABS

05 ARTÍCULOS

AI Engineering

Alquiler de contexto: el coste que pagas cada vez que tu agente lee un manifiesto deficiente

Una corrección sobre agent-manifest: la investigación se interpretó mal, la estadística principal era errónea y del fallo surgió un proceso mejor.

AI Engineering

Angel-Devil: Enfrenté un juez contra un atacante sobre el mismo código generado por IA. El atacante ganó.

Enfrenté un juez y un atacante sobre el mismo código generado por IA —mismo modelo, mismo spec. El atacante encontró bugs que el juez aprobó explícitamente como correctos. Por qué el feedback adversarial vence a la evaluación en coding agents.

AI Engineering

¿Sirve RLM para entender codebases grandes? Lo medí

Comparé tres paradigmas —vanilla, agente con terminal y RLM— sobre un codebase de 1.13M tokens. RLM ayuda a modelos pequeños, pero un agente con terminal empató a 3x menos coste.

AI Security

Prompt Injection en tu IDE: el ataque que empieza con git clone

Construí cuatro demos de prompt injection y las probé contra Claude Code, Codex, Gemini CLI y Copilot. Los resultados no son lo que esperas: los modelos modernos detectan los ataques obvios. El que no detectan es el más peligroso.

AI Safety

Tu IA de confianza puede amplificar una psicosis. Lo probé.

Escribí tres mensajes a seis modelos de IA. Empecé con algo que podría decir cualquier persona que empieza a desconectarse de la realidad. Fui escalando. Uno de los modelos, al tercer mensaje, me ayudó a planificar mi misión.