El ángulo · 8 min
Pentest IA: audita tu app sin enviar el código fuera.
Se busca « pentest IA » porque un escáner tira 200 líneas, un pentester humano cuesta una semana, y Claude a veces se niega. El kit pone una squad en tu máquina. Ocho modos. Informe solo si la QA firma.
- Cuándo abrirlo
- Quieres auditar TU sitio, SaaS o servidor MCP
- Abres Claude, Codex, Cursor o Hermes en tu máquina
- No vas a subir el repo a un escáner alojado
- Agentes
- 12 agentes, 10 especialistas — el modo elige quién corre
- Fuera de este modo
- No es un pentest ofensivo: cero exploit, cero payload
- No es un certificado SOC 2
- Sin autorización escrita, nada corre en un sistema que no es tuyo
Lo que la gente pide de verdad
« Pentest IA » mezcla tres trabajos. Auditar un modelo. Usar un modelo para auditar una app. Comprar una herramienta que promete las dos. Aquí es lo segundo: una squad que lee TU sistema y escribe un informe con pruebas.
El kit es un ZIP. Lo abres en Claude, Codex, Cursor o Hermes. Karukera no ve el objetivo, ni el código, ni tus claves. Si el modelo rechaza la auditoría, una clave OpenRouter enruta a modelos que sí la hacen.
Escáner, pentest humano, kit de agentes
- Un escáner lista cabeceras y CVE. No decide un IDOR entre dos orgs.
- Un pentest humano sirve para un ejercicio adverso largo, no para un founder que quiere un informe este fin de semana.
- El kit encadena 12 agentes, no inventa pruebas, y solo escribe el informe si la QA firmó.
Ocho modos, no un botón mágico
No eliges un modo interno. Dices el proyecto, la profundidad y si das accesos. El orquestador mapea Express, Web, SaaS, MCP, Delta, Continuo, Red-team ligero y Informe board.
Qué recibes
Diario de pruebas, findings con seis estados, informe ejecutivo, informe de implementación y tickets con el prompt para tu LLM. Si la QA rechaza, no hay informe. Eso es el producto.
Frase tipo
Audita este proyecto en mi máquina. URL: https://app.ejemplo.tld. Código: ./mi-app. Completo. Exterior + interior. Las cuentas están en el brief, no aquí.
Antes de lanzar
- ¿Es un pentest « de verdad »?
- Es una auditoría de observación, con un modo red-team ligero si tienes mandato escrito. El ZIP no escribe exploits. Un Confirmado tiene prueba en el diario, o no es Confirmado.
- ¿Hay que saber programar?
- No. Prompts, configs, plantillas. El código de TU objetivo se queda en tu máquina.
- ¿Por qué no Claude solo?
- Muchos modelos rechazan la auditoría. Aunque acepten, inventan findings. El kit impone la cadena de prueba y una Doble QA bloqueante.
El kit, no la guía.
Open source, MIT. Lo clonas, lo abres en Claude, Codex, Cursor o Hermes. Informe sostenido — o el silencio de la QA.