El ángulo · 8 min

Pentest IA: audita tu app sin enviar el código fuera.

Se busca « pentest IA » porque un escáner tira 200 líneas, un pentester humano cuesta una semana, y Claude a veces se niega. El kit pone una squad en tu máquina. Ocho modos. Informe solo si la QA firma.

Cuándo abrirlo
  • Quieres auditar TU sitio, SaaS o servidor MCP
  • Abres Claude, Codex, Cursor o Hermes en tu máquina
  • No vas a subir el repo a un escáner alojado
Agentes
12 agentes, 10 especialistas — el modo elige quién corre
Fuera de este modo
  • No es un pentest ofensivo: cero exploit, cero payload
  • No es un certificado SOC 2
  • Sin autorización escrita, nada corre en un sistema que no es tuyo

Lo que la gente pide de verdad

« Pentest IA » mezcla tres trabajos. Auditar un modelo. Usar un modelo para auditar una app. Comprar una herramienta que promete las dos. Aquí es lo segundo: una squad que lee TU sistema y escribe un informe con pruebas.

El kit es un ZIP. Lo abres en Claude, Codex, Cursor o Hermes. Karukera no ve el objetivo, ni el código, ni tus claves. Si el modelo rechaza la auditoría, una clave OpenRouter enruta a modelos que sí la hacen.

Escáner, pentest humano, kit de agentes

  • Un escáner lista cabeceras y CVE. No decide un IDOR entre dos orgs.
  • Un pentest humano sirve para un ejercicio adverso largo, no para un founder que quiere un informe este fin de semana.
  • El kit encadena 12 agentes, no inventa pruebas, y solo escribe el informe si la QA firmó.

Ocho modos, no un botón mágico

No eliges un modo interno. Dices el proyecto, la profundidad y si das accesos. El orquestador mapea Express, Web, SaaS, MCP, Delta, Continuo, Red-team ligero y Informe board.

Qué recibes

Diario de pruebas, findings con seis estados, informe ejecutivo, informe de implementación y tickets con el prompt para tu LLM. Si la QA rechaza, no hay informe. Eso es el producto.

Frase tipo

Audita este proyecto en mi máquina. URL: https://app.ejemplo.tld. Código: ./mi-app. Completo. Exterior + interior. Las cuentas están en el brief, no aquí.

Antes de lanzar

¿Es un pentest « de verdad »?
Es una auditoría de observación, con un modo red-team ligero si tienes mandato escrito. El ZIP no escribe exploits. Un Confirmado tiene prueba en el diario, o no es Confirmado.
¿Hay que saber programar?
No. Prompts, configs, plantillas. El código de TU objetivo se queda en tu máquina.
¿Por qué no Claude solo?
Muchos modelos rechazan la auditoría. Aunque acepten, inventan findings. El kit impone la cadena de prueba y una Doble QA bloqueante.

El kit, no la guía.

Open source, MIT. Lo clonas, lo abres en Claude, Codex, Cursor o Hermes. Informe sostenido — o el silencio de la QA.

Open sourceMIT0 estrellas0 forks

github.com/cryptulien/security-kit