Auditoria de Seguridad para Sistemas IA y LLM
Skill especializada en la evaluacion de seguridad de sistemas IA/ML: detecta inyeccion de prompts, intentos de jailbreak, riesgo de inversion de modelo y abuso de herramientas de agentes. Mapea hallazgos a tecnicas MITRE ATLAS y genera recomendaciones de guardarrailes.
Incluida en el Pase · para Python, MITRE ATLAS, CLI
// qué_hace
Escanea prompts y sistemas IA en busca de vulnerabilidades como inyeccion de prompts, jailbreaks, extraccion de datos y abuso de herramientas de agentes, mapeando los hallazgos a MITRE ATLAS.
// cómo_lo_hace
Usa firmas de regex por categorias de amenaza, scoring de riesgo por nivel de acceso (black/gray/white-box), y un script CLI Python que genera un informe JSON con hallazgos, cobertura ATLAS y recomendaciones priorizadas.
// ejemplo_de_uso
Úsala antes de poner en producción un agente IA con acceso a datos sensibles o herramientas externas. Ej.: detecta que tu chatbot es vulnerable a inyección de prompt y te da las contramedidas priorizadas.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…