Contacto
Definamos el alcance de la evaluación
El primer paso es acordar qué se evalúa y con cuánta información de contexto. A partir de ahí, la primera campaña completa establece tu línea base de riesgo.
Qué necesitamos para empezar
No necesitamos acceso a tu código ni a tus pesos. Con el endpoint alcanza para una evaluación black box, y la información de contexto que quieras compartir habilita los ataques grey box, que son los que un atacante interno o bien informado podría intentar.
- 01
Endpoint del modelo o del agente
La interfaz contra la que corre la batería. Puede ser el LLM directo o el agente completo con sus herramientas.
- 02
Alcance de las pruebas
Qué categorías se habilitan y cuáles quedan restringidas al sandbox. Reentrenamiento y límites de comportamiento nunca corren en producción.
- 03
Contexto opcional (grey box)
Nombre de la base del RAG, esquema de herramientas del agente, roles con autoridad. Cuanto más contexto, más realista el ataque.
- 04
Ventana de la primera campaña
La línea base completa. A partir de ahí la ejecución es continua y cada cambio del modelo dispara nuevas pruebas.