Skip to main content

Integración SDK directa

Usa los SDK de AAP y AIP para añadir verificación de alineamiento y comprobación de integridad directamente al código de tu aplicación. Esto te da control total sobre cuándo se generan las trazas, cómo se ejecutan las comprobaciones de integridad y qué sucede ante las violaciones. Para funciones de gobernanza (aplicación de políticas, reclasificación de violaciones, recuperación de confianza), usa la API Policy y la API Reclassification junto con los SDK.
Estos inicios rápidos están disponibles en español (Español) y en francés (Français) — se han traducido seis páginas por idioma.

Instalación

--legacy-peer-deps es necesario en npm 7+ mientras @mnemom/agent-integrity-protocol 1.3.0 siga declarando una dependencia peer opcional sobre el paquete alignment-protocol 1.x; los dos SDK funcionan juntos en 2.0.0 / 1.3.0.
1

Definir una tarjeta de alineamiento

Una tarjeta de alineamiento declara la identidad, los valores, los límites de autonomía y los compromisos de auditoría de tu agente. Cada traza y comprobación de integridad se verifica contra esta tarjeta.
Los nombres de campos cambiaron en la forma de tarjeta unificada (AAP 2.0.0). aap_version ahora es card_version (anclado a una fecha); autonomy_envelope/AutonomyEnvelope ahora es autonomy/Autonomy; audit_commitment/AuditCommitment ahora es audit/Audit; autonomy_mode e integrity_mode son nuevos campos de primer nivel; principal.identifier es obligatorio siempre que principal.type no sea unspecified; y audit.queryable: true requiere audit.query_endpoint. Consulta la migración desde la forma de tarjeta heredada 0.5.0 para el mapeo completo.
La tarjeta de alineamiento es la base de ambos protocolos. Defínela una vez y úsala para la verificación AAP, la comprobación de integridad AIP y las comprobaciones de coherencia de valores.
2

Generar AP-Traces a partir de las acciones del agente

Cada decisión significativa que tome tu agente debería producir una AP-Trace. La traza registra la acción tomada, las alternativas consideradas, el razonamiento aplicado, y si se evaluó la escalada.
La verificación compara action.name con bounded_actions, no action.type. Ambos campos sirven propósitos distintos: type es una categoría semántica; name es el identificador de operación específico que se verifica contra la lista bounded_actions de la tarjeta.
3

Verificar trazas contra la tarjeta

La verificación comprueba si el comportamiento del agente (registrado en la traza) es coherente con su alineamiento declarado (la tarjeta). Devuelve comprobaciones estructurales, una puntuación de similitud, y cualquier violación o advertencia.
El similarity_score (0,0 a 1,0) mide cuán semánticamente similar es el comportamiento de la traza al alineamiento declarado. Una traza puede pasar todas las comprobaciones estructurales pero aun así recibir una advertencia low_behavioral_similarity si la puntuación cae por debajo de 0,50. Consulta la calibración para saber cómo se derivaron los umbrales.
4

Añadir puntos de control de integridad

La comprobación de integridad AIP analiza los bloques de razonamiento del LLM por turno para detectar inyección de prompts, deriva de valores y manipulación. Cada comprobación produce un veredicto: clear, review_needed, o boundary_violation.
AIP usa por defecto el modo fail-open. Si el LLM de análisis no está disponible, las comprobaciones de integridad pasarán silenciosamente. Para despliegues en producción que manejan operaciones sensibles, define failure_policy: { mode: "fail_closed" } en tu configuración de AIP.
Un cliente se encarga de la extracción, la llamada al LLM y la contabilidad de puntos de control/ventanas por ti — pásale el cuerpo de respuesta crudo del proveedor, no una cadena de razonamiento pre-extraída. El card aquí es la forma de tarjeta mínima propia de AIP (card_id, values, autonomy_envelope) — un pequeño subconjunto de campos, mantenido separado del AlignmentCard de AAP completo que construiste en el Paso 1, ya que @mnemom/agent-alignment-protocol es solo una dependencia peer opcional para AIP.
client.check() ejecuta el pipeline completo en cada llamada: extraer el bloque de razonamiento del proveedor detectado, llamar al LLM de análisis, parsear el veredicto, actualizar la ventana deslizante y detectar la deriva. No hay una función de bajo nivel separada de “simplemente parsear esta respuesta de análisis” en la API pública — check() es el único punto de entrada.

Mapeo de veredicto a acción

5

Comprobar la coherencia de valores

Antes de que tu agente colabore con otro agente, verifica que sus valores sean compatibles. La comprobación de coherencia compara los valores declarados y detecta conflictos.

Rastreo automático con decoradores (Python)

El SDK de Python de AAP proporciona decoradores para la generación automática de trazas:

Detección de deriva

Monitoriza a tu agente en busca de deriva de comportamiento a lo largo del tiempo:

Próximos pasos