Integración SDK directa
Usa los SDK de AAP y AIP para añadir verificación de alineamiento y comprobación de integridad directamente al código de tu aplicación. Esto te da control total sobre cuándo se generan las trazas, cómo se ejecutan las comprobaciones de integridad y qué sucede ante las violaciones. Para funciones de gobernanza (aplicación de políticas, reclasificación de violaciones, recuperación de confianza), usa la API Policy y la API Reclassification junto con los SDK.Estos inicios rápidos están disponibles en español (Español) y en francés (Français) — se han traducido seis páginas por idioma.
Instalación
--legacy-peer-deps es necesario en npm 7+ mientras @mnemom/agent-integrity-protocol 1.3.0 siga declarando una dependencia peer opcional sobre el paquete alignment-protocol 1.x; los dos SDK funcionan juntos en 2.0.0 / 1.3.0.1
Definir una tarjeta de alineamiento
Una tarjeta de alineamiento declara la identidad, los valores, los límites de autonomía y los compromisos de auditoría de tu agente. Cada traza y comprobación de integridad se verifica contra esta tarjeta.
Los nombres de campos cambiaron en la forma de tarjeta unificada (AAP 2.0.0).
aap_version ahora es card_version (anclado a una fecha); autonomy_envelope/AutonomyEnvelope ahora es autonomy/Autonomy; audit_commitment/AuditCommitment ahora es audit/Audit; autonomy_mode e integrity_mode son nuevos campos de primer nivel; principal.identifier es obligatorio siempre que principal.type no sea unspecified; y audit.queryable: true requiere audit.query_endpoint. Consulta la migración desde la forma de tarjeta heredada 0.5.0 para el mapeo completo.2
Generar AP-Traces a partir de las acciones del agente
Cada decisión significativa que tome tu agente debería producir una AP-Trace. La traza registra la acción tomada, las alternativas consideradas, el razonamiento aplicado, y si se evaluó la escalada.
3
Verificar trazas contra la tarjeta
La verificación comprueba si el comportamiento del agente (registrado en la traza) es coherente con su alineamiento declarado (la tarjeta). Devuelve comprobaciones estructurales, una puntuación de similitud, y cualquier violación o advertencia.
El
similarity_score (0,0 a 1,0) mide cuán semánticamente similar es el comportamiento de la traza al alineamiento declarado. Una traza puede pasar todas las comprobaciones estructurales pero aun así recibir una advertencia low_behavioral_similarity si la puntuación cae por debajo de 0,50. Consulta la calibración para saber cómo se derivaron los umbrales.4
Añadir puntos de control de integridad
La comprobación de integridad AIP analiza los bloques de razonamiento del LLM por turno para detectar inyección de prompts, deriva de valores y manipulación. Cada comprobación produce un veredicto:
clear, review_needed, o boundary_violation.Un cliente se encarga de la extracción, la llamada al LLM y la contabilidad de puntos de control/ventanas por ti — pásale el cuerpo de respuesta crudo del proveedor, no una cadena de razonamiento pre-extraída. El card aquí es la forma de tarjeta mínima propia de AIP (card_id, values, autonomy_envelope) — un pequeño subconjunto de campos, mantenido separado del AlignmentCard de AAP completo que construiste en el Paso 1, ya que @mnemom/agent-alignment-protocol es solo una dependencia peer opcional para AIP.Mapeo de veredicto a acción
5
Comprobar la coherencia de valores
Antes de que tu agente colabore con otro agente, verifica que sus valores sean compatibles. La comprobación de coherencia compara los valores declarados y detecta conflictos.
Rastreo automático con decoradores (Python)
El SDK de Python de AAP proporciona decoradores para la generación automática de trazas:Detección de deriva
Monitoriza a tu agente en busca de deriva de comportamiento a lo largo del tiempo:Próximos pasos
- Descripción general de CLPI — Capa de gobernanza: aplicación de políticas, recuperación de confianza, anclaje on-chain
- API Policy — Gestión programática de políticas para integraciones SDK
- API Reclassification — Reclasificación de violaciones y recuperación de puntuación de confianza
- Especificación AAP — Detalles completos del protocolo para implementadores
- Especificación AIP — Detalles del protocolo de integridad
- Limitaciones — Qué puede y no puede garantizar AAP
- Modelo de seguridad — Modelo de amenazas y superficies de ataque
- Integración A2A — Añadir AAP a flujos de trabajo de agentes A2A
- Migración MCP — Añadir rastreo de alineamiento a herramientas MCP