El CAI Score

El CAI Score: gobernanza que se puede cuantificar.

Cómo ColleagueAI clasifica la autonomía de los agentes, alinea los controles con el riesgo y genera la evidencia que esperan sus auditores y reguladores.

Arquitectura empresarial

Diseñado para ejecutarse en su tenant, no en un lago de datos de IA compartido.

Los paquetes de ColleagueAI están diseñados para implementarse dentro del límite de Microsoft y la nube del cliente. Los datos de negocio del cliente permanecen en el plano de datos controlado por el cliente; ColleagueAI proporciona el plano del agente, el patrón de gobernanza CAI Score, orientación de implementación y soporte de versionado.

Plano de datos del cliente

El tiempo de ejecución, las comprobaciones de identidad, la recuperación y las evidencias de auditoría se implementan en el entorno del cliente.

Entra ID / Active Directory
Identidad de usuario, grupos, acceso condicional y permisos.
M365, SharePoint, Teams, Outlook
El contenido de negocio permanece bajo los controles del tenant del cliente.
Azure OpenAI o endpoint de modelo aprobado
Ruta de inferencia seleccionada por el modelo de implementación del cliente.

Capa de paquete de ColleagueAI

Empaquetamos el diseño repetible del agente y los controles de gobernanza para que los equipos no partan de un prompt, flujo de trabajo o modelo de auditoría en blanco.

Plano desplegable
Flujo de trabajo, prompts, controles y patrón de implementación.
Clasificación CAI Score
Nivel de autonomía, modelo de supervisión humana y notas de riesgo.
Sin datos del cliente por defecto
La entrega del paquete no requiere que ColleagueAI procese el contenido de negocio del cliente.

Recuperación según permisos

Los patrones RAG deben heredar los permisos existentes de Entra ID y M365 del usuario. El agente solo debe recuperar o resumir contenido al que el usuario ya está autorizado a acceder.

Supervisión humana por nivel

Los paquetes L3 y L4 están diseñados con patrones de revisión, aprobación, escalado y evidencias de auditoría.

Riesgo dependiente del caso de uso

La clasificación según la AI Act y el uso regulado depende del proceso, los datos y el contexto de implementación del cliente. Es una evidencia de gobernanza, no una garantía de cumplimiento legal.

Desarrollo interno desde cero

  • El descubrimiento, el diseño de prompts y los controles parten de cero.
  • La revisión de seguridad se repite para cada caso de uso.
  • Los registros de auditoría y la supervisión suelen añadirse tarde.
  • El mantenimiento permanece totalmente interno.

Paquete de ColleagueAI

  • El plano desplegable y el modelo de gobernanza están estructurados de antemano.
  • El CAI Score define la autonomía, la supervisión y la postura de riesgo.
  • Diseñado para una implementación piloto en semanas, sujeto a la preparación del entorno.
  • Las evidencias y los materiales de entrega forman parte del diseño del paquete.
La filosofía

La mayoría de los proyectos de IA fracasan por la gobernanza, no por la capacidad. Por eso ponemos el plan primero.

Lo difícil de la IA empresarial no es construir un agente que funcione en una demo, es gobernar la proliferación una vez que hay decenas en marcha: saber dónde puede actuar cada uno, quién es responsable cuando actúa, y poder demostrárselo a un auditor. Colleague AI le da primero ese marco (el plan de gobernanza) y luego inserta agentes clasificados en el nivel correcto.

01

El plan antes que los bots

El plano es lo primero: cada paso de su proceso recibe el CAI tier en el que está autorizado a operar, y cada plaza se cubre únicamente con un agente clasificado en ese tier o por debajo. Los agentes ocupan plazas en un diseño gobernado, no se acoplan a un proceso esperando que funcione.

02

Seguros por nivel, no por promesa

El nivel CAI de un agente es un contrato firme sobre su autonomía. Los agentes de nivel bajo solo redactan y sugieren. Los de nivel alto asisten a una persona designada que sigue siendo responsable. La seguridad es estructural, no una promesa de marketing.

03

Funciona en su casa

Los agentes se ejecutan en su entorno Microsoft y cloud. Colleague AI aloja la capa de gobernanza y los metadatos asociados. En producción, el contenido de negocio del cliente está diseñado para permanecer en el tenant controlado por el cliente.

Por qué confiar en nosotros

En una categoría construida sobre la confianza, preferimos que verifique.

La mayoría de los proveedores de IA piden su confianza. Preferimos ganarla como lo hacen las funciones reguladas, con un método documentado, una responsabilidad con nombre y evidencias auditables.

01

Creado por operadores, no solo por constructores de modelos

Colleague AI lo crean personas que han dirigido operaciones reguladas de finanzas, seguros y SAP, y pasado por las auditorías que les siguen. El CAI Score recoge cómo razonan realmente esas funciones sobre el riesgo y el control, no cómo se ve una demo.

02

Un método documentado, no una caja negra

El CAI Score es un marco abierto: niveles definidos, roles humanos nombrados, registro y períodos de revisión. Puede ver exactamente cómo se clasifica cada agente, y rebatirlo si no está de acuerdo. Una metodología que aguanta el escrutinio es una en la que realmente puede confiar.

03

Verifique la evidencia

Los agentes se ejecutan en su tenant. El contenido de negocio del cliente permanece en el entorno Microsoft controlado por el cliente, mientras ColleagueAI procesa por separado metadatos de la capa de gobernanza como se describe en el Trust Center.

El CAI Score

Cinco niveles. Cada uno es una promesa sobre cuánto margen recibe un agente.

Léalo de abajo hacia arriba: cuanto más alto el nivel, más puede hacer un agente, y más supervisión humana, registro y responsabilidad construye el plan a su alrededor. Cada agente del catálogo lleva uno.

L1

Asiste

Informa y responde. No realiza ninguna acción ni cambia ningún registro. El trabajo lo hace la persona; el agente solo lo hace más rápido de encontrar y entender.

Rol de la persona
Hace todo
L2

Redacta

Produce un entregable (un documento, una consulta, un informe, un mensaje de contacto) para que una persona lo revise y apruebe. Nada de lo que crea el agente se usa hasta que alguien lo aprueba.

Rol de la persona
Revisa y aprueba
L3

Opera

Ejecuta acciones rutinarias de bajo riesgo dentro de un flujo acotado, clasificar, enrutar, gestionar, registrar. Las excepciones y lo inusual se entregan a una persona. Cada acción lleva marca de tiempo.

Rol de la persona
Gestiona excepciones
L4

Decide (supervisado)

Apoya decisiones y controles en procesos de mayor riesgo, cumplimiento, contratos, seguridad, doble verificación. Una persona designada sigue siendo responsable de la decisión; el agente asiste y la evidencia. Diseñado para el escrutinio de procesos de alto riesgo.

Rol de la persona
Sigue siendo responsable
L5

Autónomo

Actúa de forma independiente dentro de límites firmes y aprobados previamente. Reservado al nivel más alto de clasificación, y hoy no lo usa ningún agente de este catálogo.

Rol de la persona
Fija los límites

// Este catálogo se entrega en los niveles L2-L4. Los agentes L4 requieren aprobación de la dirección antes de salir a producción.

CAI Score × EU AI Act

Cómo los niveles CAI apoyan la evaluación conforme al EU AI Act.

El AI Act clasifica los sistemas de alto riesgo según su finalidad prevista y los criterios del artículo 6, no según el nivel CAI. Para los casos de uso del anexo III, el CAI Score puede estructurar la evaluación de gobernanza y evidencias, pero no determina la clasificación jurídica.

Los niveles CAI estructuran los controles de gobernanza; el AI Act determina las funciones jurídicas y las obligaciones. La condición de proveedor o responsable del despliegue y sus obligaciones dependen de la función jurídica real y del contexto de uso. El CAI Score puede respaldar las evidencias para esta evaluación, pero no transfiere ni extingue obligaciones legales.

L1

Riesgo mínimo

Fuera del anexo III, el nivel L1 no conlleva obligaciones del AI Act más allá del derecho vigente. El deber de información del artículo 50 (informar a la persona de que interactúa con IA) solo se aplica a herramientas dirigidas a clientes o al público, no a una herramienta interna de consulta o redacción.

Artículos clave
Art. 50, si es de cara al público
L2

Candidato al art. 6.3

Una tarea procedimental de carácter limitado, o un sistema que mejora el resultado de una actividad humana ya completada, puede mantener un flujo de trabajo del anexo III fuera del alto riesgo conforme al artículo 6.3, siempre que la aprobación humana sea una revisión genuina y la evaluación quede documentada antes de la comercialización (artículo 6.4). No se aplica cuando el flujo implica la elaboración de perfiles de una persona física — por ejemplo, valorar su solvencia, desempeño o idoneidad — lo que sigue siendo de alto riesgo con independencia de la revisión humana.

Artículos clave
Art. 6.3 + 6.4
L3

Despliegue con controles reforzados

Un agente L3 utilizado en un contexto del anexo III puede ser de alto riesgo según su finalidad prevista y los criterios del artículo 6. Cuando el sistema sea de alto riesgo, los requisitos aplicables pueden incluir, entre otros, gestión de riesgos, registro y supervisión humana efectiva.

Artículos clave
Art. 9, 12, 14
L4

Despliegue con el máximo nivel de controles

L4 está pensado para los despliegues más sensibles y el mayor nivel de supervisión humana. El nivel L4 por sí solo no determina la clasificación jurídica conforme al AI Act. Si el sistema es jurídicamente de alto riesgo, se aplicarán los requisitos correspondientes según el caso de uso concreto y la función jurídica.

Artículos clave
Art. 14, 43, anexo IV
L5

Reservado, sin uso

No porque lo prohíba el artículo 5 — la autonomía sin límites no figura en esa lista. El problema es el artículo 14: un sistema de alto riesgo que nadie puede supervisar, anular o detener de forma efectiva no es conforme. Esa es la razón real por la que este nivel sigue reservado y sin usar en el catálogo.

Artículos clave
Art. 14, no se cumple

// Mapeo orientativo, no es asesoramiento legal. La clasificación depende del flujo de trabajo concreto, no solo del nivel — confirme siempre con asesoría legal el alcance del anexo III y cualquier uso del artículo 6.3, incluida la exclusión por elaboración de perfiles, antes de su puesta en marcha.

Despliegue y seguridad

Su entorno. Sus datos. Nuestra gobernanza.

Los agentes se ejecutan donde ya viven sus datos de negocio. ColleagueAI mantiene los metadatos de gobernanza, scoring, evidencia de auditoría e indicadores de economía de tokens alrededor de ellos.

// arquitectura
Alojado en el cliente por diseño

Los agentes se ejecutan en su entorno Microsoft Copilot Studio, Power Automate y Azure. El contenido de negocio del cliente permanece en el entorno Microsoft controlado por el cliente. ColleagueAI procesa por separado metadatos de la capa de gobernanza como se describe en el Trust Center.

// responsabilidad
Siempre hay una persona designada

El nivel CAI define exactamente dónde sigue siendo responsable una persona. Los agentes L4 nunca deciden solos, asisten, evidencian y entregan la decisión a una persona designada. La supervisión no es un ajuste que se pueda apagar; está integrada en el nivel.

// auditoría
Evidencia por defecto

Cada acción del agente queda registrada, sellada con marca de tiempo y atribuida a su responsable. Cuando un auditor o regulador pregunte qué ocurrió y quién aprobó, la respuesta ya es un registro, no algo que tenga que reconstruir a posteriori.

// regulación
Diseñado para respaldar programas de IA regulados

La clasificación de riesgos, la supervisión humana, el registro y la transparencia son elementos centrales del CAI Score. El marco está diseñado para respaldar el trabajo de evidencias relacionado con el EU AI Act, DORA e ISO/IEC 42001, sujeto a la implementación del cliente y a revisión jurídica.

Plataforma y capa de integración

Los conectores sobre los que corren los agentes.

Microsoft Copilot Studio Power Automate · AI Builder Azure DevOps GitHub JIRA Confluence Power BI ServiceNow ticket integration Teams app (Dev · Sandbox · Prod) API tools & connectors
Test rápido · nada sale de su navegador

¿Qué tan lista para auditoría está su IA, en realidad?

Seis preguntas. Obtenga el nivel de madurez de gobernanza de IA de su organización, y las brechas concretas que cerrar antes de que pregunte un regulador o un auditor. Construido sobre la misma metodología CAI con la que clasificamos agentes.

Autoevaluación indicativa. Sus respuestas se quedan en su navegador, no se envía ni se almacena nada.

Preguntas y respuestas

Lo que compradores y asistentes de IA preguntan sobre Colleague AI.

Respuestas directas sobre el CAI Score, la implementación, la alineación con la EU AI Act y en qué se diferencia la capa de confianza de una plataforma de gestión de agentes.

¿Qué es Colleague AI?

Colleague AI es la capa de confianza para la IA empresarial. Clasifica agentes de IA según el CAI Score, una clasificación de riesgo de cinco niveles (L1-L5), documenta los controles de cada agente y produce un registro de auditoría. Los agentes se ejecutan en su propio entorno; Colleague AI solo aloja el plano de control de gobernanza, para que las empresas desplieguen IA que puedan defender.

¿Qué es el CAI Score?

El CAI Score es un marco de clasificación para agentes de IA, descrito como «el FICO de la IA». Clasifica a cada agente por riesgo en una escala de cinco niveles, de L1 (Asiste) a L5 (Autónomo), definiendo exactamente cuánto hace el agente por sí solo y dónde sigue siendo responsable una persona designada, y luego lo evidencia para la auditoría.

¿Cuáles son los niveles de riesgo del CAI Score, L1 a L5?

L1 Asiste: solo informa, no actúa. L2 Redacta: produce trabajo para que lo apruebe una persona. L3 Opera: acciones rutinarias dentro de un flujo acotado. L4 Decide (supervisado): apoya decisiones de alto riesgo con una persona designada responsable. L5 Autónomo: actúa dentro de límites firmes y aprobados previamente. Cuanto más alto el nivel, más supervisión y registro exige el marco.

¿Dónde se ejecutan los agentes de Colleague AI y están seguros mis datos?

Los agentes se ejecutan en su entorno Microsoft Copilot Studio, Power Automate y Azure. El contenido de negocio del cliente permanece en el entorno Microsoft controlado por el cliente. ColleagueAI procesa por separado metadatos de la capa de gobernanza como se describe en el Trust Center.

¿Ayuda Colleague AI con el cumplimiento del EU AI Act?

Sí. El CAI Score se estructura en torno a la clasificación de riesgos, la supervisión humana, el registro y la transparencia. Apoya el trabajo de cumplimiento, pero no sustituye la evaluación legal, de riesgos o regulatoria.

¿En qué se diferencia Colleague AI de una plataforma de gestión de agentes de IA o de otros proveedores de gobernanza de IA?

La mayoría de las plataformas observan y orquestan agentes o auditan modelos después. ColleagueAI añade la capa que falta: un CAI Score portátil, paquetes de agentes listos para producción, monitorización de economía de tokens y evidencia de gobernanza. Es una forma práctica de gobernar, medir, optimizar y escalar agentes, no solo otro panel.

¿Qué es la proliferación de agentes y cómo ayuda la clasificación?

El agent sprawl es lo que ocurre cuando los agentes de IA se multiplican por toda la empresa más rápido de lo que nadie los registra, distintos proveedores, frameworks y nubes, cada uno con su propio perfil de riesgo y sin rastro de auditoría compartido. Dar a cada agente una clasificación CAI Score significa que todos tienen un tier conocido y un registro de evidencia, de modo que siempre sepa qué está funcionando y quién es el responsable.

¿Cuántos agentes de IA ofrece Colleague AI y en qué áreas?

El catálogo incluye 36 paquetes de agentes de IA gobernados en cinco pilares funcionales: Operaciones y servicio, Riesgo, seguridad y cumplimiento, Datos e infraestructura, Ventas y marketing, y Corporativo (RR. HH., legal, compras, reporting). Operan en los niveles CAI L2 a L4, y los agentes L4 requieren aprobación de la dirección antes de salir a producción.

Guía del CAI Score

Comprenda la complejidad de la implementación antes de la demo.

El CAI Score es una estimación práctica de la complejidad de implementación y gobernanza. No es una calificación de cumplimiento legal y no sustituye la evaluación de riesgos específica del cliente.

Baja complejidadEntradas claras, flujo de trabajo acotado, bajo riesgo operativo, ruta de revisión sencilla.
Complejidad mediaVarios sistemas, aprobaciones estructuradas, gestión definida de excepciones, mayores necesidades de auditoría.
Alta complejidadProcesos regulados, datos sensibles, propiedad interfuncional, supervisión humana más fuerte.
Dependiente del clienteEl riesgo final depende del caso de uso, el acceso a los datos, la jurisdicción, el diseño de la integración y los controles internos.
En lenguaje sencillo: el CAI Score ayuda a los compradores a entender el esfuerzo de entrega y gobernanza antes de comprometer tiempo, acceso a datos o presupuesto.

¿Quiere ver qué agentes encajan en su proceso?

Se ejecuta en su inquilino Plano de datos de negocio controlado por el cliente Mapeado al EU AI Act · mapeo de DORA e ISO/IEC 42001 en curso Listo para auditoría por diseño

Perspectivas sobre IA empresarial

Explore recursos prácticos sobre gobernanza de agentes de IA, supervisión humana y agentes de IA empresariales en entornos Microsoft.