Der CAI Score

Der CAI Score: Governance, die sich beziffern lässt.

Wie ColleagueAI die Autonomie von Agenten klassifiziert, Kontrollen dem Risiko zuordnet und die Nachweise erzeugt, die Ihre Auditoren und Aufsichtsbehörden erwarten.

Unternehmensarchitektur

Konzipiert für den Betrieb in Ihrem Tenant, nicht in einem gemeinsamen KI-Data-Lake.

ColleagueAI-Pakete sind für die Bereitstellung innerhalb der Microsoft- und Cloud-Grenze des Kunden konzipiert. Die Geschäftsdaten des Kunden verbleiben in der kundenkontrollierten Datenebene; ColleagueAI stellt den Agenten-Blueprint, das CAI-Score-Governance-Muster, Bereitstellungsanleitungen und Versionierungsunterstützung bereit.

Kundendatenebene

Laufzeit, Identitätsprüfungen, Retrieval und Audit-Nachweise werden in der Kundenumgebung bereitgestellt.

Entra ID / Active Directory
Benutzeridentität, Gruppen, bedingter Zugriff und Berechtigungen.
M365, SharePoint, Teams, Outlook
Geschäftsinhalte bleiben unter der Kontrolle des Kunden-Tenants.
Azure OpenAI oder genehmigter Modell-Endpunkt
Inferenzpfad, ausgewählt durch das Bereitstellungsmodell des Kunden.

ColleagueAI-Paketebene

Wir verpacken das wiederholbare Agentendesign und die Governance-Kontrollen, damit Teams nicht bei einem leeren Prompt, Workflow oder Auditmodell beginnen.

Bereitstellbarer Blueprint
Workflow, Prompts, Kontrollen und Implementierungsmuster.
CAI-Score-Klassifizierung
Autonomiestufe, Modell der menschlichen Aufsicht und Risikohinweise.
Standardmäßig keine Kundendaten
Die Paketbereitstellung erfordert nicht, dass ColleagueAI Geschäftsinhalte des Kunden verarbeitet.

Berechtigungsbewusstes Retrieval

RAG-Muster sollten die bestehenden Entra-ID- und M365-Berechtigungen des Benutzers übernehmen. Der Agent sollte nur Inhalte abrufen oder zusammenfassen, auf die der Benutzer bereits zugriffsberechtigt ist.

Menschliche Aufsicht nach Stufe

L3- und L4-Pakete sind mit Mustern für Überprüfung, Genehmigung, Eskalation und Audit-Nachweise konzipiert.

Anwendungsfallabhängiges Risiko

Die Klassifizierung gemäß AI Act und regulierter Nutzung hängt vom Prozess, den Daten und dem Bereitstellungskontext des Kunden ab. Dies ist ein Governance-Nachweis, keine Garantie für die Einhaltung gesetzlicher Vorschriften.

Interner Aufbau von Grund auf

  • Discovery, Prompt-Design und Kontrollen beginnen bei null.
  • Die Sicherheitsüberprüfung wiederholt sich für jeden Anwendungsfall.
  • Audit-Protokolle und Aufsicht werden oft spät hinzugefügt.
  • Die Wartung bleibt vollständig intern.

ColleagueAI-Paket

  • Bereitstellbarer Blueprint und Governance-Modell sind im Voraus strukturiert.
  • Der CAI Score definiert Autonomie, Aufsicht und Risikohaltung.
  • Konzipiert für die Pilotbereitstellung in Wochen, abhängig von der Umgebungsbereitschaft.
  • Nachweise und Übergabematerialien sind Teil des Paketdesigns.
Die Philosophie

Die meisten KI-Projekte scheitern an Governance, nicht an Fähigkeiten. Deshalb stellen wir den Bauplan an die erste Stelle.

Das Schwierige an Enterprise-KI ist nicht, einen Agenten zu bauen, der in einer Demo funktioniert, es ist die Steuerung des Wildwuchses, sobald Dutzende live sind: zu wissen, wo jeder handeln darf, wer verantwortlich ist, wenn er handelt, und es einem Prüfer nachweisen zu können. Colleague AI gibt Ihnen zuerst diesen Rahmen (den Governance-Bauplan) und setzt dann klassifizierte Agenten auf der richtigen Stufe ein.

01

Bauplan vor Bots

Der Plan kommt zuerst: Jeder Schritt Ihres Prozesses erhält den CAI tier, auf dem er operieren darf, und jeder Platz wird nur mit einem Agenten besetzt, der für diesen Tier oder einen niedrigeren klassifiziert ist. Agenten füllen Plätze in einem gesteuerten Design, sie werden nicht an einen Prozess geheftet in der Hoffnung, dass es klappt.

02

Sicher durch Stufe, nicht durch Versprechen

Die CAI-Stufe eines Agenten ist ein fester Vertrag über seine Autonomie. Agenten niedriger Stufe entwerfen und schlagen nur vor. Agenten hoher Stufe unterstützen einen benannten Menschen, der verantwortlich bleibt. Sicherheit ist strukturell, kein Marketingversprechen.

03

Er läuft bei Ihnen zu Hause

Agenten laufen in Ihrer eigenen Microsoft- und Cloud-Umgebung. Colleague AI hostet die Governance-Schicht und zugehörige Metadaten. Bei Produktionsbereitstellungen sind Kundengeschäftsinhalte so ausgelegt, dass sie im kundengesteuerten Mandanten verbleiben.

Warum uns vertrauen

In einer Kategorie, die auf Vertrauen baut, sollen Sie lieber prüfen.

Die meisten KI-Anbieter bitten um Ihr Vertrauen. Wir verdienen es lieber so, wie es regulierte Funktionen tun, mit einer dokumentierten Methode, benennbarer Verantwortung und prüfbaren Nachweisen.

01

Von Praktikern gebaut, nicht nur von Modellbauern

Colleague AI wird von Menschen gebaut, die regulierte Finanz-, Versicherungs- und SAP-Abläufe geführt haben, und die darauf folgenden Prüfungen durchlaufen haben. Der CAI Score bildet ab, wie diese Funktionen tatsächlich über Risiko und Kontrolle denken, nicht wie eine Demo aussieht.

02

Eine dokumentierte Methode, keine Blackbox

Der CAI Score ist ein offenes Framework: definierte Tiers, benannte menschliche Rollen, Protokollierung und Überprüfungszeiträume. Sie sehen genau, wie jeder Agent klassifiziert ist, und können widersprechen, wenn Sie anderer Meinung sind. Eine Methodik, die einer genauen Prüfung standhält, ist eine, hinter der Sie wirklich stehen können.

03

Prüfen Sie die Nachweise

Agenten laufen in Ihrem Mandanten. Geschäftsinhalte des Kunden verbleiben in der kundengesteuerten Microsoft-Umgebung, während ColleagueAI separate Metadaten der Governance-Schicht wie im Trust Center beschrieben verarbeitet.

Der CAI Score

Fünf Stufen. Jede ist ein Versprechen darüber, wie viel Spielraum ein Agent bekommt.

Von unten nach oben gelesen: je höher die Stufe, desto mehr darf ein Agent, und desto mehr menschliche Aufsicht, Protokollierung und Verantwortlichkeit baut der Bauplan um ihn herum ein. Jeder Agent im Katalog trägt eine davon.

L1

Assistiert

Informiert und antwortet. Führt keine Aktion aus und ändert keinen Datensatz. Die Arbeit macht der Mensch; der Agent macht sie nur schneller auffindbar und verständlicher.

Rolle des Menschen
Macht alles
L2

Entwirft

Erstellt ein Arbeitsergebnis (ein Dokument, eine Abfrage, einen Bericht, eine Ansprache) zur Prüfung und Freigabe durch einen Menschen. Nichts, was der Agent erstellt, wird verwendet, bevor eine Person es freigibt.

Rolle des Menschen
Prüft & gibt frei
L3

Operiert

Führt routinemäßige, risikoarme Aktionen in einem abgegrenzten Workflow aus, klassifizieren, weiterleiten, erledigen, protokollieren. Ausnahmen und alles Ungewöhnliche gehen an einen Menschen. Jede Aktion erhält einen Zeitstempel.

Rolle des Menschen
Übernimmt Ausnahmen
L4

Entscheidet (überwacht)

Unterstützt Entscheidungen und Kontrollen in Prozessen mit höherem Risiko, Compliance, Verträge, Sicherheit, Vier-Augen-Prinzip. Ein benannter Mensch bleibt für die Entscheidung verantwortlich; der Agent unterstützt und belegt sie. Gebaut für die Prüfung von Hochrisikoprozessen.

Rolle des Menschen
Bleibt verantwortlich
L5

Autonom

Handelt eigenständig innerhalb fester, vorab genehmigter Leitplanken. Der höchsten Klassifizierungsstufe vorbehalten, und heute von keinem Agenten in diesem Katalog genutzt.

Rolle des Menschen
Setzt die Leitplanken

// Dieser Katalog wird auf den Stufen L2-L4 ausgeliefert. L4-Agenten erfordern vor dem Go-live eine Freigabe durch die Leitung.

CAI Score × EU AI Act

Wie CAI-Stufen die Bewertung nach dem EU AI Act unterstützen.

Der AI Act klassifiziert Hochrisiko-Systeme anhand des vorgesehenen Verwendungszwecks und der Kriterien des Artikels 6, nicht anhand der CAI-Stufe. Bei Anwendungsfällen nach Anhang III kann der CAI Score die Governance- und Evidenzbewertung strukturieren, bestimmt jedoch nicht die rechtliche Einstufung.

CAI-Stufen strukturieren Governance-Kontrollen; rechtliche Rollen und Pflichten bestimmt der AI Act. Der Status als Anbieter oder Betreiber und die jeweiligen Pflichten hängen von der tatsächlichen rechtlichen Rolle und dem Nutzungskontext ab. Der CAI Score kann die Nachweisführung für diese Bewertung unterstützen, überträgt oder beseitigt aber keine gesetzlichen Pflichten.

L1

Minimales Risiko

Außerhalb von Anhang III bringt L1 keine Pflichten nach dem AI Act über geltendes Recht hinaus mit sich. Die Informationspflicht nach Artikel 50 (der Person mitteilen, dass sie mit KI interagiert) gilt nur bei kunden- oder öffentlichkeitsgerichteten Tools, nicht bei einem internen Recherche- oder Entwurfshelfer.

Maßgebliche Artikel
Art. 50, falls öffentlich zugänglich
L2

Kandidat für Art. 6 Abs. 3

Eine eng umgrenzte verfahrenstechnische Aufgabe oder ein System, das das Ergebnis einer bereits abgeschlossenen menschlichen Tätigkeit verbessert, kann einen Anhang-III-Workflow nach Artikel 6 Absatz 3 aus der Hochrisiko-Einstufung heraushalten — vorausgesetzt, die menschliche Freigabe ist eine echte Prüfung und die Bewertung wird vor Markteinführung dokumentiert (Artikel 6 Absatz 4). Gilt nicht, wenn der Workflow das Profiling einer natürlichen Person umfasst, etwa die Bewertung ihrer Kreditwürdigkeit, Leistung oder Eignung — das bleibt unabhängig vom Umfang der menschlichen Prüfung hochriskant.

Maßgebliche Artikel
Art. 6 Abs. 3 + Abs. 4
L3

Bereitstellung mit erhöhten Kontrollen

Ein L3-Agent, der in einem Kontext nach Anhang III eingesetzt wird, kann abhängig von seinem vorgesehenen Verwendungszweck und den Kriterien des Artikels 6 als Hochrisiko-System gelten. Ist das System hochriskant, können unter anderem Risikomanagement, Protokollierung und wirksame menschliche Aufsicht erforderlich sein.

Maßgebliche Artikel
Art. 9, 12, 14
L4

Bereitstellung mit höchsten Kontrollen

L4 ist für besonders sensible Bereitstellungen und die stärkste menschliche Aufsicht vorgesehen. Die L4-Stufe allein bestimmt nicht die rechtliche Einstufung nach dem AI Act. Ist das System nach dem AI Act hochriskant, gelten die einschlägigen Anforderungen entsprechend dem konkreten Anwendungsfall und der rechtlichen Rolle.

Maßgebliche Artikel
Art. 14, 43, Anhang IV
L5

Reserviert, ungenutzt

Nicht weil Artikel 5 es verbietet — unbegrenzte Autonomie steht nicht auf dieser Liste. Das Problem ist Artikel 14: Ein Hochrisiko-System, das niemand wirksam beaufsichtigen, überstimmen oder stoppen kann, ist nicht konform. Das ist der eigentliche Grund, warum diese Stufe im Katalog bis heute reserviert und ungenutzt bleibt.

Maßgebliche Artikel
Art. 14, nicht erfüllt

// Orientierende Zuordnung, keine Rechtsberatung. Die Einstufung hängt vom konkreten Workflow ab, nicht allein von der Stufe — den Anwendungsbereich von Anhang III und jede Berufung auf Artikel 6 Absatz 3, einschließlich der Profiling-Ausnahme, vor dem Go-live stets mit Rechtsberatung abstimmen.

Bereitstellung & Sicherheit

Ihre Umgebung. Ihre Daten. Unsere Governance.

Agenten laufen dort, wo Ihre Geschäftsdaten bereits liegen. ColleagueAI hält Governance-Metadaten, Scoring, Audit-Nachweise und Token-Ökonomie-Indikatoren darum herum.

// architektur
Beim Kunden gehostet, von Grund auf

Agenten laufen in Ihrer Microsoft Copilot Studio-, Power Automate- und Azure-Umgebung. Geschäftsinhalte des Kunden verbleiben in der kundengesteuerten Microsoft-Umgebung. ColleagueAI verarbeitet separate Metadaten der Governance-Schicht wie im Trust Center beschrieben.

// verantwortung
Es ist immer ein Mensch benannt

Die CAI-Stufe legt genau fest, wo ein Mensch verantwortlich bleibt. L4-Agenten entscheiden nie allein, sie unterstützen, belegen und übergeben die Entscheidung an einen benannten Menschen. Aufsicht ist kein Schalter, den man ausschalten kann; sie ist in die Stufe eingebaut.

// audit
Nachweise von Haus aus

Jede Agentenaktion wird protokolliert, mit einem Zeitstempel versehen und ist zuordenbar. Wenn ein Prüfer oder Regulierer fragt, was passiert ist und wer es genehmigt hat, ist die Antwort bereits ein Datensatz, nicht etwas, das Sie im Nachhinein zusammensetzen müssen.

// regulierung
Für regulierte KI-Programme konzipiert

Risikoklassifizierung, menschliche Aufsicht, Protokollierung und Transparenz sind Kernelemente des CAI Score. Das Framework ist darauf ausgelegt, Nachweisarbeit für den EU AI Act, DORA und ISO/IEC 42001 zu unterstützen, vorbehaltlich der Implementierung durch den Kunden und rechtlicher Prüfung.

Plattform- & Integrationsschicht

Die Konnektoren, auf denen die Agenten laufen.

Microsoft Copilot Studio Power Automate · AI Builder Azure DevOps GitHub JIRA Confluence Power BI ServiceNow ticket integration Teams app (Dev · Sandbox · Prod) API tools & connectors
Schneller Check · nichts verlässt Ihren Browser

Wie auditfähig ist Ihre KI wirklich?

Sechs Fragen. Ermitteln Sie den Reifegrad der KI-Governance Ihrer Organisation, und die konkreten Lücken, die Sie schließen sollten, bevor ein Prüfer oder Regulierer fragt. Auf derselben CAI-Methodik aufgebaut, mit der wir Agenten klassifizieren.

Orientierende Selbsteinschätzung. Ihre Antworten bleiben in Ihrem Browser, es wird nichts gesendet oder gespeichert.

Fragen und Antworten

Was Käufer und KI-Assistenten über Colleague AI fragen.

Direkte Antworten zum CAI Score, zur Bereitstellung, zur Ausrichtung am EU AI Act und dazu, wie sich der Trust-Layer von einer Agent-Management-Plattform unterscheidet.

Was ist Colleague AI?

Colleague AI ist die Vertrauensschicht für Enterprise-KI. Sie klassifiziert KI-Agenten nach dem CAI Score, einer fünfstufigen Risikoklassifizierung (L1-L5), dokumentiert die Kontrollen jedes Agenten und erzeugt einen Audit-Trail. Agenten laufen in Ihrer eigenen Umgebung; Colleague AI hostet nur die Governance-Steuerungsebene, sodass Unternehmen KI einsetzen können, die sie verteidigen können.

Was ist der CAI Score?

Der CAI Score ist ein Klassifizierungsrahmen für KI-Agenten, beschrieben als „das FICO der KI“. Er klassifiziert jeden Agenten nach Risiko auf einer fünfstufigen Skala, von L1 (Assistiert) bis L5 (Autonom), und legt genau fest, wie viel der Agent selbst tut und wo ein benannter Mensch verantwortlich bleibt, und belegt es dann für das Audit.

Was sind die CAI-Score-Risikostufen, L1 bis L5?

L1 Assistiert: informiert nur, handelt nicht. L2 Entwirft: erstellt Arbeit zur Freigabe durch einen Menschen. L3 Operiert: routinemäßige Aktionen in einem abgegrenzten Workflow. L4 Entscheidet (überwacht): unterstützt hochriskante Entscheidungen mit einem benannten verantwortlichen Menschen. L5 Autonom: handelt innerhalb fester, vorab genehmigter Leitplanken. Je höher die Stufe, desto mehr Aufsicht und Protokollierung verlangt der Rahmen.

Wo laufen die Colleague-AI-Agenten und sind meine Daten sicher?

Agenten laufen in Ihrer Microsoft Copilot Studio-, Power Automate- und Azure-Umgebung. Geschäftsinhalte des Kunden verbleiben in der kundengesteuerten Microsoft-Umgebung. ColleagueAI verarbeitet separate Metadaten der Governance-Schicht wie im Trust Center beschrieben.

Hilft Colleague AI bei der Compliance mit dem EU AI Act?

Ja. Der CAI Score ist auf Risikoklassifizierung, menschliche Aufsicht, Protokollierung und Transparenz ausgerichtet. Er unterstützt die Compliance-Arbeit, ersetzt jedoch keine rechtliche, Risiko- oder regulatorische Bewertung.

Wie unterscheidet sich Colleague AI von einer Plattform zur Verwaltung von KI-Agenten oder anderen Anbietern von KI-Governance?

Die meisten Plattformen beobachten und orchestrieren Agenten oder auditieren Modelle nachträglich. ColleagueAI ergänzt die fehlende Schicht: einen portablen CAI Score, gesteuerte Agenten-Pakete, Token-Ökonomie-Monitoring und Governance-Nachweise. So lassen sich Agenten praktisch steuern, messen, optimieren und skalieren, nicht nur in einem weiteren Dashboard.

Was ist Agenten-Wildwuchs und wie hilft die Klassifizierung?

Agent Sprawl entsteht, wenn sich KI-Agenten im Unternehmen schneller verbreiten, als jemand sie verfolgen kann, verschiedene Anbieter, Frameworks und Clouds, jeder mit eigenem Risikoprofil und ohne gemeinsame Prüfspur. Jedem Agenten eine CAI Score-Klassifizierung zu geben bedeutet, dass jeder einen bekannten Tier und einen Nachweis-Datensatz hat, sodass Sie immer wissen, was läuft und wer dafür verantwortlich ist.

Wie viele KI-Agenten bietet Colleague AI und in welchen Bereichen?

Der Katalog umfasst 36 überwachte KI-Agenten-Pakete über fünf funktionale Säulen: Betrieb & Service, Risiko, Sicherheit & Compliance, Daten & Infrastruktur, Vertrieb & Marketing und Unternehmen (HR, Recht, Einkauf, Reporting). Sie laufen auf den CAI-Stufen L2 bis L4, wobei L4-Agenten vor dem Go-live eine Freigabe durch die Leitung erfordern.

CAI-Score-Leitfaden

Verstehen Sie die Implementierungskomplexität vor der Demo.

Der CAI Score ist eine praktische Schätzung der Implementierungs- und Governance-Komplexität. Es ist keine Bewertung der Rechtskonformität und ersetzt keine kundenspezifische Risikobewertung.

Geringe KomplexitätKlare Eingaben, enger Workflow, geringes Betriebsrisiko, einfacher Prüfweg.
Mittlere KomplexitätMehrere Systeme, strukturierte Genehmigungen, definierte Ausnahmebehandlung, höhere Audit-Anforderungen.
Hohe KomplexitätRegulierte Prozesse, sensible Daten, funktionsübergreifende Verantwortung, stärkere menschliche Aufsicht.
KundenabhängigDas endgültige Risiko hängt vom Anwendungsfall, Datenzugriff, der Gerichtsbarkeit, dem Integrationsdesign und den internen Kontrollen ab.
Klartext: Der CAI Score hilft Käufern, den Liefer- und Governance-Aufwand zu verstehen, bevor sie Zeit, Datenzugriff oder Budget einsetzen.

Möchten Sie sehen, welche Agenten in Ihren Prozess passen?

Läuft in Ihrem Mandanten Kundengesteuerte Geschäftsdatenebene Auf EU AI Act abgebildet · DORA- und ISO/IEC-42001-Mapping in Arbeit Auditfähig von Grund auf

Enterprise-KI-Einblicke

Entdecken Sie praxisnahe Leitfäden zu KI-Agent-Governance, menschlicher Aufsicht und Enterprise-KI-Agenten in Microsoft-Umgebungen.