Praxisfeld · Agentische KI

Agentische KI mit klaren Berechtigungen und Review.

Agenten, die Werkzeuge nutzen, Systeme ändern oder mit Kunden sprechen, brauchen mehr als gutes Prompting. Wir bauen Architektur, Kontrollpunkte und Nachweise für den Produktionseinsatz.

AgentenarchitekturLeitplankenEvaluierungKI-VerordnungAudit-TrailsHuman-in-the-Loop

Bewertungsmaßstäbe

KI-VerordnungVO (EU) 2024/1689
DatenschutzDSGVO · Ges. 18/2018 Slg.
Daten & PlattformenData Act · DSA
HaftungEU-Produkthaftung
SicherheitISO/IEC 27001 · NIS 2
SektoralJe nach Ihrem Markt

Das Problem mit Agenten

Autonome Systeme erzeugen Betriebsrisiko.

Ein generatives Modell kann eine falsche Antwort erzeugen. Ein Agent kann auf dieser Antwort handeln: eine Rückerstattung auslösen, einen Datensatz löschen, ein Dokument offenlegen oder einen Workflow-Schritt ausführen. Deshalb gehören Berechtigungen, Freigaben und Rückwege zum Kerndesign.

Die Entwicklungsarbeit geht deshalb über Prompts hinaus. Sie umfasst Berechtigungsgrenzen, Reversibilität, Eskalation, Protokollierung und die spätere Rekonstruktion dessen, was das System getan hat und warum.

  • Was darf dieser Agent tun, und woher stammt diese Berechtigung?
  • Welche Handlungen sind umkehrbar, und welche brauchen vorher einen Menschen?
  • Wie würden Sie eine konkrete Entscheidung ein halbes Jahr später rekonstruieren — für eine Behörde oder ein Gericht?
  • Was passiert, wenn ein Werkzeugaufruf fehlschlägt oder etwas Feindseliges zurückgibt?
  • Welche Ihrer KI-Systeme sind nach der KI-Verordnung hochriskant — und können Sie Ihre Begründung zeigen?
  • Wer haftet, wenn ein autonomes System einem Dritten Schaden zufügt?

Was wir bauen

Agentensysteme, von Anfang bis Ende.

01

Agentenarchitektur

Einzel- und Multi-Agenten-Entwürfe: Aufgabenzerlegung, Delegation zwischen Agenten, Werkzeug- und API-Oberflächen, Gedächtnis und Zustand, Retrieval und die Orchestrierungsschicht, die entscheidet, was in welcher Reihenfolge läuft.

02

Leitplanken & Berechtigungen

Eng gefasste Fähigkeitsfreigaben, Werkzeugzugriff nach dem Least-Privilege-Prinzip, Eingangs- und Ausgangsfilterung, Ausgabe- und Ratenlimits, Begrenzung des Schadensradius und deterministische Prüfungen rund um nicht-deterministische Komponenten.

03

Human-in-the-Loop

Eskalationsmodelle, die festlegen, wann ein Mensch erforderlich ist; Freigabeoberflächen, die Prüfung realistisch statt symbolisch machen; und definiertes Verhalten, wenn niemand reagiert.

04

Audit-Trails

Strukturierte, manipulationssichere Protokollierung von Prompts, Werkzeugaufrufen, Entscheidungen und Ergebnissen — ausgelegt auf die Aufzeichnungspflichten der KI-Verordnung und darauf, im Ernstfall tatsächlich zu helfen.

05

Evaluierung & Red Teaming

Verhaltensbezogene Testsuiten, Regressionsevaluierung über Modellversionen hinweg, adversariale Tests einschließlich Prompt Injection über Werkzeugausgaben und Robustheitstests unter beeinträchtigten oder feindlichen Bedingungen.

06

Produktivbetrieb

Monitoring, Drift- und Kostentransparenz, Incident-Response-Verfahren, die für autonome Systeme geschrieben sind, und ein Rollback-Pfad, der auch dann funktioniert, wenn die fehlerhafte Komponente ein Modell ist.

Compliance

KI-Verordnung für Systeme, die handeln.

Wir bewerten Ihre Systeme, klassifizieren sie und erstellen die Dokumentation für diese Einstufung. Die rechtliche Arbeit bleibt mit dem technischen Design verbunden, weil die Kontrollen vom tatsächlichen Verhalten des Systems abhängen.

Bewertung & Einordnung

Bestandsaufnahme Ihrer KI-Systeme, Einordnung in die Risikoklassen der KI-Verordnung, Bestimmung Ihrer Rolle als Anbieter oder Betreiber sowie eine Gap-Analyse gegen die daraus folgenden Pflichten. Wo die Antwort unsicher ist, dokumentieren wir die Überlegung und die zugrunde liegenden Annahmen.

Dokumentation & Governance

Technische Dokumentation, Risiko- und Folgenabschätzungen, Transparenzhinweise, Protokollierung und Maßnahmen zur menschlichen Aufsicht, Daten-Governance-Nachweise, KI-Governance-Rahmenwerke und interne Richtlinien sowie Begleitung durch Konformitätsbewertung und behördliche Anfragen.

Unser Vorgehen

Fünf Stufen mit konkreten Ergebnissen.

  1. Discovery

    Was der Agent tun soll, was er anfassen darf und was das schlimmste realistische Ergebnis wäre. Ergebnis: ein abgegrenztes Designbriefing und eine erste Risikosicht.

  2. Einordnung

    Wo das System nach KI-Verordnung und angrenzendem Recht steht und welche Pflichten daran hängen. Ergebnis: eine schriftliche Einordnung mit Begründung und Annahmen.

  3. Entwurf & Umsetzung

    Architektur, Leitplanken, Berechtigungsmodell, Protokollierung und Oberflächen werden gemeinsam entwickelt. Ergebnis: ein laufendes System und sein Kontrolldesign.

  4. Evaluierung

    Verhaltensbezogene, adversariale und Regressionstests gegen definierte Kriterien. Ergebnis: ein Evaluierungsbericht, den Sie einem Sicherheitsprüfer vorlegen können.

  5. Betrieb

    Monitoring, Verfahren für Vorfälle und wiederkehrende Neubewertung, wenn sich Modelle und Umfang ändern. Ergebnis: ein System, das nach dem Launch konform bleibt.

Was Sie erhalten

Ergebnisse, die Sie weiterverwenden können.

Die Rechte an allem, was speziell für Sie entsteht, gehen ab Entstehung auf Sie über und werden mit Zahlung wirksam. Soweit unser eigenes vorbestehendes Werkzeug in ein Ergebnis eingebettet ist, erhalten Sie eine unbefristete, unwiderrufliche, weltweite Lizenz zur Nutzung, Änderung und Pflege. Fremd- und Open-Source-Komponenten werden vor Arbeitsbeginn im Leistungsschein benannt.

  • Dokumentation der Agentenarchitektur und des Kontrolldesigns
  • Einordnungsmemorandum zur KI-Verordnung mit ausformulierter Begründung
  • Risikobewertung und, wo erforderlich, Folgenabschätzung
  • Paket technischer Dokumentation und Transparenzhinweise
  • Evaluierungs- und Red-Team-Bericht mit reproduzierbaren Testsuiten
  • Spezifikation für Protokollierung und Audit-Trail, umgesetzt
  • KI-Governance-Rahmenwerk und interne Richtlinien
  • Verfahren für Incident Response und Monitoring autonomer Systeme

Ein Agent für den Produktionsreview?

Senden Sie uns den Prototyp, den geplanten Workflow und den Einwand, der den Release blockiert. Wir helfen, die nötigen Kontrollen zu definieren.