Produkt-Abo · Betrieb von KI-Agenten

Ihr Agent läuft.
Antwortet er auch noch richtig?

Ein Workflow bricht ab, wenn etwas schiefgeht. Ein KI-Agent antwortet einfach weiter — auch wenn ein Fallback gegriffen, ein Modell sich geändert oder ein Prompt seine Wirkung verloren hat. Agent-Betrieb überwacht deshalb nicht nur, ob er läuft, sondern prüft monatlich, ob er noch das Richtige tut.

Warum Monitoring allein nicht reicht

Ein Agent bricht nicht ab. Er driftet.

Genau das ist mir im eigenen KI-Sichtbarkeits-Monitor passiert: Ein Rate-Limit (HTTP 429) löste einen Fallback aus, der still das Google-Search-Grounding entfernte. Das Modell antwortete weiter — flüssig, plausibel und frei erfunden, ohne eine einzige Quelle. Die Antworten wurden korrekt als „nicht zitiert" gespeichert, die Messwerte sanken systematisch. Nirgends stand ein Fehler. Aufgefallen ist es durch eine Stichprobe, nicht durch das Monitoring. Deshalb ist der monatliche Testfall-Durchlauf hier der eigentliche Wert — nicht die grüne Statusampel.
Alexander OhlAlexander OhlGründer · Pragma-Code
Bausteine · 04

Vier Bausteine im Betrieb.

Was laufend passiert, damit ein Agent verlässlich bleibt.

Verfügbarkeit & Fehler

Erreichbarkeit, Fehlerraten und abgebrochene Läufe werden laufend überwacht. Fällt der Agent aus, melde ich mich bei Ihnen — Sie sollen es nicht von Ihren Kunden erfahren.

Monatliche Qualitätsstichprobe

Ein fester Testfall-Satz läuft jeden Monat gegen den produktiven Agenten. Er findet genau das, was kein Fehlerlog zeigt: überzeugend formulierte, falsche Antworten. Ab der Stufe „Betrieb".

Modelle & Abkündigungen

Anbieter kündigen Modelle ab und ändern das Antwortverhalten zwischen Versionen. Ich verfolge die Ankündigungen und migriere rechtzeitig, statt am Abschalttag. Ab „Betrieb" ist die Migration im Stundenrahmen enthalten.

Kostenwache

Token- und API-Kosten laufen gegen einen vorab vereinbarten Deckel. Zeichnet sich ab, dass er gerissen wird, bekommen Sie vorher eine Meldung — nicht erst auf der Rechnung.

Stufen · 03

Drei Stufen — monatlich kündbar.

Unabhängig von den Umsetzungstarifen buchbar, auch für Agenten, die jemand anderes gebaut hat. Keine Mindestlaufzeit.

"Wache"
Überwachung
390 € / Monat
monatlich kündbar

Merken, wenn etwas ausfällt oder teuer wird.

Was enthalten ist
1 Agent · bis 2 h Umsetzung / Monat
Verfügbarkeits- und Fehler-Monitoring
Modell-Abkündigungen im Blick
Kostenwache gegen den vereinbarten Deckel
Reaktion bei Ausfall: 48 h werktags
Monatsreport
Migration auf ein Nachfolgemodell: als Angebot, nicht inklusive
Anfragen
"Betrieb & Nachweis"
Qualität + Dokumentation
1.190 € / Monat
monatlich kündbar

Für Einsätze, bei denen jemand die Aufsicht belegt sehen will.

Was enthalten ist
Alles aus „Betrieb"
Bis 4 Agenten · bis 8 h Umsetzung / Monat
AI-Act-relevante Dokumentation: Protokollierung und menschliche Aufsicht
Transparenzhinweise und dokumentierter Modell- und Versionsstand
Quartals-Review-Call
Anfragen
Umfang · gilt auf allen Stufen

Was drin ist — und was nicht.

Was als ein Agent zählt

Ein sprachmodellgestützter Anwendungsfall, ein Kanal. Ein WhatsApp-Assistent für den Support und eine automatisierte Belegverarbeitung sind zwei Agenten — auch wenn beide dasselbe Modell nutzen. Derselbe Anwendungsfall zusätzlich auf Telegram ist ein weiterer Kanal und damit ein weiterer Agent.

Nicht enthalten

  • Token- und API-Kosten der Modellanbieter — werden durchgereicht, mit vorab vereinbartem Deckel und Meldung, bevor er gerissen wird
  • Neue Agenten bauen (dafür gibt es Festpreis-Angebote)
  • Rufbereitschaft ausserhalb der Werktage
  • Änderungen am Geschäftsprozess selbst
Ablauf · 04 Schritte

Von der Übernahme zum Monatsreport.

Auch dann, wenn den Agenten jemand anderes gebaut hat.

01Auch für fremde Agenten

Übernahme

Wir gehen den bestehenden Agenten durch: Kanäle, Modelle, Schnittstellen, Kostenrahmen — und wo im Prozess er überhaupt entscheidet.

02

Testfälle festlegen

Gemeinsam schreiben wir auf, was eine richtige Antwort ist — mit erwartetem Ergebnis je Fall. Dieser Satz ist ab dann der Maßstab, gegen den jeden Monat gemessen wird.

03

Laufender Betrieb

Monitoring läuft, der Kostendeckel steht, Modell-Ankündigungen werden verfolgt. Bei einem Ausfall reagiere ich innerhalb der vereinbarten Frist an Werktagen.

04

Monatsreport

Was lief, was auffiel, was nachjustiert wurde — ab „Betrieb" mit dem Ergebnis der Qualitätsstichprobe, ab „Betrieb & Nachweis" mit dokumentiertem Modell- und Versionsstand.

FAQ · 06

Häufige Fragen.

Umfang, Grenzen und was ausdrücklich nicht zugesagt wird.

Was zählt als „ein Agent"?
Ein sprachmodellgestützter Anwendungsfall in einem Kanal. Ein WhatsApp-Assistent für den Kundensupport und eine automatisierte Belegverarbeitung sind zwei Agenten, auch wenn beide dasselbe Modell nutzen. Derselbe Anwendungsfall zusätzlich auf Telegram ist ein weiterer Kanal — und damit ein weiterer Agent. Diese Zählweise steht hier, damit im Betrieb niemand rätselt, was noch im Preis enthalten ist.
Gibt es eine SLA oder 24/7-Rufbereitschaft?
Nein — und das steht hier bewusst so. Die Reaktionszeiten (48 h in „Wache", 24 h ab „Betrieb") gelten an Werktagen. Es gibt keine Rufbereitschaft am Wochenende und keine Uptime-Garantie. Pragma Code ist ein Ein-Personen-Unternehmen mit Partnernetzwerk; eine 24/7-Zusage könnte ich nicht halten, also gebe ich sie nicht. Nicht zu verwechseln mit dem Agenten selbst: Ein WhatsApp- oder Telegram-Assistent antwortet Ihren Kunden natürlich rund um die Uhr. Das ist der Bot, nicht der Betreuer.
Sind Token- und API-Kosten enthalten?
Nein. Die Kosten der Modellanbieter werden unverändert durchgereicht und laufen gegen einen vorab vereinbarten Deckel. Zeichnet sich ab, dass der Deckel gerissen wird, bekommen Sie eine Meldung, bevor es passiert. Ebenfalls nicht enthalten: neue Agenten bauen, Rufbereitschaft ausserhalb der Werktage und Änderungen am Geschäftsprozess selbst — dafür gibt es Festpreis-Angebote.
Macht Stufe 3 unser Unternehmen AI-Act-konform?
Nein, und wer das verspricht, verspricht zu viel. „Betrieb & Nachweis" liefert die Arbeitsgrundlage: Protokollierung, dokumentierte menschliche Aufsicht, Transparenzhinweise und einen nachvollziehbaren Modell- und Versionsstand. Ob Ihr Einsatz insgesamt konform ist, hängt vom Anwendungsfall, Ihrer Risikoeinstufung und Ihren eigenen Prozessen ab und wird im Zweifel von Ihrer Rechtsberatung beurteilt. Ich liefere die Dokumentation und die laufende Aufsicht — nicht die Zusicherung.
Betreuen Sie auch Agenten, die jemand anderes gebaut hat?
Ja. Voraussetzung ist Zugang zu Konfiguration, Prompts, Logs und den genutzten Modell-Endpunkten. In der Übernahme schaue ich mir den Stand an und sage offen, ob der Agent so betreibbar ist oder vorher etwas geradegezogen werden muss. Wenn es Letzteres ist, bekommen Sie dafür ein eigenes Festpreis-Angebot, bevor das Abo startet.
Was unterscheidet das vom Umsetzungstarif „Automatisierung"?
Der Umsetzungstarif „Automatisierung" (590 €/Monat, 6 Mt. Laufzeit) betreut regelbasierte Workflows in n8n, Make oder Zapier. Die sind deterministisch: Sie laufen durch oder brechen mit einem Fehler ab, und das Fehlerlog sagt, was los war. Sprachmodellgestützte Agenten brechen nicht ab — sie antworten weiter, auch falsch. Deshalb ist Agent-Betrieb eine eigene Produktlinie mit Testfall-Satz und Modell-Beobachtung, monatlich kündbar und unabhängig von den Umsetzungstarifen buchbar. Beides lässt sich kombinieren, wenn Sie Workflows und Agenten im Einsatz haben.
Unverbindlich & ohne Verkaufsdruck

Läuft Ihr Agent — oder rät er nur gut?

Im kostenlosen Erstgespräch gehen wir Ihren Agenten durch: wo er heute steht, was ein Testfall-Satz dafür abdecken müsste und welche Stufe passt.

Alexander Ohl

Alexander Ohl

Pragma-Code Support (AI)• Online

Hallo! Ich bin der Pragma-Code Assistent. Wie kann ich Ihnen heute helfen? Sie können mich zu unseren Dienstleistungen befragen oder direkt ein Thema auswählen.