Auch ein kleines Team, oft sogar ein einzelner Entwickler, kann einen KI-Agenten in ein SaaS-Produkt integrieren, wenn für den Produktivbetrieb eine vorhandene Runtime genutzt wird. Das KI-Modell selbst verursacht dabei selten den größten Aufwand. Meist braucht es ein Team für die Betriebsinfrastruktur; eine Runtime kann diese Aufgaben übernehmen. Dieser Leitfaden beschreibt den Ablauf Schritt für Schritt.
Dieser Leitfaden ergänzt den ausführlicheren Artikel über das Einbinden von KI-Agenten in ein SaaS-Produkt. Der ausführlichere Artikel erklärt die Gründe; hier folgt die Umsetzung.
Warum der Produktivbetrieb kleine Teams ausbremst
Ein Prototyp entsteht an einem Nachmittag. Der Weg in den Produktivbetrieb dauert oft Monate, obwohl das KI-Modell selten die Ursache ist. Erforderlich ist Betriebsinfrastruktur, die Events empfängt, fehlgeschlagene Aufrufe wiederholt, Runs voneinander isoliert, Secrets verwaltet, Deployments ausführt und die Aktionen des Agenten nachvollziehbar macht. Diese Infrastrukturarbeit macht aus einem Prototyp ein Produkt. Einem Zwei-Personen-Team fehlt meist die Zeit, sie aufzubauen und zu warten.
Entwickle deinen Agenten und seine Tools, binde bestehende Systeme an und veröffentliche ihn über Git. Der Quickstart führt dich durch den gesamten Ablauf.
Quickstart öffnenWeiterführende Quellen: einen KI-Agenten in ein SaaS-Produkt integrieren, Einbinden von KI-Agenten in ein SaaS-Produkt.
Eine Runtime statt eines eigenen Plattformteams
Ein kleines Team kann eine vorhandene Runtime nutzen, anstatt eine eigene Plattform aufzubauen. Das Team entwickelt die produktspezifischen Teile, also Agent und Tools. Die Runtime übernimmt Deployment, Skalierung, Verbindungen und Observability. Dadurch kann ein Entwickler die Aufgabe übernehmen, für die andernfalls ein Plattformteam erforderlich wäre.
In fünf Schritten zum ersten Agenten
1. Eine konkrete Aufgabe auswählen
Ein allgemeiner Assistent ist für den Einstieg zu breit. Sinnvoller ist eine klar begrenzte Aufgabe mit eindeutigem Input und Output: eingehende Support-Tickets priorisieren, eine Kundenrechnung zusammenfassen oder einen neuen Lead anreichern. Durch den klaren Umfang kann der erste Agent innerhalb weniger Tage live gehen und lässt sich anschließend leicht bewerten.
2. Den Agenten per Konfiguration definieren und Tools in Python schreiben
Der Agent wird in der Konfiguration beschrieben, seine Tools werden als normale Funktionen implementiert. Dafür sind weder ein neues Framework noch eine eigene Orchestrierungsschicht nötig. Jeder Entwickler mit Python-Kenntnissen kann das gesamte Projekt lesen und ändern. Das ist wichtig, wenn das Team klein ist und niemand auf ML spezialisiert ist.
3. Mit den bestehenden Workflows verbinden
Der Agent muss durch ein reales Ereignis ausgelöst werden: eine eingehende E-Mail, einen Webhook, eine neue Datenbankzeile oder eine Nachricht in einer Queue. Vorgefertigte Verbindungen ersparen die Entwicklung und Wartung dieser Infrastruktur. Bei einer Eigenentwicklung verbraucht gerade dieser Schritt unbemerkt den größten Teil der Engineering-Zeit.
4. Vor dem Produktivstart Observability und Approvals ergänzen
Bevor der Agent mit Kundendaten arbeitet, muss das Team seine Aktionen nachvollziehen und kritische Aktionen stoppen können. Traces pro Schritt und Kostenerfassung helfen, fehlerhafte Ausführungen zu untersuchen. Alle Aktionen, die Geld ausgeben oder Daten verändern, sollten durch Human-in-the-Loop-Freigaben abgesichert werden. Für ein kleines Team begrenzen diese Kontrollen das Risiko beim Produktivstart.
5. Über Git veröffentlichen und weiterentwickeln
Die Bereitstellung per Git-Push im bestehenden Workflow des Teams hält jede Änderung versioniert und reversibel. Sobald der Agent live ist, lassen sich Prompt oder KI-Modell mit A/B-Tests anhand von Messwerten verbessern. So entstehen ein Agent für den Produktivbetrieb und ein Prozess zu seiner kontinuierlichen Verbesserung. Eine eigene Plattform muss das Team dafür nicht betreuen.
Welche Infrastruktur ein kleines Team nicht selbst bauen muss
Eine Runtime übernimmt die folgenden Aufgaben:
Wann ein Projekt mehr als ein kleines Team braucht
Manche Aufgaben sind tatsächlich größer. Teams, die eigene KI-Modelle trainieren oder Fine-Tuning betreiben, täglich Millionen Runs mit strikten Latenzzielen verarbeiten oder Agent-Infrastruktur als Kernprodukt entwickeln, brauchen Spezialisten. Im häufigeren Fall ist ein Agent jedoch ein Feature innerhalb eines SaaS-Produkts und nicht das ganze Unternehmen. Dann bringen ein kleines Team und eine Runtime den Agenten bis in den Produktivbetrieb, ohne dafür zusätzliche Stellen schaffen zu müssen.