Modell-Konstellation: die Architektur hinter Sierras Agenten
„Welches große Sprachmodell nutzt Sierra?“ ist eine der häufigsten Fragen von Unternehmen, die ihr Kundenerlebnis mit KI verbessern möchten. Doch wie bei LEGO-Sets lässt sich ein großartiger Agent nicht mit nur einer Art von Bausteinen bauen. Deshalb setzen sich auf Basis von Sierra entwickelte Agenten je nach Aufgabe aus mehr als 15 führenden, Open-Weight- und proprietären Modellen zusammen.
Das Ergebnis: vielseitige Agenten, die schnell, effektiv und markenkonform arbeiten – ganz gleich, was sie tun – ohne dass Sie die Modelle von Hand auswählen oder ihre Verknüpfung im Detail steuern müssen.
Das passende Modell für die Aufgabe auswählen
Ein KI-Agent stellt eine hochentwickelte Software dar, die Schlussfolgerungen ziehen und handeln kann – etwa ein bestimmtes Produkt oder eine Dienstleistung empfehlen, einen Anrufer authentifizieren, eine Rücksendung bearbeiten, ein technisches Problem beheben oder einen Abonnenten halten, der kündigen möchte.
Unterschiedliche Aufgaben stellen ganz unterschiedliche Anforderungen an einen Agenten. Einige erfordern beispielsweise:
- Tool-Aufrufe und Entscheidungsfindung mit niedriger Latenz – bei einfacheren Aufgaben wie Auftragsverwaltung, Bestandsabfragen oder Produktsuchen sind die Anweisungen meist unkomplizierter und die von uns ausgewählten Modelle erfüllen die strengeren Latenzanforderungen für natürlich klingende Sprachdialoge.
- Hochpräzise Klassifizierung – bestimmte Aufgaben erfordern eine differenzierte und äußerst konsistente Einordnung von Verhaltensweisen, etwa zur Identifizierung verdächtigen Nutzerverhaltens.
- Schlussfolgern bei umfangreichem Kontext – wenn der Agent große Informationsmengen lesen, verarbeiten und im Gedächtnis behalten muss – etwa komplexe Richtlinien oder technische Informationen – und dazu Anweisungen sorgfältig befolgen muss, ohne Informationen zu übersehen oder zu erfinden.
- Der richtige Ton – damit der Agent insbesondere in schwierigen oder sensiblen Momenten empathisch, natürlich und markengerecht klingt.
Kein einzelnes Modell erfüllt die spezifischen Anforderungen jeder Aufgabe. Modelle, die beim Schlussfolgern überzeugen, lassen oft deutlich nach, wenn sie zu schnelleren Antworten gezwungen werden. Ebenso können Modelle, die menschenähnliche Antworten besonders gut erzeugen, bei zu umfangreichem Kontext Schwierigkeiten haben. Ein Modell für alles einzusetzen, erzwingt unnatürliche Kompromisse zwischen Geschwindigkeit, Genauigkeit und Tonalität, die letztlich zu Agenten geringerer Qualität führen.
Sierra begegnet diesen Herausforderungen, indem das Verhalten von Agenten in Aufgaben zerlegt und für jede Aufgabe das am besten geeignete Modell ausgewählt wird. Dazu gehören aufgabenspezifische Evaluierungen, das Erkennen von Fähigkeitslücken, bei denen aktuelle Modelle an ihre Grenzen stoßen, sowie Investitionen in feinabgestimmte Modelle, wenn Standardmodelle unsere Anforderungen nicht erfüllen.
Entwickelt für eine sich wandelnde Technologie
Sierras Agent OS basiert auf modularen Aufgabenabstraktionen, die Verantwortlichkeiten voneinander trennen, während die Plattform Orchestrierung und Routing im Hintergrund automatisch übernimmt. Statt monolithische Agenten zu schreiben, werden sie aus klar getrennten Fähigkeiten zusammengesetzt – Abruf, Klassifizierung, Tools, Richtlinien und Tonalität. Bestimmte Aufgaben erhalten mehr „Handlungsautonomie“ und damit mehr Spielraum, um zu schlussfolgern, zu reflektieren und Tools einzusetzen. Dieses Maß an Handlungsautonomie wird durch den Einsatz von Supervisoren ermöglicht, die Schutzschranken, Richtlinien und Qualitätsprüfungen durchsetzen.
Ein wesentlicher Vorteil dieses Systems besteht darin, dass mit Sierra entwickelte Agenten automatisch besser werden, wenn sich führende Modelle weiterentwickeln. Aufgaben mit einem höheren Maß an Eigenständigkeit profitieren stark von verbessertem Schlussfolgern, Tool-Aufrufen und Befolgen von Anweisungen. Die meisten Agenten verbessern sich im Laufe der Zeit schon durch kleine Anpassungen des Prompts. Mit der Weiterentwicklung der Modelle werden einige Aufgaben ganz natürlich überflüssig, während neue an ihre Stelle treten.
Die Gestaltung von Prompts unterscheidet sich je nach Modellfamilie. Sierras modulare Architektur erleichtert es, als wertvoll eingestufte Aufgaben mit geringem Risiko zu aktualisieren, ohne Änderungen an sensiblen Schutzschranken zu erzwingen. So können Sie neue Modelle schneller und sicherer einsetzen und von Fortschritten profitieren, ohne die übrigen Risiken einzugehen.
Zuverlässigkeit und Verfügbarkeit
Sierra bietet integrierte Redundanz über verschiedene Modellanbieter hinweg für geschäftskritische Aufgaben. Wir überwachen kontinuierlich den Zustand und die Leistung der Modelle – einschließlich Latenz, Fehlerraten und Timeouts. Wenn die Leistung eines Anbieters nachlässt, schaltet unser automatisiertes Routing nahtlos auf leistungsfähigere, gleichwertige Modelle um, damit Ihre Agenten reibungslos weiterlaufen.
Das Ergebnis ist eine robuste Inferenzschicht, die auch dann zuverlässig funktioniert, wenn ein einzelnes Modell oder ein Anbieter ausfällt, und für die anspruchsvollsten Agenten die richtige Balance zwischen Geschwindigkeit, Genauigkeit und Qualität bietet.
Sie definieren den Agenten, Sierra setzt ihn um
Mit Sierra definieren Sie, wie Ihr Agent agieren soll – seine Richtlinien, Tools, Schutzschranken, sein Wissen sowie Ihre Marke und Tonalität. Wir übersetzen dies in einen produktionsreifen Agenten aus kombinierbaren Aufgaben, unterstützt durch Supervisoren und angetrieben von einer Modell-Konstellation, die kontinuierlich für Ihren Anwendungsfall optimiert wird. Das Ergebnis ist ein zuverlässiger, erstklassiger Agent – und die Gewissheit, dass Ihre Agenten mit der Weiterentwicklung der Modelle ebenfalls besser werden.
Das ist das Versprechen von Sierras Ansatz: ein System, das modular genug ist, um Fortschritte schnell zu übernehmen, diszipliniert genug, um die Qualität zu sichern, und pragmatisch genug, um den Zuverlässigkeitsanforderungen in der Praxis gerecht zu werden. Sie definieren, was exzellent bedeutet – und wir sorgen dafür, dass die richtigen Komponenten perfekt zusammenspielen, um dies zu erreichen.


