Constellation de modèles : l’Architecture qui alimente vos agents Sierra
« Quel grand modèle de langage (LLM) Sierra utilise-t-elle ? » C’est l’une des questions que les entreprises nous posent le plus souvent lorsqu’elles évaluent une plateforme d’IA pour transformer leur expérience client.
La réponse est simple : il n’existe pas un modèle unique capable d’exceller dans toutes les situations.
Comme avec un jeu de LEGO®, il ne suffit pas d’un seul type de brique pour construire quelque chose de complexe. C’est pourquoi les agents développés sur la plateforme Sierra s’appuient sur plus de 15 modèles de pointe, open-weight et propriétaires, sélectionnés en fonction des exigences de chaque tâche.
Cette architecture, que nous appelons une constellation de modèles, associe les meilleurs modèles pour chaque besoin et les orchestre de manière transparente. Le résultat : des agents plus rapides, plus fiables et parfaitement alignés sur la voix de votre marque, sans que vous ayez à choisir, intégrer ou maintenir les modèles vous-même.
Le bon modèle pour chaque tâche
Les agents IA ne se contentent pas de générer du texte. Ils raisonnent, prennent des décisions et exécutent des actions : recommander un produit, authentifier un client, traiter un retour, résoudre un incident technique ou accompagner un client qui envisage de résilier son abonnement.
Les différentes missions confiées à un agent IA imposent des exigences très variées. Par exemple, certaines nécessitent :
- Des appels d’outils et une prise de décision à faible latence : pour des tâches comme la gestion des commandes, le suivi des stocks ou la consultation de produits, l’agent doit répondre rapidement afin de garantir des conversations vocales fluides et naturelles.
- Une classification de haute précision : certaines situations exigent une analyse fine et cohérente des comportements, par exemple pour détecter des activités suspectes ou identifier des signaux de fraude.
- Un raisonnement sur de longs contextes : lorsqu’il doit exploiter des politiques complexes, une documentation technique dense ou un historique de conversations, l’agent doit comprendre, mémoriser et appliquer les informations avec rigueur, sans omission ni hallucination.
- Une parfaite maîtrise du ton : l’agent doit rester chaleureux, conversationnel et fidèle à la voix de votre marque, y compris lors d’interactions sensibles ou complexes.
Aucun modèle ne peut aujourd’hui exceller dans toutes ces dimensions à la fois. Les modèles les plus performants en raisonnement sont souvent plus lents. À l’inverse, ceux qui privilégient la rapidité peuvent être moins efficaces lorsqu’ils doivent analyser un contexte complexe ou suivre des instructions détaillées. D’autres produisent un langage particulièrement naturel, mais montrent leurs limites face à de longs contextes ou à des tâches nécessitant une grande précision.
S’appuyer sur un seul modèle revient donc à faire des compromis entre vitesse, précision, capacité de raisonnement et qualité conversationnelle. Ces arbitrages finissent inévitablement par limiter les performances de vos agents.
Votre équipe résout ces défis en décomposant le comportement de l’agent en tâches, puis en choisissant le meilleur modèle pour chaque objectif précis. Concrètement, elle exécute des évaluations ciblées par tâche, identifie les écarts lorsque les modèles actuels ne suffisent pas et investit dans des modèles ajustés lorsque les modèles standards ne respectent pas vos contraintes.
Conçu pour un environnement en constante évolution
L’Agent OS de Sierra repose sur des abstractions de tâches modulaires qui isolent clairement les responsabilités, tandis que l’orchestration et le routage sont gérés automatiquement par la plateforme en arrière-plan. Au lieu de concevoir un agent monolithique, vos équipes le composent à partir de capacités bien séparées : recherche d’information, classification, outils, politiques et ton. Certaines tâches disposent d’un degré d’« agentivité » plus élevé, avec plus de latitude pour raisonner, réfléchir et utiliser des outils. Ce niveau d’agentivité devient possible grâce à des superviseurs qui appliquent les garde-fous, les politiques et les contrôles qualité.
Un avantage clé de cette organisation est que les agents que votre équipe construit sur Sierra s’améliorent automatiquement au rythme des modèles de pointe. Vos tâches à plus forte agentivité bénéficient directement de meilleures capacités de raisonnement, d’appel d’outils et de suivi des instructions. La plupart des agents progressent au fil du temps avec peu plus qu’un ajustement de prompt. À mesure que les modèles avancent, certaines tâches deviennent naturellement superflues et de nouvelles tâches apparaissent pour les remplacer.
Les méthodes de prompting varient selon les familles de modèles, et l’architecture modulaire de Sierra permet à vos équipes de mettre à jour facilement les tâches à forte valeur et à faible risque, sans toucher aux garde-fous sensibles. Vous pouvez ainsi adopter de nouveaux modèles plus vite et avec plus de contrôle, et bénéficier des avancées sans assumer les risques habituels.
Fiabilité et disponibilité
Pour les tâches les plus critiques, Sierra s’appuie sur une redondance native entre plusieurs fournisseurs de modèles. La plateforme surveille en continu leur disponibilité et leurs performances — latence, taux d’erreur et indisponibilités — afin de détecter immédiatement toute dégradation.
Lorsqu’un fournisseur ne répond plus aux niveaux de service attendus, le routage bascule automatiquement vers un modèle équivalent. Vos agents continuent ainsi de fonctionner sans interruption, de manière transparente pour vos clients.
Vous bénéficiez ainsi d’une couche d’inférence résiliente, capable de maintenir un haut niveau de disponibilité même en cas de défaillance d’un modèle ou d’un fournisseur. Cette architecture permet également d’optimiser en permanence le compromis entre rapidité, précision et qualité des réponses, y compris pour les cas d’usage les plus exigeants.
Vous définissez l’agent. Sierra lui donne vie.
Avec Sierra, vous définissez précisément le comportement de votre agent : ses politiques métier, ses outils, ses garde-fous, ses sources de connaissances, ainsi que la voix et le ton de votre marque.
La plateforme transforme ensuite ces choix en un agent prêt pour la production. Celui-ci s’appuie sur une architecture modulaire composée de tâches spécialisées, supervisées par des mécanismes de contrôle et orchestrées par une constellation de modèles continuellement optimisés pour chaque cas d’usage.
Vous obtenez ainsi un agent fiable, performant et conçu pour évoluer. À mesure que les modèles progressent, vos agents bénéficient automatiquement des dernières avancées, tout en conservant le comportement, la qualité et les garanties que vous avez définis.
C’est l’engagement de Sierra : une architecture suffisamment modulaire pour intégrer rapidement les innovations, suffisamment rigoureuse pour préserver la qualité et suffisamment robuste pour répondre aux exigences des environnements de production.
Vous définissez ce qu’est une expérience client d’excellence. Sierra assemble les meilleures technologies pour la rendre possible.


