Skip to main content

Le catalogue de modèles

Les assistants ne codent pas en dur de fournisseur : ils choisissent dans un catalogue de modèles sélectionnés couvrant quatre types : Seul l’administrateur de la plateforme contrôle la disponibilité. Il active les modèles globalement, peut les autoriser ou les bloquer pour un utilisateur, et définit leurs modes de moteur compatibles. Les administrateurs d’espace de travail ne peuvent pas contourner le catalogue. Avec le module Fallbacks & Guardrails, l’éditeur affiche les sélecteurs de fournisseur et de modèle. Pipeline, temps réel et half-cascade conservent des choix indépendants. L’option par défaut stocke null, afin que les modifications administrateur s’appliquent automatiquement : choix de l’assistant, valeur personnelle, valeur plateforme, puis solution de secours sûre. Sans Fallbacks & Guardrails, l’éditeur reste automatique et les valeurs personnelles continuent de s’appliquer.
Repérez le badge Recommandé : ce sont les modèles que nous testons le plus et pour lesquels nous ajustons les réglages par défaut. Le badge Faible latence signale les modèles adaptés aux conversations téléphoniques réactives.

La bibliothèque de voix

Le sélecteur de voix charge le catalogue paginé complet de chaque fournisseur TTS activé, filtrable par langue et par genre, avec des aperçus audio instantanés : cliquez sur lecture pour écouter un extrait avant de valider votre choix. Les voix ElevenLabs avec des tarifs personnalisés ou des multiplicateurs de crédits sont exclues : chaque voix ElevenLabs affichée dans le sélecteur utilise donc le tarif standard du fournisseur.
  • Voix par assistant — la voix par défaut de l’assistant.
  • Voix personnalisée par agent de Flow — chaque agent de Flow peut parler avec une voix différente (par exemple, une voix distincte pour l’agent « spécialiste des ventes »).
  • Voix par langue — grâce au changement de langue automatique, vous associez une voix à chaque langue afin que l’assistant change de voix en même temps que de langue.
  • Voix clonées — selon votre forfait, vous pouvez ajouter des clones personnalisés et les utiliser comme n’importe quelle voix de la bibliothèque. Un clone est privé au compte qui l’a créé : les autres membres du même espace de travail ne peuvent ni le voir ni le sélectionner. La limite du forfait est comptée par utilisateur.

Style de parole

Ajustez le rendu sans changer de voix :
  • Débit de parole — d’un rythme légèrement plus lent à plus rapide que le rythme neutre.
  • Volume de sortie — ajustement du niveau pour les voix trop faibles ou trop fortes.
  • Dictionnaire de prononciation — une correspondance clé/valeur propre à chaque assistant, par exemple "API" → "A P I" ou le nom de votre entreprise épelé phonétiquement. Appliqué à toute la sortie vocale.
  • Filtres Markdown et emoji — activés par défaut afin que les artefacts de mise en forme du LLM ne soient jamais lus à haute voix.

Chaînes de secours (Fallbacks & Guardrails)

Pour la fiabilité en production, vous pouvez définir une chaîne de secours par étape : si le fournisseur principal se dégrade en cours d’appel, le moteur bascule vers l’entrée suivante — l’appel se poursuit de façon transparente.
  • STT — par exemple Deepgram nova-3 → AssemblyAI universal-streaming
  • LLM — par exemple GPT → Groq
  • TTS — par exemple Cartesia sonic → ElevenLabs (chaque entrée peut spécifier sa propre voix)
Les changements d’état des fournisseurs sont enregistrés comme des événements d’appel, ce qui vous permet de vérifier après coup si un basculement s’est déclenché. Les chaînes de secours sont une fonctionnalité réservée à certains forfaits.
Même sans chaînes de secours configurées, une configuration défaillante ne fait jamais échouer un appel : le moteur revient à une pile par défaut sécurisée et enregistre un événement config_error.