> ## Documentation Index
> Fetch the complete documentation index at: https://docs.ouraicalling.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Modèles et voix

> Le catalogue de modèles, la bibliothèque de voix avec aperçus, et les chaînes de secours

## Le catalogue de modèles

Les assistants ne codent pas en dur de fournisseur : ils choisissent dans un **catalogue de modèles sélectionnés** couvrant quatre types :

| Type                  | Fournisseurs (exemples)                     |
| --------------------- | ------------------------------------------- |
| LLM                   | OpenAI, Anthropic, Google, Groq, Azure      |
| Reconnaissance vocale | Deepgram, OpenAI, Google, Azure             |
| Synthèse vocale       | Cartesia, ElevenLabs, OpenAI, Google, Azure |
| Temps réel            | OpenAI (gpt-realtime), Google (Gemini Live) |

Seul l'**administrateur de la plateforme** contrôle la disponibilité. Il active
les modèles globalement, peut les autoriser ou les bloquer pour un utilisateur,
et définit leurs modes de moteur compatibles. Les administrateurs d'espace de
travail ne peuvent pas contourner le catalogue.

Avec le module Fallbacks & Guardrails, l'éditeur affiche les sélecteurs de fournisseur et de modèle.
Pipeline, temps réel et half-cascade conservent des choix indépendants. L'option
par défaut stocke `null`, afin que les modifications administrateur s'appliquent
automatiquement : choix de l'assistant, valeur personnelle, valeur plateforme,
puis solution de secours sûre. Sans Fallbacks & Guardrails, l'éditeur reste automatique et les
valeurs personnelles continuent de s'appliquer.

<Tip>
  Repérez le badge **Recommandé** : ce sont les modèles que nous testons le plus et pour lesquels nous ajustons les réglages par défaut. Le badge **Faible latence** signale les modèles adaptés aux conversations téléphoniques réactives.
</Tip>

## La bibliothèque de voix

Le sélecteur de voix charge le catalogue paginé complet de chaque fournisseur TTS activé, filtrable par langue et par genre, **avec des aperçus audio instantanés** : cliquez sur lecture pour écouter un extrait avant de valider votre choix.

Les voix ElevenLabs avec des tarifs personnalisés ou des multiplicateurs de crédits sont exclues : chaque voix ElevenLabs affichée dans le sélecteur utilise donc le tarif standard du fournisseur.

* **Voix par assistant** — la voix par défaut de l'assistant.
* **Voix personnalisée par agent de Flow** — chaque agent de [Flow](/flow-builder/nodes) peut parler avec une voix différente (par exemple, une voix distincte pour l'agent « spécialiste des ventes »).
* **Voix par langue** — grâce au [changement de langue automatique](/assistants/languages), vous associez une voix à chaque langue afin que l'assistant change de voix en même temps que de langue.
* **Voix clonées** — selon votre forfait, vous pouvez ajouter des clones personnalisés et les utiliser comme n'importe quelle voix de la bibliothèque. Un clone est privé au compte qui l'a créé : les autres membres du même espace de travail ne peuvent ni le voir ni le sélectionner. La limite du forfait est comptée par utilisateur.

## Style de parole

Ajustez le rendu sans changer de voix :

* **Débit de parole** — d'un rythme légèrement plus lent à plus rapide que le rythme neutre.
* **Volume de sortie** — ajustement du niveau pour les voix trop faibles ou trop fortes.
* **Dictionnaire de prononciation** — une correspondance clé/valeur propre à chaque assistant, par exemple `"API" → "A P I"` ou le nom de votre entreprise épelé phonétiquement. Appliqué à toute la sortie vocale.
* **Filtres Markdown et emoji** — activés par défaut afin que les artefacts de mise en forme du LLM ne soient jamais lus à haute voix.

## Chaînes de secours (Fallbacks & Guardrails)

Pour la fiabilité en production, vous pouvez définir une **chaîne de secours par étape** : si le fournisseur principal se dégrade en cours d'appel, le moteur bascule vers l'entrée suivante — l'appel se poursuit de façon transparente.

* **STT** — par exemple `Deepgram nova-3 → AssemblyAI universal-streaming`
* **LLM** — par exemple `GPT → Groq`
* **TTS** — par exemple `Cartesia sonic → ElevenLabs` (chaque entrée peut spécifier sa propre voix)

Les changements d'état des fournisseurs sont enregistrés comme des événements d'appel, ce qui vous permet de vérifier après coup si un basculement s'est déclenché. Les chaînes de secours sont une fonctionnalité réservée à certains forfaits.

<Note>
  Même sans chaînes de secours configurées, une configuration défaillante ne fait jamais échouer un appel : le moteur revient à une pile par défaut sécurisée et enregistre un événement `config_error`.
</Note>
