Choisir un modèle
=================

Chaque agent fonctionne avec un modèle de langage. Cette page explique ce qui les différencie réellement, afin que vous choisissiez délibérément plutôt qu'en fonction du seul prix.

La réponse courte
-----------------

Si vous ne voulez pas y réfléchir : **utilisez le modèle Manivox.ai déjà sélectionné par défaut sur votre agent**. C'est l'option la plus rapide que nous proposons, elle est incluse dans votre coût de service à la minute, et c'est celle que nous optimisons pour la voix. Ne changez que si vous rencontrez l'une des raisons ci-dessous.

Ce qui compte vraiment lors d'un appel
--------------------------------------

Les comparatifs de modèles parlent généralement de scores de benchmark. Sur un appel vocal, trois autres facteurs déterminent si la conversation paraît naturelle :

- **Le délai avant la première réponse.** L'appelant attend en silence. Au-delà d'environ une seconde, cela s'entend comme une hésitation ; au-delà de deux, comme un appel coupé. C'est là que les modèles diffèrent le plus — d'un facteur six sur notre catalogue.
- **La fiabilité avec les outils.** Si votre agent consulte un agenda, recherche une information ou envoie un SMS, le modèle doit déclencher cette action correctement et systématiquement. Un modèle qui répond parfaitement mais oublie d'appeler l'outil a raté l'appel.
- **Le coût par conversation.** Facturé au million de tokens : il évolue donc avec le volume d'appels et avec la quantité de contexte que porte votre prompt.

L'« intelligence » brute est le critère le moins important pour la plupart des agents téléphoniques. Une ligne de réservation n'a pas besoin d'un raisonnement de pointe ; elle doit répondre en 300 ms et retenir la bonne date.

Les trois familles
------------------

### Modèles Manivox.ai

Notre propre matériel, en Europe. Ce sont **les modèles les plus rapides de la plateforme** — mesures à l'appui, avec une marge nette — car la requête ne quitte jamais notre réseau. La plupart sont **inclus dans votre coût de service à la minute** et ne facturent aucun token.

Choisissez ceux-là sauf raison précise. Le modèle Manivox le plus grand est celui à retenir quand un appel est réellement complexe : raisonnement en plusieurs étapes, conversations longues et ramifiées, ou demandes inhabituelles où un modèle plus petit commence à deviner.

### OpenAI et Google

Hébergés par l'éditeur, joignables via l'internet public. Tous sont **plus lents à répondre que nos propres modèles** et facturent des tokens. Ils valent le détour quand :

- Votre organisation s'est standardisée sur cet éditeur pour des raisons de politique interne ou d'achats.
- Vous avez besoin d'une très grande fenêtre de contexte — injecter un document entier à chaque tour, par exemple.
- Vous voulez le comportement d'un modèle précis que vous avez déjà validé ailleurs.

Chez chaque éditeur, les variantes « mini » et « flash » sont les plus rapides et les moins chères, et conviennent généralement mieux à la voix ; les modèles phares sont plus lents et plusieurs fois plus coûteux.

### Votre propre fournisseur (BYOK)

Si votre organisation a connecté son propre point de terminaison, ses modèles apparaissent avec le préfixe `[EXT]`. Les tokens vous sont facturés directement par ce fournisseur, pas par nous : aucun prix n'est donc affiché dans le sélecteur. Testez les appels d'outils de bout en bout avant la mise en production — voir [Modèles compatibles & BYOK](https://sandbox.manivox.ai/docs/integrations/llm-models).

Quatre situations courantes
---------------------------

Votre agentChoisissezPourquoi    Réservations, horaires d'ouverture, routage d'appels, FAQ Le modèle Manivox.ai par défaut Réponse la plus rapide, aucun coût de token. Cela couvre la grande majorité des agents téléphoniques.   Plusieurs outils, conversations ramifiées, logique conditionnelle Le plus grand modèle Manivox.ai Meilleur pour tenir un fil en plusieurs étapes. Toujours plus rapide que tout modèle hébergé, mais il facture des tokens.   Une action erronée coûte cher — réservations payantes, modifications irréversibles Un modèle hébergé prudent Certains modèles posent une question de clarification plutôt que d'agir sur une supposition. Cela coûte un tour de plus et évite une réservation erronée. La description du modèle dans le sélecteur indique s'il se comporte ainsi.   Documents très longs dans le contexte à chaque tour Un modèle hébergé à grand contexte La seule raison d'accepter le délai supplémentaire. Vérifiez d'abord si une base de connaissances ne vous servirait pas mieux — voir [Bases de connaissances](https://sandbox.manivox.ai/docs/knowledge-bases/index).  Lire le sélecteur
-----------------

Dans l'onglet **Initialisation** d'un agent, sous **Modèle de langage**, chaque modèle du menu affiche son tarif sous la forme `entrée / sortie €/M` — euros par million de tokens en entrée, puis en sortie. La sortie est généralement la plus chère des deux, et c'est ce que consomme un agent bavard.

Sous les deux menus figurent une ligne décrivant à quoi sert le modèle sélectionné, et une ligne avec ses tarifs complets. Trois choses que cette ligne peut indiquer à la place d'un prix :

- **« Inclus dans votre coût de service à la minute »** — le modèle ne facture aucun token. Nos propres modèles sont configurés ainsi.
- **« Fonctionne avec votre propre clé API »** — un fournisseur BYOK. Votre fournisseur vous facture directement.
- **Rien du tout** — aucun tarif n'a encore été enregistré pour ce modèle. Demandez-nous avant de vous appuyer dessus.

Vous pouvez aussi remplacer le modèle **étape par étape** dans l'éditeur de flux : ouvrez un nœud Agent ou Accueil et utilisez l'onglet **Modèle IA (LLM)**. Un schéma courant consiste à utiliser un modèle rapide pour tout l'appel et un modèle plus performant pour une seule étape difficile. Voir [Configuration de l'agent → LLM](https://sandbox.manivox.ai/docs/agents/configuration#llm).

Changer d'avis sans risque
--------------------------

Changer de modèle n'est pas risqué en soi — mais un prompt réglé pour un modèle peut se comporter différemment sur un autre, en particulier pour les appels d'outils. Après un changement, passez un appel de test qui sollicite vos outils avant de rendre la version live. L'historique des versions permet de revenir en arrière : voir [Gestion des versions](https://sandbox.manivox.ai/docs/agents/versions).