IA frugale
Le bon modèle, pas le plus gros

Une taille de modèle ajustée au besoin réel, qui réduit à la fois le coût et l'empreinte énergétique de chaque réponse.

La plupart des questions n'ont pas besoin du plus gros modèle

Horaires d'ouverture. Statut de commande. Politique de retour. Une large part du volume de conversations relève de la routine.
Y répondre avec le modèle le plus lourd disponible est un gaspillage — de coût, et d'énergie. Un usage uniforme signifie aussi que la dépense croît au rythme du volume.

Cleed.ai oriente chaque demande vers le modèle qui lui convient, et garde les plus lourds pour ce qui l'exige vraiment.

Une taille de modèle ajustée à la question
Horaires d'ouverture
Modèle léger
Statut de commande
Modèle léger
Politique de retour
Modèle léger
Conseil complexe
Modèle lourd
Raisonnement en plusieurs étapes
Modèle lourd
Le routage est invisible pour le client. La qualité est surveillée en continu.
Chart comparing monthly cost as conversation volume grows: a steep rise with uniform use of the heaviest model, a much flatter rise with frugal routing.

Dimensionné à la question posée

Un routage selon le besoin réel

Les demandes routinières vers des modèles légers.
Le raisonnement complexe là où il justifie son coût.

Un coût qui passe à l'échelle sans déraper

Le lien entre volume et dépense est rompu.
La croissance cesse d'être un problème de budget.

Un argument environnemental mesurable

Une consommation par requête réduite, et documentée. Utile pour votre reporting RSE et de plus en plus attendu dans la commande publique.

Utiliser un modèle de pointe pour donner des horaires d'ouverture n'est pas de la sophistication. C'est du gaspillage.

La frugalité est une décision d'ingénierie avant d'être un choix écologique — et il se trouve qu'elle sert les deux. Le routage est invisible pour le client, et la qualité des réponses est mesurée en continu.

Invisible pour le client

Le routage se fait en coulisses. Le visiteur perçoit un seul Assistant, avec un seul ton et un seul niveau de qualité.

Escalade quand il le faut

Une demande qui nécessite un modèle plus lourd en obtient un. Les seuils de qualité sont surveillés, et le routage s'ajuste.

Des chiffres communicables

La consommation par requête est mesurée et disponible, pour que l'argument environnemental repose sur des données et non sur une intention.

Une taille de modèle ajustée à la question
Horaires d'ouverture
Modèle léger
Statut de commande
Modèle léger
Politique de retour
Modèle léger
Conseil complexe
Modèle lourd
Raisonnement en plusieurs étapes
Modèle lourd
Le routage est invisible pour le client. La qualité est surveillée en continu.

Un usage uniforme des modèles crée des coûts évitables :

Des questions routinières traitées par le modèle le plus lourd
Une dépense qui croît au rythme du trafic

Voici ce qui change avec un dimensionnement ajusté :

48h Délai d'activation
.
24/7 Qualité surveillée en continu
.
1 ligne de code à installer
.
0 changement visible pour vos clients

Bénéficiez de la qualité d’expérience client d'un point de contact physique sur votre site internet

Offrez une expérience utilisateur de niveau supérieur à vos visiteurs grâce à notre expertise en IA et CX