Environ 20 % de mieux que leur ancien pipeline.
uMinds gère les tunnels de vente de plus de dix créateurs. Lors d'un test A/B comparatif mené en production, leurs agents speech-to-speech en espagnol ont battu le pipeline Cartesia + GPT-4.1 mini + Deepgram qu'ils utilisaient auparavant, sur la métrique qui rapporte : la performance. Même campagne, seule l'architecture change.
uMindsTunnels de vente pour créateurs · 10+ créateurs
Ce qui a changé, en chiffres.
~20 %de performance en plus par rapport à leur pipeline orchestré, testé en A/B en production
- 50 000appels passés en moins de 3 heures
- 45lignes simultanées, en production
- 5 CPSsur un seul numéro, SIP sur mesure
Les chiffres reflètent la configuration et les résultats de production d'un client, pas un engagement contractuel.
Leur point de départ.
uMinds gère les tunnels de vente de plus de dix créateurs, en volume : des campagnes de dizaines de milliers d'appels, sur sa propre téléphonie SIP.
Ils avaient déjà des agents vocaux en production sur un pipeline orchestré : Deepgram pour transcrire, GPT-4.1 mini pour raisonner, Cartesia pour parler. La question était de savoir si le speech-to-speech natif ferait mieux sur la métrique qui rapporte.
Ce qui tourne en production.
- Test
- A/B, en production réelle, sur la même campagne
- Avant
- Pipeline : Deepgram (STT) + GPT-4.1 mini (LLM) + Cartesia (TTS)
- Après
- Speech-to-speech : Gemini 3.1 Flash Live
- Langue
- Espagnol
- Téléphonie
- Leur propre SIP : 5 appels par seconde sur un seul numéro
- Simultanéité
- 45 lignes
- Comptes
- 3 sous-comptes, pilotés depuis un seul endroit
Même campagne, seule l'architecture change.
Les deux architectures, en production
La même campagne a tourné sur le pipeline et en speech-to-speech, en production.
Mesuré sur la performance
Le speech-to-speech a devancé le pipeline d'environ 20 %.
Montée en charge sur le gagnant
Et il a tenu la charge sur la même campagne : 50 000 appels passés en moins de 3 heures, sur 45 lignes à 5 appels par seconde.
Par ceux qui le pilotent.

Je pensais qu'il serait impossible de rivaliser avec les plus grands fournisseurs de voix. Mais CallShift s'est concentré sur ce qui manquait aux autres. Grâce à de solides paris sur des modèles comme Gemini, ils ont apporté la qualité et les tarifs qui nous ont fait quitter d'autres fournisseurs. Pour moi, CallShift est l'avenir de l'infrastructure vocale.
Même campagne, seule l'architecture change
Avant : Cartesia + GPT-4.1 mini + Deepgram, orchestrés. Après : Gemini 3.1 Flash Live, en speech-to-speech, sur leur propre téléphonie SIP, avec 3 sous-comptes pilotés depuis un seul endroit.
Vous vous reconnaissez ?
- Vous exploitez aujourd'hui des agents vocaux sur un pipeline (STT, LLM, TTS).
- Vous voulez mesurer ce que le speech-to-speech change sur votre propre campagne.
- Vous avez besoin de volume : lignes simultanées, appels par seconde, votre propre SIP.
Un autre besoin ? Un autre cas.
- Je gère un centre de contacts45 %des appels d'astreinte traités de bout en bout par l'IA chez Valophis, sans mobiliser de conseillerSofratel × Valophis
- Je gère un réseau multi-entité100clubs sur le même script, 12 semaines après le club piloteOnAir Fitness
- Je perds des appels~0 %d'appels manqués, contre 55 % avantBonnie&Car
Voyez ce que ça donne sur vos propres appels.
Réservez un appel avec un ingénieur voice AI : nous partons de vos parcours d'appel réels et vous montrons l'agent, l'architecture et les chiffres qui leur correspondent.
