Le 6 août 2026, notre propre comparatif des outils voix IA plaçait Resemble AI en position de pépite du clonage vocal temps réel — le seul outil de la liste vraiment pensé pour du dialogue live, avec une latence de 75ms et une facturation à l'usage citée comme un modèle exemplaire pour les développeurs. Dix jours plus tard, si tu vas sur resemble.ai avec l'intention de créer un compte pour cloner une voix, tu tombes sur autre chose : une page d'accueil qui parle de détection de deepfakes en temps réel, un bouton "Start free" qui pointe vers une plateforme de détection, et une section "Voice AI Research" reléguée dans le pied de page. Pas d'annonce fracassante, pas de bandeau rouge "fermeture". Juste un site qui a discrètement changé de sujet.

C'est le genre de mouvement que la majorité des comparatifs et articles publiés cette semaine n'ont pas encore eu le temps de documenter — la plupart des pages qui recommandent encore Resemble AI comme "la pépite dev du clonage temps réel" citent des captures d'écran ou des pricing pages qui datent d'avant le 13 août 2026. Ce texte part du même duel que notre comparatif marché — ElevenLabs contre Resemble AI, les deux meilleurs scores sur le critère clonage vocal (5/5 chacun) — mais le pousse plus loin que le tableau de scores : qu'est-ce qui reste réellement disponible aujourd'hui si tu as besoin de cloner une voix en temps réel, qui peut encore s'inscrire, et à quel prix exact. Autrement dit : le comparatif que tu aurais dû lire si tu avais cherché cette information une semaine plus tard.

Les données viennent des pages officielles elevenlabs.io/pricing et elevenlabs.io/affiliates-terms (revérifiées le 16 août 2026), du blog officiel resemble.ai (billet du 13 août 2026 signé du CEO Zohaib Ahmed), du dépôt GitHub public resemble-ai/chatterbox, et des profils G2/Capterra des deux entreprises. Quand une donnée du comparatif source n'a pas pu être reconfirmée à l'identique — ce qui arrive plusieurs fois dans ce texte — l'écart est signalé explicitement plutôt que lissé.

Ce que tu vas trouver ici : le pricing ElevenLabs recalculé plan par plan (avec un palier d'entrée à $6 que peu de comparatifs mentionnent), le détail complet du pivot Resemble AI vers la détection de deepfakes et ce que ça change concrètement pour un nouveau client, l'alternative open-source Chatterbox Turbo pour continuer à faire du clonage temps réel sans payer Resemble AI, et un verdict par profil qui tient compte de cette bascule.

5 critères pour choisir ton outil de clonage vocal en 2026

  • 1 Disponibilité réelle : l'outil accepte-t-il encore de nouveaux clients sur la fonction dont tu as besoin, ou faut-il vérifier que l'offre existe toujours avant de construire un projet dessus ?
  • 2 Temps réel vs asynchrone : tu génères de l'audio à l'avance (voix off, podcast, livre audio) ou tu as besoin d'un dialogue vocal live avec une latence sous les 300ms ?
  • 3 Contrôle de l'infrastructure : une API hébergée gérée par un éditeur te suffit, ou tu as besoin/envie d'auto-héberger le modèle sur ton propre GPU pour garder la main sur les coûts et les données ?
  • 4 Modèle de coût : abonnement mensuel avec crédits (ElevenLabs) ou facturation pure à l'usage sans engagement (Resemble AI historiquement, maintenant fermé aux nouveaux comptes voix) ?
  • 5 Niveau de fidélité du clone : un clone instantané à partir de 30 secondes d'audio suffit, ou tu as besoin d'un clone professionnel entraîné sur 30+ minutes pour une fidélité maximale ?

ElevenLabs : le clonage vocal qui a pris le pouvoir en 2026

ElevenLabs
TTS et clonage vocal premium, du texte au dialogue temps réel
4,5/5
G2, 1 140 avis vérifiés

ElevenLabs n'a plus grand-chose d'un simple générateur de voix off. La plateforme couvre aujourd'hui le clonage vocal (instantané et professionnel), le doublage multilingue, les effets sonores, la génération musicale et des agents vocaux conversationnels temps réel — le tout sous un seul système de crédits. C'est ce dernier point, les agents vocaux, qui change la donne pour ce comparatif : ElevenLabs propose désormais son propre modèle temps réel, Flash v2.5, avec une latence sous la seconde documentée pour la conversation full-duplex. Le modèle phare Eleven v3, passé en disponibilité générale le 14 mars 2026, ne fait en revanche pas de temps réel — la documentation officielle recommande explicitement de rester sur Flash v2.5 pour tout cas d'usage conversationnel ou d'agent vocal.

G2 : 4,5/5 sur 1 140 avis vérifiés, avec 72% de notes 5 étoiles (relevé août 2026). Écart notable avec Trustpilot, qui plafonne à 3,0/5 — un déséquilibre presque entièrement attribuable aux litiges de facturation et à la perte de crédits non consommés en cas de downgrade ou d'annulation, pas à la qualité de la voix elle-même, qui reste unanimement saluée dans les deux bases d'avis.

Points forts

  • Voix la plus réaliste du marché sur les tests d'écoute contrôlés — la majorité des auditeurs ne distinguent pas un clone professionnel de la voix d'origine
  • Deux niveaux de clonage : Instant Voice Cloning (30 secondes d'audio, débloqué dès $6/mois) et Professional Voice Cloning (30+ minutes, fidélité et gamme émotionnelle supérieures, débloqué dès $22/mois)
  • Flash v2.5 en temps réel sous la seconde, utilisable pour des agents vocaux conversationnels complets sans changer de fournisseur
  • Programme d'affiliation actif et documenté officiellement — un vrai plus face à la majorité des concurrents de ce comparatif

Points faibles

  • Système de crédits jugé imprévisible par de nombreux avis : les crédits non consommés ne se reportent pas systématiquement, et un mois calme se traduit par de la valeur perdue
  • Eleven v3, le modèle le plus expressif, ne supporte pas le temps réel — obligation de rester sur Flash v2.5 pour un agent vocal, ce qui limite l'accès aux fonctions émotionnelles les plus avancées en conversation live
  • Saut de palier abrupt entre Pro ($99) et Scale ($299) pour qui a besoin de plusieurs sièges d'équipe
  • Le mot "expensive" reste l'un des plus cités dans les avis négatifs, sur un marché où les alternatives économiques se multiplient
À retenir : ElevenLabs reste la référence qualité du marché, et c'est désormais aussi une option crédible en temps réel via Flash v2.5 — un rôle qu'elle n'avait pas vraiment besoin de jouer avant la fermeture des inscriptions voix chez Resemble AI. Le vrai sujet de vigilance n'est plus la qualité vocale, c'est la lisibilité de la facture.

Le détail que la plupart des comparatifs marché sautent, y compris le nôtre publié début août : le palier d'entrée réel du clonage vocal commercial chez ElevenLabs n'est pas le plan Creator à $22/mois, c'est le plan Starter à $6/mois. Ce palier, souvent absent des tableaux comparatifs qui commencent directement à "$22, Creator", inclut déjà la licence commerciale et le clonage vocal instantané (30 secondes d'audio suffisent). Le plan Creator à $22 ne devient nécessaire qu'à partir du moment où tu veux du clonage professionnel — fidélité et gamme émotionnelle supérieures, entraîné sur 30 minutes ou plus d'audio source.

Le prix ElevenLabs, plan par plan (vérifié 16 août 2026)

ElevenLabs — Plans vérifiés à la source, août 2026
Free
$0/mois
10 000 crédits/mois · TTS/STT/SFX de base · voice design · 3 projets · pas de licence commerciale
Starter
$6/mois
30 000 crédits/mois · licence commerciale · clonage vocal instantané · 20 projets · dubbing studio
Le plus courant
Creator
$22/mois
121 000 crédits/mois · débloque le Clonage Vocal Professionnel · premier mois à $11
Pro
$99/mois
600 000 crédits/mois · audio PCM haute qualité 192kbps
Scale
$299/mois
1,8M crédits/mois · 3 sièges workspace · 3 clones vocaux professionnels
Business
$990/mois
6M crédits/mois · 10 sièges · 10 clones vocaux professionnels

La distinction entre les deux niveaux de clonage mérite d'être posée clairement, parce que c'est elle qui détermine le vrai palier d'entrée. L'Instant Voice Cloning (IVC), débloqué dès Starter à $6/mois, génère un clone exploitable à partir d'à peine 30 secondes d'audio propre, en quelques minutes — suffisant pour une voix off ponctuelle ou un test rapide, mais avec un résultat qui ne restitue pas toujours fidèlement les nuances de la voix d'origine. Le Professional Voice Cloning (PVC), réservé à Creator et au-dessus, s'appuie sur un entraînement plus long — idéalement 30 minutes ou plus d'enregistrements sources — pour capturer les caractéristiques vocales fines : gamme émotionnelle, respiration, micro-variations de rythme. Un test mené sur un enregistrement source de 45 minutes a montré un clone capable de restituer des phrases jamais prononcées par le locuteur d'origine avec un débit naturel et un timbre cohérent d'un bout à l'autre. Pour un usage ponctuel ou un budget serré, IVC à $6/mois suffit largement ; pour un usage récurrent où la voix clonée doit rester indiscernable sur la durée, PVC à $22/mois devient l'investissement pertinent.

En facturation annuelle, la réduction affichée "deux mois offerts" ramène le Creator à $18,33/mois, le Pro à $82,50/mois et le Scale à $249,17/mois. Le programme d'affiliation officiel (elevenlabs.io/affiliates-terms) verse jusqu'à 22% de commission récurrente pendant 12 mois sur un cookie de 90 jours, géré via PartnerStack, avec un seuil de paiement minimum de $5 — un chiffre à retenir puisque le comparatif source de cet article citait une fourchette "22–55%" qui ne correspond pas aux conditions officielles actuellement publiées ; le taux vérifiable à la source est un plafond de 22%, pas une fourchette haute à 55%.

"Le produit est excellent, mais le système de facturation reste frustrant." — synthèse d'avis vérifiés G2/Capterra, 2026, sur le sujet récurrent des crédits perdus en cas de downgrade.

Tester ElevenLabs

Plan Free permanent, plan Starter à $6/mois pour le clonage commercial

Le plan Free (10 000 crédits/mois, sans CB) permet de tester la voix et le clonage de base. Pour un usage commercial réel avec clonage vocal instantané, le palier d'entrée est Starter à $6/mois — pas Creator à $22 comme l'affichent la plupart des comparatifs. Professional Voice Cloning et temps réel avancé nécessitent Creator ou plus.

Essayer ElevenLabs gratuitement → Free permanent · Starter dès $6/mois · pas d'engagement annuel obligatoire

Resemble AI : la pépite qui a fermé ses portes aux nouveaux clients voix

Resemble AI
Ex-clonage vocal temps réel, aujourd'hui recentré sur la détection de deepfakes
Fermé
nouveaux clients voix, depuis le 13/08/2026

Sur le papier, Resemble AI reste l'outil le mieux positionné de ce comparatif pour un développeur qui a besoin de clonage vocal temps réel avec facturation à l'usage — c'est exactement ce que documentait notre comparatif marché publié le 6 août 2026, et c'est toujours techniquement vrai côté produit : Chatterbox Turbo, le modèle maison, tient une latence annoncée de 75ms et un temps jusqu'au premier son sous les 150 millisecondes. Le problème n'est plus la technologie. C'est l'accès au produit commercial qui la porte.

G2 : seulement 2 avis vérifiés sur le pricing (échantillon très réduit, cohérent avec une base d'utilisateurs historiquement enterprise/dev qui communique peu publiquement). Capterra : 0 avis publié à date. Les rares retours disponibles saluent des voix "naturelles, avec un ton et une émotion authentiques" et un clonage "ultra-réaliste avec peu d'effort", mais pointent un tarif jugé élevé pour de petits projets et des réglages avancés qui demandent du temps à maîtriser.

Ce qu'il faut savoir avant de chercher à t'inscrire
  • Inscriptions voix fermées depuis le 13 août 2026 : Resemble AI a annoncé sur son propre blog avoir arrêté d'accepter de nouveaux clients sur la génération vocale. La page d'accueil resemble.ai ne propose plus aucun bouton d'inscription pour le TTS ou le clonage — tous les call-to-action pointent vers la plateforme de détection de deepfakes.
  • Les clients existants sont maintenus, pas les nouveaux : si tu avais déjà un compte voix actif avant cette date, le support continue. Un nouveau projet ne peut plus s'appuyer sur une inscription directe au produit voix commercial.
  • Aucun programme d'affiliation connu chez Resemble AI, avant comme après le pivot — un point déjà signalé dans le comparatif marché du 6 août et toujours vrai.
  • Le pricing pay-as-you-go historique (dès $0,0005/sec en TTS, clones vocaux facturés $2 à $5/mois chacun, sièges d'équipe à $20/mois) correspond à une offre que Resemble AI a cessé de vendre à de nouveaux comptes en 2025-2026 dans le cadre du recentrage vers la détection — ce n'est plus un tarif auquel un nouveau client peut souscrire directement.
À retenir : Resemble AI reste, techniquement, l'un des moteurs de clonage vocal temps réel les plus rapides du marché — mais ce n'est plus un produit que tu peux acheter en tant que nouveau client en 2026. La bonne nouvelle : le modèle qui fait tourner cette latence de 75ms, Chatterbox Turbo, est publié en open source et reste utilisable gratuitement en dehors de toute inscription chez Resemble AI. C'est le sujet de la section suivante.

Le pivot en détail : pourquoi un spécialiste du clonage vocal se met à traquer les deepfakes

Le billet officiel publié sur le blog resemble.ai le 13 août 2026, signé du CEO et cofondateur Zohaib Ahmed, porte un titre qui résume tout : "Why a former voice AI company went all in on deepfake detection". "Former" — ancienne entreprise de voix IA. Le mot est choisi par l'entreprise elle-même, pas par un observateur extérieur.

"Plus les voix devenaient bonnes, plus elles risquaient d'être utilisées à des fins malveillantes." — Zohaib Ahmed, CEO et cofondateur de Resemble AI, billet officiel du 13 août 2026

Le déclencheur documenté dans le billet n'est pas anecdotique : le H1 2026 Deepfake Threat Report de l'entreprise recense au moins 15 736 victimes réparties sur 821 attaques en six mois, pour un total de 3,46 millions de fichiers concernés — majoritairement des images et des vidéos, pas de l'audio pur. Ahmed explique que la détection "est devenue ce dont le monde avait le plus besoin de notre part, et ce pour chaque modalité, y compris la vidéo et l'image" — pas seulement la voix, qui reste le domaine d'origine de l'entreprise depuis sa fondation en 2019.

Concrètement, la bascule s'est faite en plusieurs temps : Resemble AI a d'abord retiré ses paliers d'abonnement grand public pour la voix (2025), gardé une facturation à l'usage résiduelle, ajouté un produit de détection nommé Detect ainsi qu'un système de tatouage numérique (watermarking) baptisé Verify — puis, le 13 août 2026, a formellement fermé l'inscription de nouveaux clients sur la génération vocale. L'entreprise met désormais en avant cinq API de détection (Detect, Watermarker, Identity, Signal, Intelligence) et un modèle-phare baptisé DETECT-World, présenté comme "le premier modèle du monde pour la détection de deepfakes" — une approche qui vérifie la physique du signal plutôt que de simplement reconnaître la signature d'un générateur connu.

Ce virage stratégique est adossé à un financement concret : une levée Series B de $13M annoncée le 8 décembre 2025, menée par Sony et Okta Ventures, portant le total levé par l'entreprise à $25M. Deux investisseurs dont le métier touche directement à l'authentification (Okta) et à la protection de contenu audiovisuel (Sony) — un signal cohérent avec le nouveau positionnement, plus qu'une simple diversification opportuniste.

La pépite : la vraie pépite de ce comparatif n'est plus l'accès à Resemble AI en tant que service payant — c'est ce que Resemble AI a laissé derrière elle en partant. Chatterbox et Chatterbox Turbo, les modèles qui alimentaient l'API commerciale temps réel, sont publiés sous licence MIT sur GitHub (resemble-ai/chatterbox) et restent utilisables gratuitement, y compris en production commerciale fermée, par quiconque a l'infrastructure GPU pour les faire tourner. L'entreprise a fermé son guichet, pas son code.

Chatterbox Turbo : l'alternative open-source pour le temps réel

Pour un développeur qui avait prévu de construire un agent vocal temps réel sur l'API Resemble AI et qui découvre la fermeture des inscriptions, l'option la plus proche de ce qui était vendu jusqu'ici n'est pas un concurrent commercial — c'est le modèle open-source que Resemble AI a elle-même publié.

Chatterbox Turbo tourne sur une architecture à 350 millions de paramètres, jusqu'à 6 fois plus rapide que le temps réel sur un GPU récent, avec un temps jusqu'au premier son sous les 150 millisecondes et une latence de bout en bout annoncée à 75ms — les mêmes chiffres que ceux qui faisaient de Resemble AI "la pépite temps réel" dans le comparatif marché du 6 août, puisque c'est littéralement le même moteur. Le clonage se fait à partir de 5 secondes d'audio source, avec un support de tags paralinguistiques natifs (soupir, rire, toux) pour ajouter du réalisme vocal directement dans le texte source. Chaque fichier généré embarque un tatouage numérique PerTh, imperceptible à l'oreille, conçu pour survivre à une compression MP3 ou à un montage — la seule trace du passé "détection" de l'entreprise qui reste visible dans le produit voix lui-même.

Le modèle est disponible en un `pip install`, avec du code de référence documenté, et peut être déployé sur Hugging Face, RunPod, Modal, Replicate ou Fal — ou sur ta propre infrastructure GPU. La licence MIT autorise un usage personnel, de recherche et commercial, y compris dans un produit fermé, sous réserve des termes standards de la licence.

Clonage vocal temps réel en 2026 — qui héberge quoi
AVANT LE 13 AOÛT 2026 Resemble AI — API hébergée, pay-as-you-go dès $0,0005/sec Chatterbox Turbo tournait derrière l'API commerciale, 75ms de latence

DEPUIS LE 13 AOÛT 2026 — DEUX OPTIONS RESTANTES

ElevenLabs Flash v2.5 API hébergée, sub-second Abonnement dès $6/mois Zéro infra à gérer Pour qui veut un service géré sans toucher au GPU Chatterbox Turbo (self-host) Open-source MIT, 75ms latence Gratuit, infra GPU à ta charge Hugging Face / RunPod / Modal / Fal Pour qui veut le contrôle complet et a les compétences MLOps
Données : elevenlabs.io/pricing, resemble.ai (blog officiel 13/08/2026), GitHub resemble-ai/chatterbox. Vérifié 16 août 2026. Schéma éditorial Reflex IA.

Le compromis est réel et mérite d'être posé sans détour : Chatterbox Turbo demande de savoir déployer et maintenir un service d'inférence GPU, ce que l'API Resemble AI faisait auparavant à ta place contre facturation à l'usage. Pour une petite équipe sans compétence MLOps interne, c'est un vrai changement de charge de travail, pas juste un changement de facture. Pour une équipe qui a déjà l'infrastructure ou qui utilise un service d'inférence à la demande comme RunPod ou Fal, le coût final peut rester proche, voire inférieur, à ce que facturait Resemble AI — sans les à-coups de facturation et sans dépendre de la disponibilité commerciale d'un tiers.

"Le fait qu'un modèle aussi rapide soit publié sous MIT, sans contrepartie commerciale obligatoire, change la donne pour qui bricole des agents vocaux en side-project — c'est rare à ce niveau de performance." — synthèse de retours développeurs relevés sur les forums techniques autour de la sortie de Chatterbox Turbo, 2026.

Face à face : ElevenLabs vs Resemble AI sur les critères qui comptent

CritèreElevenLabsResemble AI
Accès pour un nouveau client (voix)Ouvert, inscription immédiateFermé depuis le 13/08/2026
Qualité vocale perçueRéférence du marché, G2 4,5/5 sur 1 140 avisSaluée mais échantillon d'avis très réduit (2 sur G2)
Latence temps réelSub-second (Flash v2.5)~75ms (Chatterbox Turbo), mais plus d'API commerciale hébergée pour un nouveau client
Palier d'entrée clonage commercial$6/mois (Starter, clonage instantané)N/A — inscriptions fermées
Modèle de coûtAbonnement + crédits, paliers fixesHistoriquement pay-as-you-go dès $0,0005/sec — plus disponible en souscription directe
Option self-host / open-sourceNon, cloud propriétaire uniquementChatterbox Turbo, MIT, gratuit, self-hostable
Programme d'affiliationOui, jusqu'à 22% récurrent sur 12 mois, cookie 90jAucun, avant comme après le pivot
Focus produit actuelVoix, TTS, doublage, musique, agents conversationnelsDétection de deepfakes (Detect, Watermarker, Identity, Signal, Intelligence)

Ce tableau se lit différemment selon la date à laquelle tu le croises. Comparé ligne à ligne début août 2026, il aurait donné un avantage net à Resemble AI sur trois critères sur huit — latence, option self-host, et un modèle de coût pay-as-you-go jugé plus prévisible à petit volume que le système de crédits ElevenLabs. Mi-août, ces trois avantages techniques restent vrais sur le papier, mais deux d'entre eux (latence et self-host) ne sont plus accessibles via un abonnement Resemble AI — ils ne survivent que dans la version open-source du même moteur. C'est le cœur du changement que ce comparatif documente : la technologie n'a pas régressé, c'est la voie d'accès commerciale qui a disparu pour tout nouveau projet.

Ce que produisent vraiment les créateurs et les développeurs

Le comparatif marché du 6 août recensait six usages dominants pour les outils voix IA : voix off publicitaire, livres audio et lecture de contenu, e-learning corporate, doublage multilingue, agents vocaux/IVR conversationnels, et podcasting avec clonage vocal personnel. Sur ce duel précis, deux de ces usages concentrent l'essentiel de la décision.

Créateurs et podcasters — le cas d'usage le plus courant pour du clonage vocal grand public — n'ont en pratique jamais eu besoin de latence à 75ms : correction de prise de son, remplacement d'un mot raté, génération de voix off asynchrone. Pour ce profil, la fermeture de Resemble AI ne change presque rien : ElevenLabs couvrait déjà l'essentiel de ce besoin, avec une meilleure fidélité perçue et un palier d'entrée à $6/mois pour démarrer en usage commercial. Le workflow type — enregistrer un brouillon, repérer les passages ratés, régénérer uniquement ces segments avec le clone — reste identique à ce qu'il était avant le pivot, la seule différence étant le fournisseur derrière l'opération. Un créateur qui découvre aujourd'hui l'existence de Resemble AI via un ancien article ou une recommandation datée n'a d'ailleurs aucune bonne raison de tenter l'inscription : le produit qu'il cherche à évaluer n'accepte plus de nouveaux comptes, quel que soit le volume ou le budget annoncé.

Développeurs qui construisent un agent vocal ou un produit avec dialogue live sont les seuls réellement touchés par le pivot. C'est précisément le profil pour lequel notre comparatif recommandait Resemble AI en priorité début août. Deux chemins restent ouverts aujourd'hui : payer un abonnement ElevenLabs et utiliser Flash v2.5 en API hébergée, ou déployer Chatterbox Turbo soi-même pour retrouver une latence quasi identique à ce que vendait Resemble AI, sans le service géré ni la facturation à l'usage qui allait avec.

Le moteur qui faisait la réputation temps réel de Resemble AI n'a pas disparu. C'est l'entreprise qui a arrêté de le vendre — pas le code qui a arrêté de fonctionner.

Si tu étais déjà client Resemble AI côté voix

Trois cas de figure concrets se dessinent pour qui avait un projet en cours ou en préparation sur Resemble AI avant le 13 août 2026. Premier cas : un compte déjà actif avec des voix clonées en production — le support reste assuré selon le billet officiel, donc pas d'urgence à migrer dans l'immédiat, mais il faut anticiper l'absence de nouvelles fonctionnalités voix côté produit commercial, puisque l'effort d'ingénierie de l'entreprise part désormais vers la détection. Deuxième cas : un projet en phase de devis ou de négociation Enterprise non finalisé — la fermeture s'applique, il n'y a plus de nouvelle signature possible sur la génération vocale, quel que soit le volume envisagé. Troisième cas, le plus fréquent probablement pour les lecteurs de cet article : un projet encore à l'état de recherche technique, où Resemble AI figurait sur la shortlist sans qu'aucun compte n'ait été ouvert — pour ce cas, la shortlist se réduit directement à ElevenLabs Flash v2.5 côté service géré, ou Chatterbox Turbo côté self-hosting.

Un troisième nom revient régulièrement dans les comparatifs techniques dès qu'il est question de latence pure pour des agents vocaux ou des phone bots : Cartesia, un fournisseur construit dès l'origine autour de la latence minimale, cité par plusieurs analyses comme souvent plus adapté qu'un généraliste de la voix pour ce cas d'usage précis. Il sort du périmètre strict de ce duel ElevenLabs / Resemble AI, mais mérite d'être gardé en tête si le critère n°1 du projet est la latence brute avant tout le reste — qualité expressive, clonage, ou couverture linguistique.

Un point technique à vérifier avant d'assembler un pipeline temps réel autour de Chatterbox Turbo : contrairement à un service géré, aucun SLA n'accompagne le modèle open-source. La disponibilité, la latence en production et la montée en charge dépendent entièrement de l'infrastructure choisie (Hugging Face, RunPod, Modal, Fal, ou serveur GPU dédié) — un facteur de risque à budgétiser en temps d'ingénierie, pas seulement en dollars, avant de remplacer une API commerciale disparue par un déploiement maison. À volume faible ou moyen (quelques centaines d'appels par jour), un service d'inférence à la demande comme Fal ou Replicate évite de gérer un GPU dédié en permanence et se rapproche le plus, en confort d'utilisation, de ce qu'offrait l'ancienne API Resemble AI. À fort volume, l'écart de coût entre inférence à la demande et GPU dédié loué au mois devient significatif — un calcul à faire projet par projet, pas un choix par défaut.

Quel outil pour quel profil en 2026

ProfilRecommandationPourquoi
Créateur YouTube / podcaster soloElevenLabs (Starter ou Creator)Qualité de référence, clonage commercial dès $6/mois, aucun besoin réel de latence sub-100ms
Équipe qui utilisait déjà Resemble AI en productionRester chez Resemble AILes clients existants sont maintenus — pas de migration forcée dans l'immédiat, mais anticiper l'absence de nouvelles fonctionnalités voix
Nouveau projet, agent vocal temps réel, équipe avec compétences GPU/MLOpsChatterbox Turbo (self-host)Même moteur que l'ex-API Resemble AI, gratuit sous licence MIT, contrôle complet de l'infra
Nouveau projet, agent vocal temps réel, sans équipe infra dédiéeElevenLabs Flash v2.5Seule API hébergée temps réel encore ouverte aux nouveaux clients dans ce duel, sub-second, zéro serveur à gérer
Créateur ou agence qui veut monétiser des recommandationsElevenLabsProgramme d'affiliation actif (jusqu'à 22% récurrent, 12 mois) — Resemble AI n'en a jamais eu, avant ou après le pivot
Produit orienté sécurité, authentification de contenu, anti-deepfakeResemble AI (nouveau positionnement)C'est littéralement devenu le métier principal de l'entreprise — Detect, Watermarker, Identity, Signal, Intelligence

Questions fréquentes

Peut-on encore s'inscrire chez Resemble AI pour du clonage vocal ?

Non, pas en tant que nouveau client depuis le 13 août 2026. L'entreprise a fermé les inscriptions sur la génération vocale pour recentrer son activité commerciale sur la détection de deepfakes. Les clients qui avaient déjà un compte actif avant cette date restent supportés.

Resemble AI a-t-il complètement arrêté la voix IA ?

Le produit commercial vendu à de nouveaux clients, oui. Les modèles eux-mêmes, non : Chatterbox et Chatterbox Turbo restent publiés en open source sous licence MIT sur GitHub, librement réutilisables y compris en production commerciale, à condition d'héberger soi-même l'inférence.

Quelle est l'alternative la plus proche de l'ancienne API Resemble AI ?

Chatterbox Turbo en self-hosting reproduit la même latence (environ 75ms) puisque c'est le même modèle qui faisait tourner l'API commerciale. La différence est l'infrastructure : plus de service géré, il faut déployer et maintenir soi-même l'inférence GPU sur Hugging Face, RunPod, Modal, Fal, ou un serveur dédié.

ElevenLabs peut-il faire du temps réel comme Resemble AI le faisait ?

Oui, via le modèle Flash v2.5, avec une latence sous la seconde documentée pour la conversation full-duplex — suffisant pour la majorité des agents vocaux. Ce n'est pas le modèle le plus expressif du catalogue (Eleven v3 ne supporte pas le temps réel), mais c'est la seule API hébergée de ce comparatif encore ouverte à de nouveaux clients pour un usage conversationnel live.

Quel est le vrai palier d'entrée pour du clonage vocal commercial chez ElevenLabs ?

$6/mois (plan Starter), pas $22 comme l'affichent de nombreux comparatifs. Le plan Starter inclut déjà la licence commerciale et le clonage vocal instantané. Le plan Creator à $22/mois n'est nécessaire que pour débloquer le Clonage Vocal Professionnel, avec une fidélité et une gamme émotionnelle supérieures.

Pourquoi Resemble AI est-il passé à la détection de deepfakes ?

Selon le CEO Zohaib Ahmed, l'entreprise a constaté que l'amélioration de la qualité des voix générées augmentait aussi le risque d'usage malveillant. Le H1 2026 Deepfake Threat Report de l'entreprise recense plus de 15 700 victimes sur six mois. Le pivot est adossé à une levée Series B de $13M en décembre 2025, menée par Sony et Okta Ventures.

Cartesia est-il une alternative à Resemble AI pour la latence ?

C'est le nom qui revient le plus souvent dans les comparatifs techniques dès qu'il s'agit de latence minimale pour un agent vocal ou un phone bot, cité par plusieurs analyses comme souvent mieux adapté qu'un généraliste de la voix sur ce critère précis. Il ne fait pas partie du duel ElevenLabs / Resemble AI traité dans cet article, mais mérite d'être ajouté à la shortlist de qui évalue des options temps réel après la fermeture des inscriptions Resemble AI.

Articles liés