Intelligence artificielle

OpenAI coupe tts-1 et gpt-4o-mini-tts le 6 janvier 2027 : ce qui change pour vos voix de synthèse

OpenAI a annoncé le 1er octobre 2026 le retrait de ses modèles de synthèse vocale historiques. Le remplaçant désigné, gpt-realtime-2.1-mini, ne s'utilise pas de la même façon et coûte plus cher par jeton audio. Dates, prix et plan de migration.

Un vieux micro de studio débranché à côté d'un micro moderne éclairé sur une table de régie

OpenAI fait le ménage dans ses voix de synthèse. Depuis le 1er octobre 2026, sa page « Deprecations » annonce le retrait de tts-1, tts-1-hd et gpt-4o-mini-tts, avec une coupure fixée au 6 janvier 2027. Les clients de l'API ont reçu l'avis par e-mail. Si un de vos outils lit des articles à voix haute, génère des messages vocaux ou des podcasts automatiques avec ces modèles, il vous reste un peu plus de trois mois pour basculer. Pour le contexte, voir notre article sur le retrait de Claude Sonnet 4.5.

À retenir

  • tts-1, tts-1-hd et les deux versions de gpt-4o-mini-tts seront coupés le 6 janvier 2027.
  • Le remplaçant désigné pour les quatre est gpt-realtime-2.1-mini, un modèle de l'API Realtime.
  • Son audio en sortie coûte 20 $ le million de jetons, contre 12 $ pour gpt-4o-mini-tts : environ deux tiers de plus par jeton audio.
  • Le guide « Text to speech » d'OpenAI recommandait encore gpt-4o-mini-tts le 2 octobre 2026 : ne vous y fiez pas pour planifier.
  • Les modèles gpt-audio et apparentés, dépréciés en juillet, sont coupés le 20 janvier 2027.

Quels modèles sont retirés, et par quoi les remplacer ?

La page de dépréciations d'OpenAI indique : « The following text-to-speech models are deprecated and will be removed from the API on January 6, 2027, with at least three months' notice. » Le détail :

Modèle retiréRemplaçant désigné par OpenAICoupure
tts-1gpt-realtime-2.1-mini6 janvier 2027
tts-1-hdgpt-realtime-2.1-mini6 janvier 2027
gpt-4o-mini-tts-2025-03-20gpt-realtime-2.1-mini6 janvier 2027
gpt-4o-mini-tts-2025-12-15gpt-realtime-2.1-mini6 janvier 2027

Au-delà du 6 janvier 2027, les appels à ces identifiants échoueront. Pensez aussi aux outils tiers (extensions, plugins WordPress, automatisations no-code) qui utilisent votre clé API avec l'un de ces modèles sans que vous l'ayez choisi.

Le piège : le remplaçant ne fonctionne pas pareil

Les modèles retirés passent par un appel simple : on envoie un texte à l'endpoint /v1/audio/speech, on récupère un fichier audio. gpt-realtime-2.1-mini, lui, est un modèle de l'API Realtime, conçu pour les agents vocaux à faible latence, sorti en juillet 2026 selon MarkTechPost. Pour produire un simple fichier MP3 à partir d'un texte, il faudra donc revoir l'intégration, pas seulement changer le nom du modèle.

Détail révélateur : le 2 octobre 2026, le guide « Text to speech » d'OpenAI présentait encore gpt-4o-mini-tts comme « le modèle de synthèse vocale le plus récent et le plus fiable ». La documentation n'est pas encore alignée : surveillez sa mise à jour avant de coder la migration.

Changer le nom du modèle ne suffira pas : prévoyez du temps pour revoir l'intégration et réécouter le rendu.

Combien ça va coûter ?

D'après la grille tarifaire d'OpenAI :

Modèle (tarif public API)FacturationPrix
tts-1Par caractère de texte15 $ le million de caractères
tts-1-hdPar caractère de texte30 $ le million de caractères
gpt-4o-mini-ttsJetons texte en entrée, jetons audio en sortie0,60 $ / 12 $ le million de jetons
gpt-realtime-2.1-miniJetons texte en entrée, jetons audio en sortie0,60 $ / 20 $ le million de jetons

À texte en entrée égal (0,60 $ le million de jetons), la sortie audio passe de 12 $ à 20 $ le million de jetons entre gpt-4o-mini-tts et gpt-realtime-2.1-mini. Pour tts-1 et tts-1-hd, facturés au caractère, la comparaison dépend de la longueur de vos textes : faites le calcul sur un échantillon réel avant de basculer.

Check-list de migration

  • Inventorier : cherchez tts-1, tts-1-hd et gpt-4o-mini-tts dans vos dépôts, variables d'environnement et outils no-code.
  • Choisir la cible : gpt-realtime-2.1-mini (remplaçant officiel) ou un autre fournisseur de synthèse vocale si votre besoin se limite à produire des fichiers audio.
  • Adapter le code : l'API Realtime ne s'appelle pas comme l'endpoint de synthèse classique.
  • Réécouter : voix, débit, prononciation des noms propres et des chiffres sur vos textes réels.
  • Recalculer le coût sur un mois de production réelle.
  • Basculer avant Noël, pour garder une marge avant le 6 janvier.

Questions fréquentes

Quand tts-1 et gpt-4o-mini-tts seront-ils coupés ?
Le 6 janvier 2027, selon la page de dépréciations d'OpenAI. L'annonce date du 1er octobre 2026.
Quel modèle OpenAI remplace tts-1 et gpt-4o-mini-tts ?
OpenAI désigne gpt-realtime-2.1-mini pour les quatre modèles retirés : tts-1, tts-1-hd, gpt-4o-mini-tts-2025-03-20 et gpt-4o-mini-tts-2025-12-15.
Le remplaçant coûte-t-il plus cher ?
Par jeton audio, oui : 20 $ le million de jetons en sortie pour gpt-realtime-2.1-mini, contre 12 $ pour gpt-4o-mini-tts. Le texte en entrée reste à 0,60 $ le million de jetons.
Les modèles gpt-audio sont-ils aussi concernés ?
Oui, mais selon un autre calendrier : gpt-audio, gpt-4o-audio, gpt-audio-mini et gpt-4o-mini-audio, dépréciés le 20 juillet 2026, seront coupés le 20 janvier 2027, avec gpt-audio-1.5 comme remplaçant.

Sources

CS
Consultant SEO · fondateur de Cat's Eye Web

Écrit sur le SEO technique, l'IA et Google Discover à partir de tests terrain. Créateur de l'outil d'audit Cat's Eye. @ChrisWaoo

À lire ensuite