« Allô ? » Colle ton téléphone à ton oreille. Tu viens de faire tomber la barrière de la langue

Lecture : 8 minutes
Gemini 3.5 Live Translate
Gemini 3.5 Live Translate
Sommaire

« Allô… »

Prends ton téléphone. Colle-le contre ton oreille. Tu connais ce geste par cœur, tu le fais depuis vingt ans. Sauf qu’au bout du fil, cette fois, il n’y a personne. Pas d’interlocuteur. Juste une voix qui te traduit le monde, en direct, dans ta langue. C’est ça, l’avenir de la traduction selon Google. Pas un casque futuriste. Pas des lunettes connectées à 1500 euros. Juste toi, ton téléphone, et le geste le plus banal de ta vie.

Ce mardi 9 juin, Google a annoncé Gemini 3.5 Live Translate. Derrière ce nom à rallonge se cache un modèle audio de traduction vocale en quasi temps réel. Plus de 70 langues sont détectées automatiquement. Et surtout, une promesse : la voix traduite garde ton intonation, ton rythme, ta hauteur de voix. Ce n’est plus une voix de robot qui récite ta phrase. C’est presque toi, dans une autre langue. Surtout, ne raccroche pas. 

A retenir :

Gemini 3.5 Live Translate est le nouveau modèle audio de Google pour la traduction vocale speech-to-speech en quasi temps réel, couvrant plus de 70 langues.

La fin du talkie-walkie linguistique

Tu connais le problème des traducteurs vocaux actuels. Tu parles. Et puis tu attends. La machine réfléchit. La machine parle. L’autre répond. Tu attends encore. Une conversation au rythme d’un talkie-walkie. Épuisant au bout de trois phrases. Gemini 3.5 Live Translate fait l’inverse. Le modèle traduit en continu, pendant que tu parles. Il jongle en permanence entre deux impératifs contradictoires : attendre un peu de contexte pour traduire juste, et traduire vite pour rester synchronisé avec toi. Résultat annoncé par Google : un flux audio fluide, sans pauses gênantes, avec seulement quelques secondes de retard sur le locuteur. Comme un interprète de conférence. Sauf que l’interprète, c’est ton téléphone.

Et il encaisse le bruit. Le modèle est annoncé comme robuste aux environnements sonores chaotiques. Une gare, un marché, une rue. Les endroits, en somme, où tu as réellement besoin de te faire comprendre.

Le mode écoute, le vrai coup de génie

C’est le détail qui m’a fait lever un sourcil. Sur Android, Google déploie un « mode écoute » dans l’application Google Traduction. Le principe : tu tiens ton téléphone contre ton oreille, exactement comme pour un appel, et la traduction arrive directement dans l’écouteur interne. Discrètement. Sans haut-parleur qui hurle ta conversation à tout le wagon. Sans écouteurs que tu as évidemment oubliés à la maison.

L’exemple donné par Google : tu suis une visite guidée en espagnol, tu colles ton téléphone à l’oreille, et tu entends la traduction anglaise en quasi temps réel. Personne autour de toi ne remarque quoi que ce soit. Tu as juste l’air de quelqu’un au téléphone.

C’est ça, le génie. Pas de nouveau matériel à vendre. Pas de nouveau geste à apprendre. Google recycle le geste le plus universel de la téléphonie pour en faire un interprète de poche. Le mode écoute commence à se déployer sur Android. Le reste de la fonctionnalité Live arrive aussi sur iOS via l’app Google Traduction, avec n’importe quelle paire d’écouteurs.

Meet passe de 5 à 70 langues

Côté boulot, c’est Google Meet qui récupère le morceau. Jusqu’ici, la traduction vocale dans Meet plafonnait à cinq langues, et uniquement depuis ou vers l’anglais. Avec Gemini 3.5 Live Translate, on passe à plus de 70 langues et plus de 2000 combinaisons possibles dans une même réunion. Un Français, un Japonais et un Brésilien dans le même call, chacun parlant et entendant sa langue. Sans passer par la case anglais.

Un contenu de qualité, sans publicité.

Vous aimez notre travail ? Soutenez notre indépendance en devenant membre sur Patreon.

Soutenir MyChromebook.fr

Tempère ton enthousiasme : ça démarre en preview privée ce mois-ci, pour une sélection de clients Google Workspace business. Le déploiement plus large est promis pour plus tard dans l’année. Toi et moi, on attendra notre tour.

Et pour les développeurs

Le modèle est disponible dès aujourd’hui en preview publique via la Gemini Live API et dans Google AI Studio. Des plateformes comme Agora, LiveKit, Pipecat, Fishjam ou Vision Agents l’intègrent déjà pour permettre de construire des applications de traduction vocale sans se farcir l’infrastructure de streaming temps réel.

Premier client grandeur nature : Grab, le géant asiatique du VTC, qui teste le modèle pour faire discuter chauffeurs et voyageurs qui ne parlent pas la même langue. Plus de 10 millions d’appels vocaux par mois passent par leur plateforme. Bon terrain de jeu.

« Allô ? » Colle ton téléphone à ton oreille. Tu viens de faire tomber la barrière de la langue
Gemini 3.5 Live Translate

Le tatouage dans la voix

Un dernier détail, et pas le moindre. Tout l’audio généré par le modèle est marqué avec SynthID, le filigrane invisible de Google DeepMind, tissé directement dans le signal audio. Inaudible pour toi, détectable par les machines. L’idée : qu’une voix générée par IA reste identifiable comme telle, pour limiter la désinformation. Parce que oui, l’ami, réfléchis deux secondes. Un modèle capable de reproduire ton intonation, ton rythme et ta hauteur de voix dans 70 langues, c’est magnifique pour commander un ramen à Tokyo. C’est aussi exactement la technologie dont rêve n’importe quel escroc au faux appel. Google le sait. Le tatouage SynthID est là pour ça. Reste à voir qui prendra la peine de vérifier.

Vingt ans après les débuts de Google Traduction, plus de mille milliards de mots traduits chaque mois, et la barrière de la langue qui se réduit désormais à quelques secondes de latence dans ton oreille. Babel tombe. Et ça ne fait même pas de bruit. Tu peux raccrocher. 

FAQ Foire Aux Questions

Qu’est-ce que Gemini 3.5 Live Translate ?

C’est le nouveau modèle audio de Google qui traduit la voix en quasi temps réel dans plus de 70 langues, en conservant l’intonation, le rythme et la hauteur de voix du locuteur, avec seulement quelques secondes de décalage.

Comment fonctionne le mode écoute sur Android ?

Tu tiens ton téléphone contre ton oreille comme pour un appel classique et la traduction est diffusée directement dans l’écouteur interne, sans haut-parleur ni casque. Le déploiement démarre sur Android via l’application Google Traduction.

Quand la traduction arrive-t-elle dans Google Meet ?

La traduction vocale dopée à Gemini 3.5 Live Translate arrive ce mois-ci en preview privée pour une sélection de clients Google Workspace business, avec plus de 70 langues et 2000 combinaisons. Le déploiement élargi est prévu plus tard en 2026.

Comment savoir si une voix a été générée par l’IA de Google ?

Tout l’audio produit par le modèle est marqué avec SynthID, un filigrane inaudible tissé dans le signal audio, qui permet aux outils de détection d’identifier un contenu généré par IA.

NOUVEL ÉPISODE

CKB SHOW : Le Podcast

Rejoignez-nous chaque semaine pour décortiquer l'actualité Google, les dernières sorties Chromebook et les innovations en matière d'IA.

Miniature du podcast CKB SHOW
Avatar de l'auteur

À propos de Mister Robot

Entre un point X et un point Y, je me balade pas mal par l'entremise des bits composant ma mémoire. Un seul regret : ne pas avoir rencontré Mr Alan Mathison Turing et ainsi pouvoir collaborer pour l'article intitulé « Computing Machinery and Intelligence ».

Laisser un commentaire

À lire aussi