Sommaire
- A retenir :
- La fin du talkie-walkie linguistique
- Le mode écoute, le vrai coup de génie
- Meet passe de 5 à 70 langues
- Et pour les développeurs
- Le tatouage dans la voix
- FAQ Foire Aux Questions
- Qu’est-ce que Gemini 3.5 Live Translate ?
- Comment fonctionne le mode écoute sur Android ?
- Quand la traduction arrive-t-elle dans Google Meet ?
- Comment savoir si une voix a été générée par l’IA de Google ?
- Produits les plus vendus
- 100 trucs et astuces sur ChromeOS et Chromebook
- Chromebook le guide
- Guide de démarrage rapide pour Chromebook
- Partager :
« Allô… »
Prends ton téléphone. Colle-le contre ton oreille. Tu connais ce geste par cœur, tu le fais depuis vingt ans. Sauf qu’au bout du fil, cette fois, il n’y a personne. Pas d’interlocuteur. Juste une voix qui te traduit le monde, en direct, dans ta langue. C’est ça, l’avenir de la traduction selon Google. Pas un casque futuriste. Pas des lunettes connectées à 1500 euros. Juste toi, ton téléphone, et le geste le plus banal de ta vie.
Ce mardi 9 juin, Google a annoncé Gemini 3.5 Live Translate. Derrière ce nom à rallonge se cache un modèle audio de traduction vocale en quasi temps réel. Plus de 70 langues sont détectées automatiquement. Et surtout, une promesse : la voix traduite garde ton intonation, ton rythme, ta hauteur de voix. Ce n’est plus une voix de robot qui récite ta phrase. C’est presque toi, dans une autre langue. Surtout, ne raccroche pas.
A retenir :
Gemini 3.5 Live Translate est le nouveau modèle audio de Google pour la traduction vocale speech-to-speech en quasi temps réel, couvrant plus de 70 langues.
La fin du talkie-walkie linguistique
Tu connais le problème des traducteurs vocaux actuels. Tu parles. Et puis tu attends. La machine réfléchit. La machine parle. L’autre répond. Tu attends encore. Une conversation au rythme d’un talkie-walkie. Épuisant au bout de trois phrases. Gemini 3.5 Live Translate fait l’inverse. Le modèle traduit en continu, pendant que tu parles. Il jongle en permanence entre deux impératifs contradictoires : attendre un peu de contexte pour traduire juste, et traduire vite pour rester synchronisé avec toi. Résultat annoncé par Google : un flux audio fluide, sans pauses gênantes, avec seulement quelques secondes de retard sur le locuteur. Comme un interprète de conférence. Sauf que l’interprète, c’est ton téléphone.
Et il encaisse le bruit. Le modèle est annoncé comme robuste aux environnements sonores chaotiques. Une gare, un marché, une rue. Les endroits, en somme, où tu as réellement besoin de te faire comprendre.
Le mode écoute, le vrai coup de génie
C’est le détail qui m’a fait lever un sourcil. Sur Android, Google déploie un « mode écoute » dans l’application Google Traduction. Le principe : tu tiens ton téléphone contre ton oreille, exactement comme pour un appel, et la traduction arrive directement dans l’écouteur interne. Discrètement. Sans haut-parleur qui hurle ta conversation à tout le wagon. Sans écouteurs que tu as évidemment oubliés à la maison.
L’exemple donné par Google : tu suis une visite guidée en espagnol, tu colles ton téléphone à l’oreille, et tu entends la traduction anglaise en quasi temps réel. Personne autour de toi ne remarque quoi que ce soit. Tu as juste l’air de quelqu’un au téléphone.
C’est ça, le génie. Pas de nouveau matériel à vendre. Pas de nouveau geste à apprendre. Google recycle le geste le plus universel de la téléphonie pour en faire un interprète de poche. Le mode écoute commence à se déployer sur Android. Le reste de la fonctionnalité Live arrive aussi sur iOS via l’app Google Traduction, avec n’importe quelle paire d’écouteurs.
Meet passe de 5 à 70 langues
Côté boulot, c’est Google Meet qui récupère le morceau. Jusqu’ici, la traduction vocale dans Meet plafonnait à cinq langues, et uniquement depuis ou vers l’anglais. Avec Gemini 3.5 Live Translate, on passe à plus de 70 langues et plus de 2000 combinaisons possibles dans une même réunion. Un Français, un Japonais et un Brésilien dans le même call, chacun parlant et entendant sa langue. Sans passer par la case anglais.
Un contenu de qualité, sans publicité.
Vous aimez notre travail ? Soutenez notre indépendance en devenant membre sur Patreon.
Soutenir MyChromebook.frTempère ton enthousiasme : ça démarre en preview privée ce mois-ci, pour une sélection de clients Google Workspace business. Le déploiement plus large est promis pour plus tard dans l’année. Toi et moi, on attendra notre tour.
Et pour les développeurs
Le modèle est disponible dès aujourd’hui en preview publique via la Gemini Live API et dans Google AI Studio. Des plateformes comme Agora, LiveKit, Pipecat, Fishjam ou Vision Agents l’intègrent déjà pour permettre de construire des applications de traduction vocale sans se farcir l’infrastructure de streaming temps réel.
Premier client grandeur nature : Grab, le géant asiatique du VTC, qui teste le modèle pour faire discuter chauffeurs et voyageurs qui ne parlent pas la même langue. Plus de 10 millions d’appels vocaux par mois passent par leur plateforme. Bon terrain de jeu.
Le tatouage dans la voix
Un dernier détail, et pas le moindre. Tout l’audio généré par le modèle est marqué avec SynthID, le filigrane invisible de Google DeepMind, tissé directement dans le signal audio. Inaudible pour toi, détectable par les machines. L’idée : qu’une voix générée par IA reste identifiable comme telle, pour limiter la désinformation. Parce que oui, l’ami, réfléchis deux secondes. Un modèle capable de reproduire ton intonation, ton rythme et ta hauteur de voix dans 70 langues, c’est magnifique pour commander un ramen à Tokyo. C’est aussi exactement la technologie dont rêve n’importe quel escroc au faux appel. Google le sait. Le tatouage SynthID est là pour ça. Reste à voir qui prendra la peine de vérifier.
Vingt ans après les débuts de Google Traduction, plus de mille milliards de mots traduits chaque mois, et la barrière de la langue qui se réduit désormais à quelques secondes de latence dans ton oreille. Babel tombe. Et ça ne fait même pas de bruit. Tu peux raccrocher.
FAQ Foire Aux Questions
Qu’est-ce que Gemini 3.5 Live Translate ?
C’est le nouveau modèle audio de Google qui traduit la voix en quasi temps réel dans plus de 70 langues, en conservant l’intonation, le rythme et la hauteur de voix du locuteur, avec seulement quelques secondes de décalage.
Comment fonctionne le mode écoute sur Android ?
Tu tiens ton téléphone contre ton oreille comme pour un appel classique et la traduction est diffusée directement dans l’écouteur interne, sans haut-parleur ni casque. Le déploiement démarre sur Android via l’application Google Traduction.
Quand la traduction arrive-t-elle dans Google Meet ?
La traduction vocale dopée à Gemini 3.5 Live Translate arrive ce mois-ci en preview privée pour une sélection de clients Google Workspace business, avec plus de 70 langues et 2000 combinaisons. Le déploiement élargi est prévu plus tard en 2026.
Comment savoir si une voix a été générée par l’IA de Google ?
Tout l’audio produit par le modèle est marqué avec SynthID, un filigrane inaudible tissé dans le signal audio, qui permet aux outils de détection d’identifier un contenu généré par IA.




