Plus besoin d’écouteurs : Google Traduction permet désormais de traduire une conversation en direct en plaçant simplement le téléphone près de l’oreille sur Android

Plus besoin d’écouteurs: Google fait évoluer une nouvelle fois son application Google Traduction avec une fonction particulièrement pratique pour les utilisateurs Android. Grâce au nouveau mode écoute, il devient possible d’entendre une traduction presque en temps réel directement dans l’écouteur du téléphone, sans avoir besoin de porter des écouteurs. Il suffit de rapprocher le smartphone de son oreille, comme pendant un appel classique.

Cette nouveauté s’appuie sur Gemini 3.5 Live Translate, le modèle audio de Google conçu pour traduire la parole d’une langue vers une autre. Google indique que cette technologie peut détecter plus de 70 langues et produire une traduction vocale continue, avec une attention particulière portée au rythme, à l’intonation et à la hauteur de la voix.

Google Traduction veut rendre les conversations plus naturelles

La traduction vocale classique fonctionne souvent de manière assez simple : une personne parle, le système attend la fin de la phrase, puis propose la traduction. Cette méthode peut fonctionner pour une demande courte, mais elle devient moins agréable lorsque la conversation est longue ou rapide.

Avec Gemini 3.5 Live Translate, Google cherche à réduire cette attente. Le modèle traite la parole au fur et à mesure et génère la traduction de façon continue. Selon Google, le système reste généralement seulement quelques secondes derrière la personne qui parle, afin de conserver un échange plus fluide.

L’objectif n’est donc pas seulement de traduire les mots. Google indique également que le modèle cherche à conserver certains éléments de la manière dont une personne parle, notamment son intonation, son rythme et sa hauteur de voix. Cela doit rendre le résultat plus naturel à écouter qu’une traduction vocale produite phrase après phrase.

Le mode écoute fonctionne directement avec le téléphone

La principale nouveauté pour les utilisateurs Android concerne le mode écoute de Google Traduction. Avec cette fonction, la traduction n’est plus obligatoirement envoyée vers des écouteurs connectés. Elle peut être diffusée directement dans l’écouteur interne du smartphone, celui que l’on utilise normalement pour téléphoner.

Le fonctionnement est assez simple. L’utilisateur lance la traduction en direct dans Google Traduction, puis porte le téléphone à son oreille. La personne en face continue de parler dans sa langue et le smartphone traite la conversation. La traduction est ensuite diffusée directement à l’utilisateur, sans passer par le haut-parleur principal.

Cette approche peut être intéressante lorsque l’on ne possède pas d’écouteurs ou lorsqu’on ne souhaite pas faire écouter la traduction aux personnes présentes autour de soi. Google présente notamment ce mode comme une solution pratique pour écouter rapidement une traduction dans des situations quotidiennes.

Une fonction pensée pour les voyages et les situations du quotidien

Pour les voyageurs, ce nouveau mode peut avoir plusieurs utilisations concrètes. Dans un hôtel, un restaurant, une gare ou un magasin, il peut être utile pour comprendre rapidement une personne qui parle une langue que l’on maîtrise peu.

Le téléphone peut également rester relativement discret pendant l’échange. Plutôt que de regarder constamment l’écran pour lire une traduction, l’utilisateur peut simplement écouter la réponse dans l’écouteur du smartphone. Le fonctionnement rappelle ainsi davantage une conversation téléphonique traditionnelle.

Google avait déjà lancé des fonctions de traduction en direct avec audio et affichage du texte. Depuis 2025, l’entreprise propose notamment des conversations traduites en temps réel dans plus de 70 langues sur Android et iOS, avec une détection des pauses, des accents et de l’intonation.

Plus de 70 langues grâce à Gemini 3.5 Live Translate

Le nouveau système de traduction repose sur Gemini 3.5 Live Translate. Google présente ce modèle comme une solution de traduction vocale « speech-to-speech », c’est-à-dire qu’il transforme directement la parole d’une langue en parole dans une autre langue, sans que l’utilisateur ait nécessairement besoin de passer par une transcription visible.

Le modèle est annoncé comme capable de détecter automatiquement plus de 70 langues. Google explique également qu’il est conçu pour fonctionner avec des conversations où plusieurs éléments peuvent se mélanger, comme les pauses, les changements de rythme ou les environnements relativement bruyants.

Cette prise en charge élargie est importante pour les voyageurs, mais aussi pour les personnes qui utilisent régulièrement plusieurs langues. Google cherche ainsi à transformer son application de traduction en un véritable outil de communication vocale, plutôt qu’en un simple dictionnaire numérique.

Google Meet profite aussi de cette technologie

Gemini 3.5 Live Translate ne concerne pas uniquement Google Traduction. Google prévoit également son intégration dans Google Meet, son service de visioconférence. La technologie doit permettre de traduire les conversations vocales pendant les réunions, avec une prise en charge annoncée de plus de 70 langues.

Google indique que cette évolution pourrait permettre plus de 2 000 combinaisons de langues au sein d’une même réunion. C’est une évolution importante par rapport au fonctionnement précédent, qui était davantage centré sur les traductions vers et depuis l’anglais.

Le déploiement de cette fonction dans Google Meet a commencé par une phase de test privé destinée à certains clients professionnels de Google Workspace. Google avait annoncé une disponibilité plus large par la suite, sans que tous les utilisateurs puissent nécessairement y accéder immédiatement.

Une technologie également ouverte aux développeurs

Google ne réserve pas non plus Gemini 3.5 Live Translate à ses propres applications. Le modèle est disponible en préversion publique pour les développeurs à travers Gemini Live API et Google AI Studio.

Cette ouverture permet à des entreprises et à des développeurs de tester la traduction vocale en direct dans leurs propres services. Cela pourrait concerner des applications de visioconférence, des outils d’apprentissage des langues ou encore des solutions d’assistance vocale.

Google explique que le modèle traite le son pendant qu’il est transmis, ce qui permet de construire des expériences où la traduction intervient presque immédiatement. Cette approche pourrait donc dépasser le simple cadre de Google Traduction dans les prochains mois.

Le son généré par l’IA reçoit un marquage SynthID

Google ajoute également une mesure destinée à faciliter l’identification des contenus audio générés par son IA. Les sons produits par les modèles concernés sont marqués avec SynthID, un filigrane numérique qui reste normalement imperceptible à l’oreille.

Selon Google, ce marquage est directement intégré au signal audio. Il doit permettre de détecter plus facilement qu’un contenu a été créé ou généré par une intelligence artificielle. L’objectif affiché est notamment de contribuer à limiter certains risques liés à la désinformation ou à l’utilisation trompeuse de contenus synthétiques.

Cette protection est particulièrement intéressante alors que les outils capables de produire une voix naturelle deviennent de plus en plus accessibles. Elle ne change pas directement l’utilisation de Google Traduction, mais elle accompagne le développement de cette nouvelle génération d’outils audio.

Google Traduction devient un interprète plus discret

Avec ce nouveau mode écoute sur Android, Google cherche surtout à rendre la traduction vocale plus simple à utiliser. L’utilisateur n’a plus forcément besoin de sortir des écouteurs, de regarder l’écran ou de tenir le téléphone devant son interlocuteur.

Le système reste toutefois dépendant de plusieurs facteurs. La qualité de la connexion, le bruit autour de l’utilisateur, les accents et les expressions locales peuvent influencer le résultat. Comme avec les autres systèmes de traduction automatique, une erreur reste possible, notamment dans une conversation complexe ou spécialisée.

Pour une discussion informelle, un voyage ou une situation où il faut simplement comprendre rapidement une personne, cette technologie peut néanmoins constituer une aide intéressante. Elle rapproche progressivement le smartphone d’un véritable interprète personnel capable de fonctionner presque en temps réel.

Une évolution importante pour la traduction sur smartphone

Avec Gemini 3.5 Live Translate, Google poursuit donc une évolution déjà engagée dans Google Traduction. Après la traduction de textes et les conversations vocales classiques, l’entreprise mise désormais sur une expérience plus continue et plus naturelle.

Le mode écoute de Google Traduction sur Android constitue probablement l’un des changements les plus simples à comprendre : il suffit de porter le téléphone à l’oreille pour écouter la traduction. Cette fonction peut être particulièrement utile aux voyageurs qui n’ont pas d’écouteurs à disposition ou qui souhaitent garder la traduction plus discrète.

À terme, la combinaison de la traduction vocale, de la transcription et des outils d’intelligence artificielle pourrait encore modifier notre façon de communiquer dans une langue étrangère. Pour l’instant, Google présente surtout Gemini 3.5 Live Translate comme un moyen de réduire les pauses et les obstacles entre deux langues, avec une traduction vocale disponible dans plus de 70 langues.

Disclaimer

Les informations présentées dans cet article reposent principalement sur les annonces officielles de Google concernant Gemini 3.5 Live Translate et les évolutions de Google Traduction. La disponibilité de certaines fonctions peut varier selon le pays, le système d’exploitation, le modèle de smartphone et le déploiement progressif de Google. Une traduction automatique peut également comporter des erreurs ; pour les échanges professionnels, juridiques, médicaux ou autres situations sensibles, une vérification humaine reste recommandée.

Leave a Comment