DeepL Voice restitue désormais votre voix lors des conversations multilingues en temps réel
- De nouveaux modèles d'IA vocale et de nouvelles fonctionnalités permettent de restituer davantage le ton, les émotions et les expressions propres à chaque locuteur, tout en assurant une traduction en temps réel à faible latence.
- DeepL dévoile également une nouvelle application de bureau pour faciliter les réunions multilingues en ligne, tandis que la traduction de voix à voix est désormais disponible dans plus de 30 langues.
- DeepL Voice poursuit son déploiement rapide auprès des entreprises et lors d'événements en direct, et assurera notamment la traduction en temps réel sur les 50 scènes de Salesforce Dreamforce 2026.
PARIS, 15 septembre 2026 /PRNewswire/ -- DeepL, leader de l'IA linguistique, annonce aujourd'hui des avancées majeures pour sa technologie d'IA vocale. DeepL Voice s'est déjà distingué par la précision de ses traductions, se classant n° 1 dans l'évaluation indépendante menée par Slator sur les sous-titres traduits par IA. Aujourd'hui, ses nouveaux modèles vocaux vont encore plus loin en restituant non seulement ce que les utilisateurs disent, mais aussi la manière dont ils le disent. Les utilisateurs de Zoom, Microsoft Teams et Google Meet peuvent désormais échanger en temps réel dans différentes langues avec DeepL Voice, tout en conservant les caractéristiques de leur voix, leur intonation et leur rythme, pour des conversations multilingues beaucoup plus naturelles.
« La voix est au cœur de notre manière de nous exprimer et véhicule bien plus que de simples mots », déclare Jarek Kutylowski, PDG et fondateur de DeepL. « Avec les dernières avancées de DeepL Voice, nous allons au-delà des simples sous-titres pour proposer une expérience audio qui préserve en temps réel l'identité vocale, les émotions et le rythme de chacun. Nous avons développé des modèles qui vous font oublier que vous communiquez par l'intermédiaire d'une IA, pour que la technologie s'efface au profit d'une expérience vocale naturelle. Ces modèles permettent de restituer toute la dimension humaine des conversations multilingues en temps réel. »
En parallèle, DeepL lance une nouvelle application de bureau dédiée à Voice, qui offre une expérience de traduction unifiée sur les différentes plateformes de visioconférence, sans nécessiter d'intégration supplémentaire. La traduction de voix à voix est désormais disponible pour les réunions en ligne, les conversations en présentiel ainsi que via l'API DeepL.
Les nouveautés de DeepL Voice
La traduction vocale en temps réel a considérablement progressé en matière de rapidité et de précision. Le prochain défi consiste à préserver les caractéristiques propres à chaque voix : ces nuances vocales subtiles qui distinguent une personne d'une autre et jouent un rôle essentiel dans la compréhension du langage parlé. Grâce à ses nouveaux modèles, DeepL Voice restitue davantage cette dimension humaine d'une langue à l'autre, en préservant le ton, le rythme, la cadence et l'intonation. Les conversations multilingues gagnent ainsi en naturel et reflètent plus fidèlement la personnalité de celles et ceux qui s'expriment.
Les derniers modèles d'IA vocale de DeepL proposent notamment :
- Une préservation de la voix : la voix de chaque personne reste distincte et reconnaissable dans les 14 langues prises en charge, y compris lorsque plusieurs participants sont traduits simultanément.
- L'expression naturelle : une question conserve son intonation interrogative, tandis que l'hésitation, l'urgence ou encore l'enthousiasme sont restitués dans la traduction.
- Une faible latence : les modèles maintiennent la fluidité d'une conversation en temps réel tout en préservant davantage d'informations contextuelles et de nuances propres à la parole.
- La prise en charge linguistique étendue : la traduction de voix à voix est désormais disponible dans plus de 30 langues.
« Pour y parvenir, nous avons dû relever simultanément plusieurs défis techniques complexes : préserver l'identité vocale de chaque personne tout en maintenant la qualité de la traduction et une faible latence », explique Sebastian Enderlein, directeur technique de DeepL. « Il s'agit d'une avancée technique majeure pour DeepL Voice, qui établit un nouveau niveau d'exigence en matière de communication multilingue. Elle ouvre également de nouvelles perspectives pour les entreprises, qu'il s'agisse de leurs modes de fonctionnement, de leurs interactions avec leurs clients ou encore des produits et expériences multilingues qu'elles peuvent développer, sans compter les cas d'usage que nous n'avons pas encore imaginés. »
DeepL dévoile également sa nouvelle application de bureau Voice, disponible sur Windows et Mac, qui offre une expérience de traduction homogène pour les réunions en ligne.
L'application DeepL Voice fonctionne aux côtés des principales plateformes de visioconférence, notamment Zoom, Microsoft Teams et Google Meet. Elle détecte automatiquement les appels et affiche en permanence une fenêtre superposée avec les sous-titres traduits en temps réel. Les utilisateurs peuvent ainsi suivre les sous-titres tout en présentant un contenu ou en prenant des notes, passer à la traduction de voix à voix lorsqu'ils préfèrent écouter plutôt que lire, ou encore ajuster la taille des sous-titres, le niveau sonore de l'audio d'origine et les paramètres de traduction. L'application leur permet également de bénéficier des nouvelles fonctionnalités de DeepL Voice dès leur déploiement, sans dépendre du calendrier de mise à jour propre à chaque plateforme.
La traduction vocale en temps réel se déploie dans les entreprises et lors d'événements en direct
Ces nouveautés interviennent alors que la demande pour DeepL Voice ne cesse de croître dans de nombreux secteurs et pour une grande variété de cas d'usage. Des entreprises des secteurs de l'industrie manufacturière, du commerce de détail, des sciences de la vie, des services professionnels et bien d'autres utilisent DeepL Voice pour faciliter la collaboration multilingue entre leurs équipes internationales, leurs clients et leurs partenaires. Elles peuvent ainsi collaborer plus facilement au-delà des barrières linguistiques, gagner en productivité, mieux fédérer des équipes internationales et se développer plus rapidement sur de nouveaux marchés.
Grâce à l'API DeepL Voice, les développeurs peuvent également intégrer l'IA vocale en temps réel à des centres de contact, des outils de visioconférence, des applications destinées aux équipes de terrain ou encore des produits développés sur mesure.
Cette demande s'étend également aux événements et expériences à grande échelle. DeepL est partenaire IA vocale de Salesforce Dreamforce 2026, qui se tiendra du 15 au 17 septembre à San Francisco. À cette occasion, sa technologie assurera la traduction en temps réel sur les 50 scènes de l'événement et pendant plus de 1 000 sessions. L'entreprise présentera également sur son stand ses dernières innovations DeepL Voice, notamment la traduction de voix à voix, la préservation de la voix et la restitution améliorée des expressions.
Pour en savoir plus et essayer DeepL Voice, rendez-vous sur: https://www.deepl.com/fr/products/voice
À propos de DeepL
DeepL est une entreprise mondiale spécialisée dans l'IA qui développe l'infrastructure linguistique au service des entreprises internationales. Plus de 200 000 équipes professionnelles et des millions de particuliers utilisent la plateforme d'IA linguistique de DeepL pour communiquer à l'échelle mondiale, collaborer et travailler en temps réel dans différentes langues. En combinant des modèles d'IA révolutionnaires avec une sécurité et une confidentialité de niveau entreprise, DeepL permet aux organisations de travailler en toute fluidité sur différents marchés et dans différentes cultures. Fondée en 2017 par son PDG Jarek Kutylowski, DeepL compte aujourd'hui plus de 900 employés et bénéficie du soutien d'investisseurs de premier plan, notamment Benchmark, IVP et Index Ventures. Pour en savoir plus, rendez-vous sur www.deepl.com.
Partager cet article