Ouvrir le menu principal

MacGeneration

Recherche

Mistral dévoile deux modèles de transcription multilingue, dont un en quasi-temps réel

Félix Cattafesta

jeudi 05 février 2026 à 10:54 • 23

Intelligence artificielle

L’IA générative aura grandement fait progresser les technologies de transcription. Si l’on parle souvent du Whisper d’OpenAI, Mistral a présenté aujourd’hui une famille de modèles pensés pour cet usage. L’un d’entre eux est spécifiquement pensé pour la transcription en temps réel.

Image Mistral

La famille se compose de deux modèles. Le premier est Voxtral Mini Transcribe V2, que l’on nous présente comme à la pointe et prenant en charge le découpage selon les intervenants, le biais contextuel ainsi qu’un horodatage au niveau des mots. Il fonctionne avec 13 langues, à savoir l'anglais, le chinois, l'hindi, l'espagnol, l'arabe, le français, le portugais, le russe, l'allemand, le japonais, le coréen, l'italien et le néerlandais. Plutôt pensé pour transcrire de gros lots de fichiers à la fois, il peut traiter des enregistrements jusqu’à 3 heures en une requête.

De son côté, Voxtral Realtime a été conçu spécialement pour la transcription en direct avec une latence configurable à moins de 200 ms, ce qui permet de s’en servir en temps réel. Selon Mistral, il surpasse GPT-4o mini Transcribe et Gemini 2.5 Flash. Prenant lui aussi en charge 13 langues, il est disponible en open-weights sous licence Apache 2.0 et peut être essayé dans Mistral Studio ou via le chatbot Le Chat.

Voxtral Realtime fait 4 milliards de paramètres et est donc suffisamment petit pour tourner sur un téléphone ou un ordinateur en local. Selon Mistral, ces deux nouveaux modèles sont à la fois moins coûteux à exploiter et moins sujets aux erreurs que les alternatives concurrentes.

Voxtral Mini Transcribe V2 est disponible via une API à 0,003 $ la minute, tandis que la variante temps réel est annoncée à 0,006 $ la minute. Cette dernière est intéressante : le dernier modèle du genre de Google a une latence d’environ 2 secondes. NVIDIA propose aussi Parakeet, un modèle ASR très performant en anglais sur GPU davantage pensé pour le traitement à grande échelle que pour la transcription multilingue.

Ajouter ce site dans Google News

iPhone 18 Pro et Pro Max : des premières remises allant jusqu’à 200 €

15:19

• 4


iPhone 18 Pro et Pro Max : les précommandes sont ouvertes, les délais s’allongent déjà 🆕

14:01

• 40


iOS 27 : la correction automatique des mots de passe et les suggestions dans Messages attendront

12:59

• 13


iOS 27 arrive le 14 septembre : les réglages de confidentialité à revoir (et ExpressVPN à -80 %) 📍

12:59

• 0


MacBook Neo : jusqu’à 120 € sur la carte Carrefour, ou 100 € de remise chez Amazon

12:58

• 1


Victime de son succès, GPT-6 Astra pousse OpenAI à fermer son offre ChatGPT Pro à 200 $

11:47

• 7


Entre clins d’œil à Steve Jobs et piques sur la concurrence, le style John Ternus

11:00

• 19


Précommandes des iPhone 18 à 14 heures : un Pro aujourd’hui ou un Duo en octobre ?

08:44

• 66


iPhone 18 Pro : l’Apple Store baisse le rideau jusqu’à 14 heures

08:44

• 24


La brosse à dents connectée de Dyson retirée temporairement des étals suite à un défaut de composants

08:43

• 54


Sortie de veille : notre premier avis sur l’iPhone Duo et les autres nouveautés du keynote

08:00

• 4


Bon plan : Anker offre un deuxième produit pour l'achat de certains chargeurs

11/09/2026 à 23:36

• 1


iOS 27, iPadOS 27, macOS 27 : découvrez notre nouveau livre !

11/09/2026 à 22:55

• 21


Samsung s’offre un faux Tim Cook pour se moquer de l'iPhone Duo

11/09/2026 à 22:11

• 81


Mais où est passé l’iPhone 18 standard ?

11/09/2026 à 22:11

• 27


Anthropic le consigne dans un rapport : Claude aurait déjà été détourné pour des recherches sur les armes biologiques

11/09/2026 à 21:30

• 51