Ouvrir le menu principal

MacGeneration

Recherche

Mistral dévoile deux modèles de transcription multilingue, dont un en quasi-temps réel

Félix Cattafesta

jeudi 05 février 2026 à 10:54 • 23

Intelligence artificielle

L’IA générative aura grandement fait progresser les technologies de transcription. Si l’on parle souvent du Whisper d’OpenAI, Mistral a présenté aujourd’hui une famille de modèles pensés pour cet usage. L’un d’entre eux est spécifiquement pensé pour la transcription en temps réel.

Image Mistral

La famille se compose de deux modèles. Le premier est Voxtral Mini Transcribe V2, que l’on nous présente comme à la pointe et prenant en charge le découpage selon les intervenants, le biais contextuel ainsi qu’un horodatage au niveau des mots. Il fonctionne avec 13 langues, à savoir l'anglais, le chinois, l'hindi, l'espagnol, l'arabe, le français, le portugais, le russe, l'allemand, le japonais, le coréen, l'italien et le néerlandais. Plutôt pensé pour transcrire de gros lots de fichiers à la fois, il peut traiter des enregistrements jusqu’à 3 heures en une requête.

De son côté, Voxtral Realtime a été conçu spécialement pour la transcription en direct avec une latence configurable à moins de 200 ms, ce qui permet de s’en servir en temps réel. Selon Mistral, il surpasse GPT-4o mini Transcribe et Gemini 2.5 Flash. Prenant lui aussi en charge 13 langues, il est disponible en open-weights sous licence Apache 2.0 et peut être essayé dans Mistral Studio ou via le chatbot Le Chat.

Voxtral Realtime fait 4 milliards de paramètres et est donc suffisamment petit pour tourner sur un téléphone ou un ordinateur en local. Selon Mistral, ces deux nouveaux modèles sont à la fois moins coûteux à exploiter et moins sujets aux erreurs que les alternatives concurrentes.

Voxtral Mini Transcribe V2 est disponible via une API à 0,003 $ la minute, tandis que la variante temps réel est annoncée à 0,006 $ la minute. Cette dernière est intéressante : le dernier modèle du genre de Google a une latence d’environ 2 secondes. NVIDIA propose aussi Parakeet, un modèle ASR très performant en anglais sur GPU davantage pensé pour le traitement à grande échelle que pour la transcription multilingue.

Ajouter ce site dans Google News

iPhone 18 Pro Max : déjà jusqu’à un mois d’attente chez Apple, du stock chez Amazon

09:36

• 44


iOS 27 : faites travailler vos appareils Apple ensemble avec notre livre à 4,99 €

09:30

• 5


ChatGPT m'a aidé à récupérer 9 To de données, que je pensais avoir perdus après une coupure de courant

08:00

• 30


Et si Apple transformait le Mac mini en cerveau de la maison connectée ?

12/09/2026 à 19:56

• 10


Le nouveau score de récupération de l’Apple Watch repose sur une donnée dont Apple n'a pas testé la précision

12/09/2026 à 17:55

• 27


iPhone 18 Pro et Pro Max : des premières remises allant jusqu’à 200 €

12/09/2026 à 15:19

• 13


iPhone 18 Pro et Pro Max : les précommandes sont ouvertes, les délais s’allongent déjà 🆕

12/09/2026 à 14:01

• 121


iOS 27 : la correction automatique des mots de passe et les suggestions dans Messages attendront

12/09/2026 à 12:59

• 14


iOS 27 arrive le 14 septembre : les réglages de confidentialité à revoir (et ExpressVPN à -80 %) 📍

12/09/2026 à 12:59

• 0


MacBook Neo : jusqu’à 120 € sur la carte Carrefour, ou 100 € de remise chez Amazon

12/09/2026 à 12:58

• 2


Victime de son succès, GPT-6 Astra pousse OpenAI à fermer son offre ChatGPT Pro à 200 $

12/09/2026 à 11:47

• 24


Entre clins d’œil à Steve Jobs et piques sur la concurrence, le style John Ternus

12/09/2026 à 11:00

• 28


Précommandes des iPhone 18 à 14 heures : un Pro aujourd’hui ou un Duo en octobre ?

12/09/2026 à 08:44

• 73


iPhone 18 Pro : l’Apple Store baisse le rideau jusqu’à 14 heures

12/09/2026 à 08:44

• 25


La brosse à dents connectée de Dyson retirée temporairement des étals suite à un défaut de composants

12/09/2026 à 08:43

• 60


Sortie de veille : notre premier avis sur l’iPhone Duo et les autres nouveautés du keynote

12/09/2026 à 08:00

• 5