Aujourd'hui, nous lançons AI Dictation v2 — une application de reconnaissance vocale basée sur la pile multiplateforme AI Suite v2. Parlez et regardez les mots apparaître, capturez une réunion diffusée par votre ordinateur, ou importez un enregistrement — et obtenez un texte propre et modifiable. Le principe est simple : transformez la parole en texte sans envoyer votre voix dans le cloud.
Ce que ça fait
AI Dictation transcrit à partir de trois sources : votre microphone (dictez en direct et regardez le texte s'afficher en continu), l' audio de votre ordinateur (une réunion, une vidéo, un podcast diffusé sur votre PC), ou un fichier audio que vous possédez déjà. Avec le moteur gratuit embarqué, toute la transcription s'effectue sur votre machine — coupez le réseau et ça continue de fonctionner.
La première fois que vous enregistrez, l'application sélectionne et télécharge pour vous un modèle de reconnaissance vocale performant embarqué, puis sous-titre votre discours au fur et à mesure que vous parlez. Choisissez la langue parlée ou laissez-la détecter automatiquement, activez les horodatages quand vous en avez besoin, et sauvegardez le résultat en texte brut, en SubRip (.srt) ou WebVTT (.vtt) sous-titres pour légender une vidéo, ou au format JSON avec le minutage de chaque segment pour vos propres outils.
Nouveautés de la v2
- Trois façons de capturer. Microphone, audio système de votre ordinateur ou fichier — changez de source en un clic, avec un indicateur en temps réel qui montre que votre entrée est bien captée.
- Relecture et retranscription. Chaque enregistrement est sauvegardé, vous pouvez donc le réécouter avec un scrubbing sur la forme d’onde et voir chaque mot surligné au fur et à mesure. Relancez une transcription avec un modèle plus précis à tout moment — le nouveau résultat est enregistré comme une entrée distincte, l’original n’est jamais écrasé.
- Sous-titres et exportations propres. Exportez des sous-titres SubRip et WebVTT avec un minutage précis, du JSON pour vos outils, ou du texte brut. Un contrôle de nettoyage décide comment sont traités les sons non verbaux comme [Musique] ou (rires), avec la sortie brute du modèle accessible dans un panneau à part.
- Historique sous votre contrôle. Chaque transcription est sauvegardée localement et chiffrée au repos, prête à être rouverte, copiée ou poursuivie. Recherchez dans n’importe quelle transcription avec la fonction trouver — qui filtre aussi votre liste récente pour ne montrer que les enregistrements mentionnant ce que vous avez tapé.
- Votre choix de moteur. Commencez gratuitement avec un modèle Whisper embarqué. La version Pro débloque des modèles plus grands, le moteur cloud OpenAI, et un moteur local compatible GPU pour les audios les plus difficiles — avec des limites de sécurité GPU intégrées et une option de maintien des modèles chargés pour que les tâches répétées démarrent instantanément.
- En 16 langues. Toute l’interface suit la langue de votre système d’exploitation, avec un changement en un clic dans les Paramètres, et elle transcrit des dizaines de langues parlées.
- Scriptable. Un outil en ligne de commande sans interface graphique transcrit depuis le terminal et fait également office de serveur MCP, permettant aux agents IA et autres outils de l'appeler sur votre propre infrastructure.
Toutes les fonctionnalités sont gratuites
Comme pour le reste de la suite, aucune fonctionnalité n'est réservée à la version Pro. La dictée en direct, la transcription de l'audio système et des fichiers, l'exportation de sous-titres, la lecture, la retranscription, l'historique chiffré, la fonction recherche et l'outil en ligne de commande sont tous inclus dans l'application gratuite, avec un modèle performant embarqué et sans limite de temps ni fenêtres intrusives. La version Pro concerne simplement le choix du moteur — des modèles locaux plus volumineux, le moteur cloud OpenAI, et un moteur local accéléré par GPU lorsque vous souhaitez une précision accrue. Vous ne perdez jamais une fonctionnalité en restant sur la version gratuite.
Pourquoi le traitement embarqué est important
Interviews, réunions, notes médicales, dictée juridique — l'audio que les utilisateurs souhaitent le plus souvent transcrire est souvent celui qui ne peut pas être envoyé dans le cloud. AI Dictation apporte l'IA à vos enregistrements : rien ne quitte l'appareil avec le moteur embarqué, vos transcriptions et enregistrements sont chiffrés au repos, et il n'y a aucun frais de transcription à la minute. C'est le même principe sur site, axé sur la confidentialité, qui guide tout ce que Software Tailor développe [1].
Téléchargez-le
AI Dictation v2 est disponible dès maintenant sur le Microsoft Store pour Windows en téléchargement gratuit, avec une version Pro disponible si vous souhaitez les moteurs premium et cloud [2]. Des éditions pour macOS, Linux, navigateur et mobile sont prévues. Lisez la présentation complète des fonctionnalités sur la page produit.