MadoHub Docs

Saisie vocale

Dictez dans MadoHub avec une reconnaissance vocale on-device — votre audio ne quitte jamais la machine.

La saisie vocale vous permet de dicter au lieu de taper. Maintenez une touche, parlez, relâchez — la transcription arrive où vous l'avez dictée. Tout le pipeline s'exécute localement : capture audio, rééchantillonnage et transcription se font tous sur votre machine, sans aucun appel réseau entre les deux.

Si vous avez déjà dicté dans une API vocale cloud et vous êtes demandé où cet audio finissait, c'est l'autre design. Votre voix est captée, transcrite par un modèle Whisper local, et écrite dans MadoHub — tout dans le même processus, sur votre machine. Rien de l'audio ni de la transcription n'est uploadé.

Ce que vous pouvez faire

  • Dictée push-to-talk — maintenez une touche, parlez, relâchez pour transcrire.
  • Relancer le dernier enregistrement — ré-exécutez la transcription sur le même audio capturé sans parler à nouveau, utile lorsque la première passe vous a mal entendu.
  • Router la transcription vers une des trois destinations — vers l'entrée de chat MadoAgent, vers le terminal focalisé sans soumission, ou vers le terminal focalisé avec soumission immédiate.
  • Changer de destination à la volée — modifiez où la dictée atterrit depuis la palette de commandes sans ouvrir les Paramètres.
  • Choisir une taille de modèle — de tiny (~75 Mo) jusqu'à medium (~1,5 Go) ; les modèles plus grands sont plus précis mais plus lents et plus lourds à télécharger.
  • Épingler une langue ou auto-détecter — anglais, chinois, japonais, coréen, espagnol, français, allemand, ou auto.

Comment l'utiliser

  1. Activez la saisie vocale depuis Paramètres → Voix, ou depuis la palette de commandes (Cmd+Shift+P) via l'entrée Enable Voice Input (repérable par « voice », « dictation », « push-to-talk » ou « 语音 »).
  2. Si vous n'avez pas encore téléchargé de modèle Whisper, MadoHub ouvre les Paramètres sur l'onglet Voix avec un toast vous indiquant quoi télécharger — il n'enregistrera pas dans le vide.
  3. Maintenez Cmd+Shift+V (la touche push-to-talk par défaut) pour enregistrer, et relâchez pour arrêter et transcrire.
  4. Pressez Cmd+Shift+R pour relancer le dernier enregistrement si la première passe vous a mal entendu. La relance ne fonctionne que dans les 30 secondes suivant une transcription réussie et seulement si vous n'avez pas démarré un nouvel enregistrement depuis.
  5. Choisissez où les transcriptions atterrissent dans Paramètres → Voix, ou changez de destination à la volée depuis la palette de commandes.
DestinationComportement
Agent (par défaut)Rédigée dans l'entrée de chat MadoAgent, qui s'ouvre automatiquement pour que vous la voyiez atterrir. Vous revoyez, éditez, et pressez Entrée vous-même.
Terminal — insertÉcrite dans le tile de terminal actuellement focalisé sans soumission. Les sauts de ligne sont réduits en espaces afin de ne pas s'auto-soumettre dans un shell.
Terminal — autoÉcrite dans le tile de terminal focalisé et soumise immédiatement.

Les deux destinations terminal se verrouillent sur le tile de terminal qui était focalisé lorsque vous avez démarré l'enregistrement — un changement de focus en cours d'enregistrement ne peut pas mal router la transcription. Si aucun terminal n'était focalisé (ou si le tile s'est fermé avant que vous ayez fini de parler), MadoHub se rabat sur la destination Agent et affiche un toast expliquant pourquoi.

Cas d'usage courants

  • « Refactore le module auth pour utiliser une classe, ajoute des tests pour le flux de login. » — dictez un long prompt dans MadoAgent tout en réfléchissant au code, puis revoyez et envoyez.
  • Lancer une commande shell rapide sans taper — réglez la destination sur Terminal — auto et dictez git status ou pnpm test.
  • Dictée CJK — épinglez la langue sur chinois/japonais/coréen pour une meilleure précision sur les utterances courtes, puisque l'auto-détection de Whisper peut se tromper sur des clips CJK silencieux ou très courts.

Conseils et bonnes pratiques

  • Commencez avec le modèle small (le défaut) pour un bon compromis précision/taille. Passez à medium uniquement si vous dictez souvent et avez besoin de la précision supplémentaire.
  • Épinglez une langue lorsque vous savez ce que vous parlez — cela évite les erreurs d'auto-détection sur les clips courts ou silencieux.
  • Rebind les touches push-to-talk et relance dans les Paramètres si elles entrent en collision avec des raccourcis que vous utilisez déjà ; les Paramètres vous avertissent des conflits.
  • Utilisez Terminal — insert plutôt que Terminal — auto lorsque vous dictez une entrée multi-lignes, afin de pouvoir relire avant de soumettre.

Fonctionnalités associées

  • Palette de commandes — basculez la saisie vocale et changez de destination depuis ici.
  • Paramètres — l'onglet Voix où vous configurez le modèle, la langue, les touches et la destination.
  • MadoAgent — la destination de dictée par défaut.

Limitations

  • La saisie vocale est livrée désactivée par défaut ; activez-la avant la première utilisation.
  • La relance ne fonctionne que dans les 30 secondes suivant une transcription réussie, et seulement si vous n'avez pas démarré un nouvel enregistrement depuis.
  • Les destinations terminal nécessitent un tile de terminal en direct focalisé au moment où vous démarrez l'enregistrement. Sinon, MadoHub se rabat sur la destination Agent.
  • Un modèle doit être téléchargé avant l'enregistrement ; MadoHub n'enregistrera pas dans le vide.

On this page