
Un prompt n’est pas une annonce publique
Décrivez la modification, l’erreur ou le cas limite à voix basse. Vos voisins de bureau n’ont pas besoin d’en profiter.
PENSÉ POUR CODER EN ESPACE PARTAGÉ
Approchez l’iPhone de votre bouche et maintenez pour parler. Vous gardez la voix basse ; votre Mac transcrit sur place et insère le texte là où se trouve déjà le curseur.

01 / UNE IDÉE TOUTE SIMPLE
À distance, le micro du MacBook entend votre clavier, la ventilation et les conversations en même temps que vous. Près de la bouche, votre voix arrive devant le reste. Vous pouvez donc parler moins fort, sans demander au modèle de réparer une mauvaise prise de son.
IPHONE → MAC / EN PRATIQUE
L’iPhone capte la voix de près. Le son chiffré rejoint le Mac associé, qui le transcrit localement puis l’insère au niveau du curseur actif.
ScenicRouteRanker.swift

Décrivez la modification, l’erreur ou le cas limite à voix basse. Vos voisins de bureau n’ont pas besoin d’en profiter.

Le micro rapproché ne fait pas taire la pièce. Il place votre voix au premier plan avant même la reconnaissance.
Restez dans Codex, Claude Code, Xcode, Terminal ou le navigateur. La transcription vient au curseur.
02 / CE QUI COMPTE VRAIMENT
Voici ce qui change concrètement la dictée au bureau : la distance du micro, le trajet du son et les manipulations qui restent à faire.
L’iPhone peut être à quelques centimètres ; le MacBook reste généralement à 50–80 cm.
Estimation fondée sur la seule distance. La pièce, l’angle et les micros font varier le résultat réel.
La reconnaissance s’exécute sur votre Mac. Une fois le modèle prêt, le réseau public n’est plus nécessaire.
Le son est traité en mémoire puis libéré, sans fichier laissé sur l’iPhone ou le Mac.
Pas d’app intermédiaire ni d’aller-retour par le presse-papiers.
Une heure par défaut sur Mac, avec la possibilité de le désactiver entièrement.
03 / MODÈLES ET LANGUES
undervoice préfère des packs adaptés à chaque langue à un modèle prétendument universel. En français, allemand, espagnol, chinois, japonais ou coréen, vous pouvez prononcer naturellement les noms de bibliothèques, variables et commandes en anglais. Un mode anglais dédié est aussi disponible.
Un modèle bilingue assure l’aperçu en direct ; Paraformer ou FireRedASR2 CTC produit la version finale, ponctuation comprise, en local.
NVIDIA Parakeet TDT 0.6B v3 anime les packs anglais, allemand, français et espagnol réglés pour le produit.
Kotoba Whisper Bilingual v1.0 a été entraîné pour le japonais, l’anglais et le passage naturel de l’un à l’autre.
Whisper Large v3 Turbo couvre les phrases coréennes et leur vocabulaire technique anglais tout en restant praticable en local.
Pour le WER et le CER, plus bas signifie meilleur. Les valeurs publiées de 6,34 % et 9,3–16,8 % viennent des jeux de test des modèles amont complets. Elles ne constituent pas un score global d’undervoice avec prise de son rapprochée, quantification et mélange de langues. Des jeux et métriques différents ne forment pas un classement honnête.
04 / IPHONE OU MICRO DU MACBOOK
Les deux solutions peuvent utiliser le même modèle local sur Mac. La vraie différence se joue au départ : près de votre bouche ou de l’autre côté du bureau.
| En espace partagé | iPhone rapproché | Micro du MacBook |
|---|---|---|
| Distance bouche–micro | 5–10 cm | 50–80 cm |
| À voix basse | Votre voix arrive en premier | Voix, clavier, ventilation et conversations arrivent ensemble |
| Volume nécessaire | Vous pouvez rester discret | Il faut souvent hausser la voix à cette distance |
| Lieu de reconnaissance | En local sur votre Mac | En local sur votre Mac |
| Cas idéal | Open space et bureau partagé | Pièce privée ou contenu non confidentiel |
L’estimation de 14–24 dB utilise la relation en champ libre 20 × log10(r₂/r₁) pour 5–10 cm contre 50–80 cm. Réverbération, position et direction de la voix modifient le résultat.
05 / SÉCURITÉ ET RÉSEAU
undervoice n’exploite aucun relais vocal. Sur le même réseau, l’iPhone se connecte au Mac ; à distance, vous pouvez passer par votre propre réseau Tailscale. L’authentification et le chiffrement de l’app restent actifs dans les deux cas.
Installation et autorisations →Être sur le même Wi-Fi ne suffit pas. Un nouvel iPhone doit être explicitement associé.
Son, transcription et commandes sont authentifiés et chiffrés de bout en bout.
Chaque reconnexion dérive une nouvelle clé de session.
L’enregistrement reste en mémoire. Les diagnostics excluent le son et le texte transcrit.
Sur le réseau local, le son va directement de l’iPhone au Mac, où le modèle s’exécute.
Pour un autre Wi-Fi ou la 5G, utilisez votre propre Tailscale sans renoncer au chiffrement undervoice.
06 / ÉCRIRE PARTOUT
« Garde l’API publique, remplace les tentatives par un backoff exponentiel et ajoute trois tests de cas limites. »
écouteAu début de la dictée, le Mac mémorise l’app et la sélection actives. Si le focus change, l’insertion s’interrompt. Les mots de passe et champs utilisant Secure Keyboard Entry restent toujours intacts.
PARLEZ À VOTRE MAC, PAS À LA PIÈCE
Installez le modèle sur Mac, scannez le code d’association avec l’iPhone, puis maintenez pour parler.