PENSÉ POUR CODER EN ESPACE PARTAGÉ

Dictez vos prompts.
Pas à tout l’open space.

Approchez l’iPhone de votre bouche et maintenez pour parler. Vous gardez la voix basse ; votre Mac transcrit sur place et insère le texte là où se trouve déjà le curseur.

Un développeur parle doucement dans son iPhone pendant que le texte apparaît sur son Mac dans un open space

01 / UNE IDÉE TOUTE SIMPLE

Le Mac reste sur le bureau. L’iPhone vient à quelques centimètres.

À distance, le micro du MacBook entend votre clavier, la ventilation et les conversations en même temps que vous. Près de la bouche, votre voix arrive devant le reste. Vous pouvez donc parler moins fort, sans demander au modèle de réparer une mauvaise prise de son.

IPHONE → MAC / EN PRATIQUE

Parlez à voix basse. Le texte arrive dans Codex.

L’iPhone capte la voix de près. Le son chiffré rejoint le Mac associé, qui le transcrit localement puis l’insère au niveau du curseur actif.

Codex / Claude Codeslowmap / prototype
Création des préférences de parcoursScenicRouteRanker.swift
Crée une carte de promenades qui privilégie l’ombre, le calme et les pentes douces plutôt que le trajet le plus rapide.
L’écran de dictée clair d’undervoice sur un iPhone 17 Pro Max
À VOTRE BUREAU01
Une personne parle doucement dans son iPhone à son bureau

Un prompt n’est pas une annonce publique

Décrivez la modification, l’erreur ou le cas limite à voix basse. Vos voisins de bureau n’ont pas besoin d’en profiter.

PRISE DE SON RAPPROCHÉE02
Un iPhone tenu près de la bouche

Donnez l’avantage à votre voix

Le micro rapproché ne fait pas taire la pièce. Il place votre voix au premier plan avant même la reconnaissance.

SANS QUITTER LE FLOW03

Gardez vos outils

Restez dans Codex, Claude Code, Xcode, Terminal ou le navigateur. La transcription vient au curseur.

02 / CE QUI COMPTE VRAIMENT

Des chiffres utiles, pas une boîte noire.

Voici ce qui change concrètement la dictée au bureau : la distance du micro, le trajet du son et les manipulations qui restent à faire.

5–10 cm

Un micro vraiment proche

L’iPhone peut être à quelques centimètres ; le MacBook reste généralement à 50–80 cm.

14–24 dB

Moins de voix pour le même niveau reçu

Estimation fondée sur la seule distance. La pièce, l’angle et les micros font varier le résultat réel.

0 audio cloud

Aucun détour par un service vocal

La reconnaissance s’exécute sur votre Mac. Une fois le modèle prêt, le réseau public n’est plus nécessaire.

0 fichier audio

Aucun enregistrement à effacer

Le son est traité en mémoire puis libéré, sans fichier laissé sur l’iPhone ou le Mac.

0 copier-coller

Le résultat arrive au bon endroit

Pas d’app intermédiaire ni d’aller-retour par le presse-papiers.

1 heure

Un historique local volontairement court

Une heure par défaut sur Mac, avec la possibilité de le désactiver entièrement.

La limite est claire :appareils associés uniquement ; aucun envoi ni fichier audio ; arrêt si le focus change ; aucun texte dans les mots de passe ou les champs sécurisés.

03 / MODÈLES ET LANGUES

Sept langues principales. Le vocabulaire technique anglais suit.

undervoice préfère des packs adaptés à chaque langue à un modèle prétendument universel. En français, allemand, espagnol, chinois, japonais ou coréen, vous pouvez prononcer naturellement les noms de bibliothèques, variables et commandes en anglais. Un mode anglais dédié est aussi disponible.

中文 + EnglishEnglish日本語 + EnglishDeutsch + EnglishFrançais + EnglishEspañol + English한국어 + English
ZH + ENLOCAL

Chinois avec termes anglais

Un modèle bilingue assure l’aperçu en direct ; Paraformer ou FireRedASR2 CTC produit la version finale, ponctuation comprise, en local.

Moteur
sherpa-onnx
Optimisation
INT8 ONNX
OBJECTIF
aperçu rapide, passe finale plus précise
EN / DE / FR / ESLOCAL

Quatre packs européens

NVIDIA Parakeet TDT 0.6B v3 anime les packs anglais, allemand, français et espagnol réglés pour le produit.

Moteur
sherpa-onnx
Optimisation
INT8 ONNX
MESURE AMONT
WER moyen de 6,34 %
JA + ENLOCAL

Japonais sans perdre les termes anglais

Kotoba Whisper Bilingual v1.0 a été entraîné pour le japonais, l’anglais et le passage naturel de l’un à l’autre.

Moteur
whisper.cpp
Optimisation
Q5_0
MESURE AMONT
CER japonais de 9,3 à 16,8 %
KO + ENLOCAL

Coréen, noms et commandes compris

Whisper Large v3 Turbo couvre les phrases coréennes et leur vocabulaire technique anglais tout en restant praticable en local.

Moteur
whisper.cpp
Optimisation
Q5_0
CHOISI POUR
couverture multilingue et vitesse locale
Bien lire les chiffres de précision

Pour le WER et le CER, plus bas signifie meilleur. Les valeurs publiées de 6,34 % et 9,3–16,8 % viennent des jeux de test des modèles amont complets. Elles ne constituent pas un score global d’undervoice avec prise de son rapprochée, quantification et mélange de langues. Des jeux et métriques différents ne forment pas un classement honnête.

04 / IPHONE OU MICRO DU MACBOOK

Soignez d’abord la prise de son.

Les deux solutions peuvent utiliser le même modèle local sur Mac. La vraie différence se joue au départ : près de votre bouche ou de l’autre côté du bureau.

En espace partagéiPhone rapprochéMicro du MacBook
Distance bouche–micro5–10 cm50–80 cm
À voix basseVotre voix arrive en premierVoix, clavier, ventilation et conversations arrivent ensemble
Volume nécessaireVous pouvez rester discretIl faut souvent hausser la voix à cette distance
Lieu de reconnaissanceEn local sur votre MacEn local sur votre Mac
Cas idéalOpen space et bureau partagéPièce privée ou contenu non confidentiel

L’estimation de 14–24 dB utilise la relation en champ libre 20 × log10(r₂/r₁) pour 5–10 cm contre 50–80 cm. Réverbération, position et direction de la voix modifient le résultat.

05 / SÉCURITÉ ET RÉSEAU

L’enregistrement va directement au Mac que vous avez choisi.

undervoice n’exploite aucun relais vocal. Sur le même réseau, l’iPhone se connecte au Mac ; à distance, vous pouvez passer par votre propre réseau Tailscale. L’authentification et le chiffrement de l’app restent actifs dans les deux cas.

Installation et autorisations
PAIRED

Appareils associés uniquement

Être sur le même Wi-Fi ne suffit pas. Un nouvel iPhone doit être explicitement associé.

E2E

Chiffré dès l’iPhone

Son, transcription et commandes sont authentifiés et chiffrés de bout en bout.

ROTATE

Une nouvelle clé par connexion

Chaque reconnexion dérive une nouvelle clé de session.

RAM

Le son ne devient jamais un fichier

L’enregistrement reste en mémoire. Les diagnostics excluent le son et le texte transcrit.

0 CLOUD

Aucun cloud vocal undervoice

Sur le réseau local, le son va directement de l’iPhone au Mac, où le modèle s’exécute.

REMOTE

Votre réseau privé

Pour un autre Wi-Fi ou la 5G, utilisez votre propre Tailscale sans renoncer au chiffrement undervoice.

06 / ÉCRIRE PARTOUT

Le texte va là où se trouve le curseur.

CodexClaude CodeXcodeTerminalTout champ de texte

« Garde l’API publique, remplace les tentatives par un backoff exponentiel et ajoute trois tests de cas limites. »

écoute

Au début de la dictée, le Mac mémorise l’app et la sélection actives. Si le focus change, l’insertion s’interrompt. Les mots de passe et champs utilisant Secure Keyboard Entry restent toujours intacts.

undervoice

PARLEZ À VOTRE MAC, PAS À LA PIÈCE

Parlez doucement. Codez librement.

Installez le modèle sur Mac, scannez le code d’association avec l’iPhone, puis maintenez pour parler.