HECHO PARA PROGRAMAR EN ESPACIOS COMPARTIDOS

Dicta tus prompts.
Sin audiencia.

Acerca el iPhone y mantén pulsado para hablar. Puedes bajar la voz: el Mac transcribe en local y coloca el texto justo donde ya está el cursor.

Una persona habla en voz baja al iPhone mientras el texto aparece en el Mac dentro de una oficina abierta

01 / UNA IDEA MUY SIMPLE

El Mac se queda en la mesa. El iPhone puede estar a pocos centímetros.

Desde lejos, el micrófono del MacBook recoge teclado, aire acondicionado y conversaciones junto con tu voz. Al acercarlo a la boca, tu voz llega primero y con más fuerza. Así puedes hablar más bajo sin pedirle al modelo que arregle una grabación deficiente.

IPHONE → MAC / ASÍ SE USA

Habla bajo al iPhone. El texto aparece en Codex.

El iPhone capta tu voz de cerca. El audio cifrado llega al Mac enlazado, se reconoce allí mismo y se inserta en el cursor activo.

Codex / Claude Codeslowmap / prototype
Creando preferencias de rutaScenicRouteRanker.swift
Crea un mapa de paseos que valore la sombra, el ruido y la pendiente en vez de elegir siempre el trayecto más rápido.
Pantalla clara de dictado de undervoice en un iPhone 17 Pro Max
EN TU MESA01
Una persona habla en voz baja al iPhone en su mesa

Un prompt no tiene por qué ser un discurso

Cuenta el cambio, el error o el caso límite en voz baja. El resto de la oficina no necesita enterarse.

AUDIO DE PROXIMIDAD02
Un iPhone situado cerca de la boca

Haz que tu voz llegue primero

Acercar el micro no silencia la oficina. Hace que tu voz destaque antes de que empiece el reconocimiento.

SIN ROMPER EL RITMO03

Sigue usando tus herramientas

El foco permanece en Codex, Claude Code, Xcode, Terminal o el navegador. La transcripción llega al cursor.

02 / LO QUE IMPORTA EN LA MESA

Cifras que explican la experiencia.

Esto es lo que cambia el día a día: la distancia al micrófono, adónde va el audio y cuántos pasos quedan después de hablar.

5–10 cm

Un micrófono realmente cerca

El iPhone puede estar a centímetros de tu boca mientras el MacBook sigue a 50–80 cm.

14–24 dB

Menos voz para el mismo nivel de entrada

Estimación basada solo en distancia. La sala, el ángulo y cada micrófono cambian el resultado real.

0 audio en nube

Sin pasar por un servicio de voz

El reconocimiento se ejecuta en el Mac. Con el modelo preparado, el uso local no necesita internet público.

0 archivos de audio

No quedan grabaciones que borrar

El audio se procesa en memoria y se descarta, sin archivos en el iPhone ni en el Mac.

0 copiar / pegar

El resultado llega a su sitio

Sin otra app, sin viajes por el portapapeles y sin perder el contexto.

1 hora

Historial local breve de serie

El historial del Mac conserva una hora por defecto y puede desactivarse por completo.

El límite es comprobable:solo dispositivos enlazados; sin subir audio ni crear grabaciones; la inserción para si cambia el foco; nada se escribe en contraseñas o campos seguros.

03 / MODELOS E IDIOMAS

Siete idiomas principales. Los tecnicismos en inglés entran tal cual.

undervoice usa paquetes ajustados por idioma en lugar de prometer que un único modelo sirve igual para todo. En español, alemán, francés, chino, japonés o coreano puedes decir nombres de librerías, variables y comandos en inglés con naturalidad. También hay un modo solo en inglés.

中文 + EnglishEnglish日本語 + EnglishDeutsch + EnglishFrançais + EnglishEspañol + English한국어 + English
ZH + ENLOCAL

Chino con términos en inglés

Un modelo bilingüe genera la vista previa; Paraformer o FireRedASR2 CTC produce el texto final y la puntuación en local.

Motor
sherpa-onnx
Optimización
INT8 ONNX
DISEÑADO PARA
vista rápida y cierre más preciso
EN / DE / FR / ESLOCAL

Cuatro paquetes europeos

NVIDIA Parakeet TDT 0.6B v3 impulsa los paquetes de inglés, alemán, francés y español ajustados para el producto.

Motor
sherpa-onnx
Optimización
INT8 ONNX
PRUEBA DEL MODELO BASE
WER medio del 6,34 %
JA + ENLOCAL

Japonés sin perder el inglés técnico

Kotoba Whisper Bilingual v1.0 se entrenó para japonés, inglés y el cambio natural entre ambos.

Motor
whisper.cpp
Optimización
Q5_0
PRUEBA DEL MODELO BASE
CER japonés del 9,3–16,8 %
KO + ENLOCAL

Coreano con nombres, órdenes y siglas

Whisper Large v3 Turbo cubre frases en coreano y el vocabulario técnico inglés que contienen, con tiempos razonables en local.

Motor
whisper.cpp
Optimización
Q5_0
ELEGIDO POR
cobertura multilingüe y velocidad local
Cómo leer las cifras de precisión

En WER y CER, menos es mejor. El 6,34 % y el 9,3–16,8 % proceden de pruebas publicadas de los modelos base completos. No son una nota global de undervoice con audio cercano del iPhone, modelos cuantizados e idiomas mezclados. Métricas y conjuntos distintos no forman una clasificación justa.

04 / IPHONE FRENTE AL MICRO DEL MACBOOK

Mejora la entrada antes de juzgar el modelo.

Ambas opciones pueden usar el mismo modelo local en el Mac. La diferencia está en el origen: a centímetros de la boca o al otro lado de la mesa.

En oficina compartidaiPhone cercaMicrófono del MacBook
Distancia boca–micro5–10 cm50–80 cm
Al hablar bajoTu voz llega primeroVoz, teclado, climatización y conversaciones llegan juntas
Volumen necesarioPuedes mantener la voz bajaA distancia suele tocar hablar más alto
Dónde se reconoceEn local, en tu MacEn local, en tu Mac
Ideal paraOficinas abiertas y mesas compartidasHabitaciones privadas o contenido no sensible

La estimación de 14–24 dB usa la relación de campo libre 20 × log10(r₂/r₁) para 5–10 cm frente a 50–80 cm. Los reflejos, la colocación y la dirección de la voz cambian el resultado.

05 / SEGURIDAD Y RED

La grabación va directa al Mac que elegiste.

undervoice no tiene un relé de voz. En la misma red, el iPhone conecta directamente con el Mac; entre redes, puedes usar tu propio Tailscale. La autenticación y el cifrado de la app siguen activos en ambos casos.

Instalación y permisos
PAIRED

Solo dispositivos enlazados

Compartir Wi-Fi no basta. Un iPhone nuevo debe enlazarse de forma explícita.

E2E

Cifrado antes de salir del iPhone

Audio, transcripciones y control se autentican y cifran de extremo a extremo.

ROTATE

Una clave nueva por conexión

Cada reconexión deriva una clave de sesión distinta.

RAM

El audio nunca se convierte en archivo

La grabación vive en memoria. Los diagnósticos no contienen audio ni texto transcrito.

0 CLOUD

Sin nube de voz de undervoice

En la red local, el audio va directo del iPhone al Mac y el modelo se ejecuta allí.

REMOTE

Tu propia red privada

Para otra Wi-Fi o datos móviles, usa tu Tailscale sin perder el cifrado de undervoice.

06 / ESCRIBE EN CUALQUIER PARTE

Donde esté el cursor, aparecerán las palabras.

CodexClaude CodeXcodeTerminalCualquier campo de texto

«Mantén la API pública, cambia los reintentos a espera exponencial y añade tres pruebas de casos límite.»

escuchando

Al empezar, el Mac recuerda la app y la selección activas. Si cambia el foco, la inserción se pausa. Los campos de contraseña y los controles con Secure Keyboard Entry nunca reciben texto.

undervoice

HABLA CON TU MAC, NO CON TODA LA SALA

Habla bajo. Programa sin fricción.

Instala el modelo en el Mac, escanea el código de enlace con el iPhone y mantén pulsado para hablar.