
프롬프트를 사무실 전체에 말하지 마세요
수정 방향, 오류, 예외 조건을 작은 목소리로 설명하면 됩니다. 주변 사람이 대화에 참여할 필요는 없습니다.
공유 오피스에서 코딩하는 사람을 위해
iPhone을 입 가까이 들고 누른 채 말하세요. 목소리를 높이지 않아도 됩니다. Mac이 기기 안에서 텍스트로 바꾸고 커서가 있는 곳에 곧바로 입력합니다.

01 / 단순한 원리
멀리 있는 MacBook 마이크에는 내 목소리와 키보드, 냉난방 소리, 주변 대화가 함께 들어갑니다. 마이크를 입 가까이 가져오면 인식 전에 내 목소리부터 더 크게 담깁니다. 모델로 나쁜 입력을 보정하기 전에 입력 자체를 좋게 만드는 방식입니다.
IPHONE → MAC / 실제 사용 흐름
iPhone은 가까이서 소리를 받습니다. 암호화된 오디오는 페어링한 Mac으로 전달되고, Mac 안에서 인식된 뒤 활성 커서에 바로 입력됩니다.
ScenicRouteRanker.swift

수정 방향, 오류, 예외 조건을 작은 목소리로 설명하면 됩니다. 주변 사람이 대화에 참여할 필요는 없습니다.

근접 수음이 사무실을 조용하게 만들지는 않습니다. 대신 인식이 시작되기 전에 내 목소리가 주변 소리보다 두드러지게 합니다.
Codex, Claude Code, Xcode, Terminal, 브라우저에 그대로 머무세요. 텍스트가 현재 커서로 들어옵니다.
02 / 책상에서 중요한 숫자
얼마나 작게 말할 수 있는지, 오디오가 어디로 가는지, 말한 뒤에 별도 작업이 필요한지에 답하는 수치입니다.
iPhone은 입 가까이 가져오고 MacBook은 50–80 cm 떨어진 책상 위에 그대로 둘 수 있습니다.
5–10 cm와 50–80 cm의 거리만으로 계산한 추정치입니다. 공간, 방향, 마이크에 따라 실제 결과는 달라집니다.
인식은 Mac에서 실행됩니다. 모델 준비 후 로컬 사용에는 공용 인터넷이 필요 없습니다.
오디오는 메모리에서 처리한 뒤 해제하며 iPhone이나 Mac에 녹음으로 남기지 않습니다.
다른 앱을 열거나 복사해 돌아올 필요 없이 현재 입력란에 바로 들어갑니다.
Mac 기록은 완전히 끌 수도 있으며 undervoice 서버와 동기화되지 않습니다.
03 / 모델과 언어
하나의 범용 모델이 모든 언어를 잘한다고 가정하지 않고 언어별로 조정한 팩을 씁니다. 한국어, 중국어, 일본어, 독일어, 프랑스어, 스페인어 문장 안에 영어 라이브러리명, 변수, 명령을 그대로 말할 수 있습니다. 영어 전용 모드도 제공합니다.
이중 언어 스트리밍 모델이 미리보기를 만들고 Paraformer 또는 정확도 우선 FireRedASR2 CTC가 최종 텍스트와 문장부호를 로컬에서 완성합니다.
NVIDIA Parakeet TDT 0.6B v3를 영어, 독일어, 프랑스어, 스페인어용으로 제품에 맞게 구성했습니다.
Kotoba Whisper Bilingual v1.0은 일본어, 영어, 두 언어를 오가는 음성을 위해 학습됐습니다.
Whisper Large v3 Turbo가 한국어 문장과 그 안의 영어 기술 용어를 함께 처리하면서 로컬 대기 시간을 줄입니다.
WER과 CER은 낮을수록 좋습니다. 6.34%와 9.3–16.8%는 원본 전체 모델이 공개 테스트 세트에서 얻은 값입니다. iPhone 근접 수음, 양자화 모델, 언어 혼용을 포함한 undervoice 전체 정확도가 아닙니다. 데이터와 지표가 다른 숫자를 단순 순위로 비교할 수 없습니다.
04 / IPHONE과 MACBOOK 마이크
둘 다 Mac의 같은 로컬 모델을 사용할 수 있습니다. 차이는 음성이 입에서 몇 cm 떨어진 곳에서 시작하는지, 책상 건너편에서 시작하는지입니다.
| 공유 오피스 | 입 가까이 든 iPhone | MacBook 내장 마이크 |
|---|---|---|
| 입과 마이크 거리 | 5–10 cm | 50–80 cm |
| 작게 말할 때 | 내 목소리가 먼저 강하게 들어감 | 목소리, 키보드, 냉난방, 주변 대화가 함께 들어감 |
| 필요한 목소리 크기 | 작은 목소리 유지 | 책상 거리에서는 더 크게 말하기 쉬움 |
| 인식 위치 | 내 Mac에서 로컬 처리 | 내 Mac에서 로컬 처리 |
| 잘 맞는 환경 | 개방형 사무실, 공유 좌석 | 개인실, 내용이 들려도 괜찮은 상황 |
14–24 dB은 자유 음장 공식 20 × log10(r₂/r₁)로 5–10 cm와 50–80 cm를 비교한 추정치입니다. 반사음, 배치, 말하는 방향에 따라 실제 값은 달라집니다.
05 / 보안과 네트워크
undervoice에는 음성 중계 서버가 없습니다. 같은 네트워크에서는 iPhone이 Mac에 직접 연결되고, 다른 네트워크에서는 사용자의 Tailscale을 쓸 수 있습니다. 어느 경로에서도 앱 수준 기기 인증과 암호화는 유지됩니다.
설치 및 권한 안내 →같은 Wi-Fi에 있다는 것만으로는 부족합니다. 새 iPhone은 명시적으로 페어링해야 합니다.
오디오, 텍스트, 제어 메시지를 인증하고 종단간 암호화합니다.
다시 연결할 때마다 새로운 세션 키를 만듭니다.
녹음은 메모리에만 존재하며 진단 정보에도 오디오와 받아쓰기 본문이 없습니다.
로컬 네트워크에서는 오디오가 iPhone에서 Mac으로 바로 가고 모델도 Mac에서 실행됩니다.
다른 Wi-Fi나 셀룰러에서는 내 Tailscale을 사용할 수 있고 undervoice 암호화도 그대로 유지됩니다.
06 / 어디서나 입력
“공개 API는 유지하고 재시도는 지수 백오프로 바꾼 다음 경계 조건 테스트를 세 개 추가해 줘.”
듣는 중받아쓰기를 시작할 때 활성 앱과 선택 영역을 Mac이 기억합니다. 도중에 포커스가 바뀌면 입력을 멈춥니다. 암호 입력란과 Secure Keyboard Entry 컨트롤에는 절대 쓰지 않습니다.
사무실이 아니라 MAC에게 말하세요
Mac에 모델을 설치하고 iPhone으로 페어링 코드를 스캔하세요. 이제 누른 채 말하면 됩니다.