보는 모든 것을 이해하기 위한 모든 것
AddSub의 모든 기능: 실시간 음성 인식, 99개 언어 실시간 번역, 색상 코드 라벨이 있는 화자 분리, Vision OCR, 그리고 플로팅 Liquid Glass 오버레이. 100% 온디바이스.
실시간 음성 인식
AddSub는 Mac에서 재생되는 모든 오디오를 듣고 발생하는 즉시 음성 인식합니다. Whisper급 음성 인식이 Apple Neural Engine에서 실행됩니다 — 클라우드 왕복도, 분당 요금도 없으며 결과는 1초 이내에 나타납니다.
- Apple Silicon에서 1초 미만의 지연 시간
- Whisper급 정확도(일본어는 Kotoba-Whisper)
- 언어 자동 감지 또는 수동 고정
- 오디오를 재생하는 모든 앱에서 작동
실시간 음성 인식 — live on AddSub
99개 언어 실시간 번역
어떤 언어로든 시청하고 내 언어로 읽어보세요. AddSub는 소스 언어를 감지하고 Apple의 온디바이스 Translation 프레임워크를 사용해 지속적으로 번역합니다.
- 99개 음성 언어 지원
- 언어 쌍, 예: 일본어 → 영어
- 이중 언어 자막(원문 + 번역 나란히)
- Apple Translation이 Neural Engine에서 실행
99개 언어 실시간 번역 — live on AddSub
화자 분리
AddSub는 화자를 분리하고 각 대사를 지속적인 색상 코드 배지(S1, S2, S3…)로 라벨링합니다. 인터뷰, 팟캐스트, 회의는 누가 무엇을 말했는지가 보존된 읽기 쉬운 대화록이 됩니다.
- 세션 전반에 걸친 지속적인 화자 식별
- 대화록과 일치하는 색상 코드 배지
- 오프라인 파일뿐 아니라 실시간 스트림에서도 작동
- 보정된 온디바이스 클러스터링(pyannote + wespeaker)
화자 분리 — live on AddSub
Vision OCR
화면 속 텍스트 — 슬라이드, 코드, UI 라벨 — 는 Apple Vision 프레임워크로 읽혀 오디오 대화록과 함께 표시됩니다. 강의, 제품 데모, 튜토리얼에 완벽합니다.
- 나타나는 슬라이드와 코드를 읽음
- 화면 속 텍스트를 음성 자막과 함께 표시
- Apple Vision 기반, 온디바이스
Vision OCR — live on AddSub
플로팅 Liquid Glass 오버레이
멋진 네이티브 오버레이가 모든 앱 위에 떠 있습니다. 시청 중에는 방해가 되지 않으며, 마우스를 올리면 전체 대화록 타임라인으로 확장됩니다.
- 모든 앱, 모든 공간 위의 플로팅 창
- 최소화 캡슐 ↔ 전체 타임라인 모드
- 구간 복사, 전체 복사, 또는 SRT로 내보내기
- 완전한 사용자 지정: 글꼴 크기, 불투명도, 텍스트 색상
플로팅 Liquid Glass 오버레이 — live on AddSub
100% 온디바이스 개인정보 보호
음성 인식, 번역, 화자 분리, OCR 등 모든 기능이 로컬에서 실행됩니다. 오디오는 절대 Mac을 떠나지 않습니다. 서버도, 계정도 필요 없고, 클라우드 비용도 없습니다.
- 업로드 없음, 영원히
- 구독료나 분당 요금 없음
- 오프라인에서 작동
- 단일 네이티브 바이너리 — 백그라운드 에이전트 없음
100% 온디바이스 개인정보 보호 — live on AddSub
모든 기능을 7일 동안 무료로 사용해 보세요
신용카드도, 계정도 없이. 그냥 다운로드하고 시청하세요.