功能
看懂任何内容所需的一切
AddSub 的全部功能:实时转录、跨 99 种语言的实时翻译、带彩色标识的说话人分离、视觉 OCR,以及悬浮的 Liquid Glass 覆盖层。100% 本地处理。
实时转录
AddSub 会聆听 Mac 上播放的任何音频,并即时转录。Whisper 级语音识别运行在 Apple Neural Engine 上——无需云端往返、没有按分钟计费,结果在不到一秒内出现。
- Apple Silicon 上的亚秒级延迟
- Whisper 级准确度(日语使用 Kotoba-Whisper)
- 自动检测语言或手动固定
- 适用于任何播放音频的应用
实时转录 — live on AddSub
99 种语言的实时翻译
观看任意语言的内容,并用你的语言阅读。AddSub 会检测源语言,并使用 Apple 的端侧 Translation 框架持续翻译。
- 支持 99 种语音语言
- 语言对,例如 日语 → 英语
- 双语字幕(原文与译文并排)
- Apple Translation 运行在 Neural Engine 上
99 种语言的实时翻译 — live on AddSub
说话人分离
AddSub 会区分说话人,并用持久的彩色标识(S1、S2、S3……)标注每一行。访谈、播客和会议会变成可读的文字记录,并保留谁说了什么。
- 整个会话中持久的说话人身份
- 与文字记录匹配的彩色标识
- 适用于实时流,而非仅限离线文件
- 经过校准的设备端聚类(pyannote + wespeaker)
说话人分离 — live on AddSub
视觉 OCR
屏幕上的文字——幻灯片、代码、界面标签——由 Apple Vision 框架读取,并与音频文字记录交织在一起。非常适合课程、产品演示和教程。
- 即时读取幻灯片和代码
- 将屏幕文字与语音字幕交织
- 基于 Apple Vision,设备端运行
视觉 OCR — live on AddSub
悬浮 Liquid Glass 覆盖层
一个精美的原生覆盖层悬浮在每个应用之上。观看时它不会妨碍你,悬停时会展开显示完整的文字记录时间线。
- 悬浮在所有应用、所有空间之上
- 最小化胶囊 ↔ 完整时间线模式
- 复制任意片段、复制全部,或导出为 SRT
- 完全可定制:字体大小、不透明度、文字颜色
悬浮 Liquid Glass 覆盖层 — live on AddSub
100% 本地隐私
每一项功能——转录、翻译、说话人分离、OCR——都在本地运行。你的音频不会离开 Mac。没有服务器,无需账户,也没有云成本。
- 永不上传任何内容
- 没有订阅或按分钟计费
- 可离线运行
- 单一原生二进制文件——没有后台代理
100% 本地隐私 — live on AddSub
免费试用全部功能 7 天
无需信用卡。无需账户。只需下载并观看。