AddSubAddSub
功能

看懂任何内容所需的一切

AddSub 的全部功能:实时转录、跨 99 种语言的实时翻译、带彩色标识的说话人分离、视觉 OCR,以及悬浮的 Liquid Glass 覆盖层。100% 本地处理。

实时转录

AddSub 会聆听 Mac 上播放的任何音频,并即时转录。Whisper 级语音识别运行在 Apple Neural Engine 上——无需云端往返、没有按分钟计费,结果在不到一秒内出现。

  • Apple Silicon 上的亚秒级延迟
  • Whisper 级准确度(日语使用 Kotoba-Whisper)
  • 自动检测语言或手动固定
  • 适用于任何播放音频的应用

实时转录 — live on AddSub

99 种语言的实时翻译

观看任意语言的内容,并用你的语言阅读。AddSub 会检测源语言,并使用 Apple 的端侧 Translation 框架持续翻译。

  • 支持 99 种语音语言
  • 语言对,例如 日语 → 英语
  • 双语字幕(原文与译文并排)
  • Apple Translation 运行在 Neural Engine 上

99 种语言的实时翻译 — live on AddSub

说话人分离

AddSub 会区分说话人,并用持久的彩色标识(S1、S2、S3……)标注每一行。访谈、播客和会议会变成可读的文字记录,并保留谁说了什么。

  • 整个会话中持久的说话人身份
  • 与文字记录匹配的彩色标识
  • 适用于实时流,而非仅限离线文件
  • 经过校准的设备端聚类(pyannote + wespeaker)

说话人分离 — live on AddSub

视觉 OCR

屏幕上的文字——幻灯片、代码、界面标签——由 Apple Vision 框架读取,并与音频文字记录交织在一起。非常适合课程、产品演示和教程。

  • 即时读取幻灯片和代码
  • 将屏幕文字与语音字幕交织
  • 基于 Apple Vision,设备端运行

视觉 OCR — live on AddSub

悬浮 Liquid Glass 覆盖层

一个精美的原生覆盖层悬浮在每个应用之上。观看时它不会妨碍你,悬停时会展开显示完整的文字记录时间线。

  • 悬浮在所有应用、所有空间之上
  • 最小化胶囊 ↔ 完整时间线模式
  • 复制任意片段、复制全部,或导出为 SRT
  • 完全可定制:字体大小、不透明度、文字颜色

悬浮 Liquid Glass 覆盖层 — live on AddSub

100% 本地隐私

每一项功能——转录、翻译、说话人分离、OCR——都在本地运行。你的音频不会离开 Mac。没有服务器,无需账户,也没有云成本。

  • 永不上传任何内容
  • 没有订阅或按分钟计费
  • 可离线运行
  • 单一原生二进制文件——没有后台代理

100% 本地隐私 — live on AddSub

免费试用全部功能 7 天

无需信用卡。无需账户。只需下载并观看。