以下均为 macOS 26 实机运行截图,没有设计稿修饰——你下载后看到的就是这个样子。
悬浮窗置顶于任意视频之上,中文译文大字呈现;点击切换原文,锁定防误拖,四种样式适配不同画面。
左侧原文/译文双栏实时滚动,右侧动作轨收纳开始/停止、悬浮译文与导出,配置条一行搞定语言与引擎。
语言、音频来源、翻译引擎、术语表、字幕样式与 VAD 断句开关集中管理,与主控台实时同步。
会话内全部字幕集中回看,生成中英摘要,一键导出双语 SRT / TXT / Markdown,字幕时间轴完整保留。
从音频捕获到最终导出,RTT 把每个环节都打磨到位,让你专注观看,而不是折腾工具。
默认捕获 YouTube、网课、直播与本地播放器的系统音频;也可切换麦克风输入,用于会议与口语练习,支持粤语。
基于 macOS 26 SpeechAnalyzer,语音识别在本机完成,低延迟且保护隐私;并内置 Apple Translation 可选设备端引擎。
识别结果经 Bing 翻译为简体中文,翻译失败可单句重试,稳准兼顾。
独立窗口置顶显示,可切换原文/译文,锁定后防止误拖动与误缩放。
句子完成前即可看到临时翻译,完成后替换为正式双语字幕,所见即所得。
默认 / 黑底 / 透明 / 学习四种模板,适配不同视频背景,看清每个字。
内置语音活动检测,长静音时强制断句,避免一句拖得太长、译文迟迟不来。
会话内集中回看本次全部字幕记录,按完整句子生成正式记录与滚动预翻译。
一键导出双语 SRT、TXT 或 Markdown;可复制当前字幕或最近几条字幕。
翻译过程中切换识别语言,不会清空已完成字幕,模型下载进度可见、完成自动开始识别。
自定义关键术语的固定译法,避免专有名词被误翻。
菜单栏检查更新,默认每天自动检查一次;Sparkle 校验更新包完整性。
声音进入 Mac,文字浮现眼前。整条链路在本地与云端之间精准衔接。
授予屏幕录制权限后,RTT 抓取系统音频流;也可选麦克风用于会议口语。
Apple SpeechAnalyzer 在本机完成语音转文字,首用某语言需下载模型。
识别结果发送至 Bing,译为简体中文;先有预览,后有正式译文,失败可重试。
双语字幕在置顶窗口显示,可锁定、换样式、复制、导出。
覆盖主流外语与亚洲语言。部分语言使用 SpeechTranscriber,其余回退到 DictationTranscriber,首次使用时 macOS 可能需要下载对应模型。
普通用户直接从 Releases 下载 DMG 拖入 Applications;开发者可从源码构建。
# 1. 安装 GNU Awk 及其运行库(仅源码构建需要) brew install gawk # 2. 开发模式直接运行 swift run RTT # 3. 构建带固定 Bundle ID 的 App ./scripts/build-app.sh open dist/RTT.app # 4. 运行测试 swift test
系统音频由 RTT 捕获,语音识别在本机由 Apple SpeechAnalyzer 完成;识别文字仅发送至 Bing 用于翻译。RTT 不保存任何音频文件,导出的字幕也只包含已完成的原文与译文。