01
尚未检测浏览器环境
这一项不加载语音模型。绿色表示具备基础能力,不代表后续一定通过。
浏览器与系统
请在目标 Windows 的 Edge 上测试
安全网页环境
正式测试使用 HTTPS,不使用本地文件
共享标签页音频
还需你亲自授权,并验证实际有声音
音频处理 AudioWorklet
读取共享声音,生成识别所需的音频采样
本地翻译 Translator API
还需实际验证 en → zh-Hans 模型
GPU 加速 WebGPU
没有 GPU 路径,仍可测试 CPU
CPU 运行环境 WebAssembly
兼容模式使用单线程,不依赖特殊隔离设置
置顶字幕浮窗
不可用时可以并排查看;全屏表现需实测
02
尚未共享能不能获取视频声音?
先在另一个 Edge 标签页播放公开视频,再选择那个标签页,勾选“同时共享标签页音频”。
—
本页不调用麦克风,也不回放捕获音频,不会产生双重声音。
浏览器会同时建立一个必要的画面轨道,但本页不读取、显示或保存视频画面。测试后请停止共享。
03
尚未测试本地英语 → 中文
让浏览器实际翻译下面这句话。点击后,Edge 可能需要先下载翻译模型。
The meeting starts at nine in the morning. Please turn on the subtitles.
中文测试结果会显示在这里。
仅使用浏览器内置 Translator API,不调用云端付费翻译,也不自动切换到其他服务。
04
可选测试语音识别与速度测试
加载一个英文小模型,在这台电脑里处理 8 秒视频声音。模型加载成功,不等于实时速度合格。
只有勾选同意并点击加载,才会下载资源:CPU 模型从本站获取,运行库来自 jsDelivr;手动 GPU 测试仍连接 Hugging Face。不需要 API Key。
先完成音频共享与模型加载。第 3 步也通过后,识别结果会继续翻译成中文。
8 秒样本结果 · 不是连续同传
中文字幕会显示在这里。
识别出的英文会显示在这里。
—识别耗时
—翻译耗时
—处理耗时 ÷ 音频时长
速度比值小于 1,表示本段处理快于播放;越低余量越大。这里不含 8 秒采集等待和模型下载,不代表端到端字幕延迟。至少重复两次,排除首次运行影响。