Muse Voice Transcribe 实时语音转文字指南
查找 Meta 的 muse-voice-transcribe-1.0、API 价格、语言覆盖、实时转录、说话人分离和端点检测能力。本站是独立资料站,不隶属于 Meta。
非官方披露:musevoicetranscribe.site 不是 Meta、Meta AI 或 Meta Superintelligence Labs 的官方网站。
Muse Voice Transcribe 是什么?
Muse Voice Transcribe 是 Meta Superintelligence Labs 发布的实时音频感知模型,用于流式语音识别、说话人分离和端点检测。它面向正在讲话的音频流工作,而不只是上传完整录音后再转写。
公开资料显示,它通过 Meta Model API、Meta AI for Mac 和 Muse Code 提供访问;本站只整理这些公开事实,并提供独立的浏览器转录体验。
现在就把声音变成文字
直接说话,实时查看文字,并可复制或下载整理后的转录结果。
Select a language, then allow microphone access to begin.
一个模型,三种实时信号
Meta 将转录、说话人标签和对话轮次边界放进同一个流式模型,而不是依赖多个后处理系统拼接。
先听,还是现在输出?
每个 80ms 音频块到达时,模型决定继续听取上下文,或输出文字。Adaptive Delay 会依据词语难度动态改变等待时间。
80ms audio chunk
A compact audio representation enters the stream.
Listen or emit
The autoregressive model asks for more audio or returns text.
Adaptive delay
Harder words get more context; easier words arrive sooner.
排名会变化,来源不该模糊
Meta 表示 Muse Voice Transcribe 在发布时位列 Artificial Analysis 流式语音转文字与公开说话人分离基准第一。该表述的有效日期为 2026 年 9 月 1 日。
查看基准方法快速核对访问、价格和边界
不是。本站是独立资料站和浏览器端转录工具,所有模型能力说明都应以 Meta AI Research 和当前 Meta Model API 文档为准。
本站的浏览器演示不销售 API 额度。Meta Model API 公布的 Muse Voice Transcribe 价格为每音频小时 $0.18;Mac 和 Muse Code 的使用路径不等同于 API 计费文档。
开发者应从 Meta Model API 文档开始评估 muse-voice-transcribe-1.0。非开发者可关注 Meta AI for Mac 中由 Muse Voice Transcribe 支持的听写功能。
Meta 表示 Muse Voice Transcribe 已用于 Meta AI for Mac 和 Muse Code 的听写场景;可用地区、账户要求和产品入口应以 Meta 当前说明为准。
Meta 称该模型训练覆盖 70+ 语言,其中 25 种在发布时经过更充分验证,并支持多语言和句内 code-switching。
Muse Voice Transcribe 面向实时流式 ASR,并把说话人分离和端点检测放在同一模型中。Whisper 常用于批量转录和自托管场景;实际选择取决于延迟、隐私、成本和部署要求。