Meta AI Research · Released Sep 01, 2026

Muse Voice Transcribe 实时语音转文字指南

查找 Meta 的 muse-voice-transcribe-1.0、API 价格、语言覆盖、实时转录、说话人分离和端点检测能力。本站是独立资料站,不隶属于 Meta。

非官方披露:musevoicetranscribe.site 不是 Meta、Meta AI 或 Meta Superintelligence Labs 的官方网站。

80 ms
音频处理块
20+
说话人
70+
训练语言
> 1 hr
原生长上下文
简明答案

Muse Voice Transcribe 是什么?

Muse Voice Transcribe 是 Meta Superintelligence Labs 发布的实时音频感知模型,用于流式语音识别、说话人分离和端点检测。它面向正在讲话的音频流工作,而不只是上传完整录音后再转写。

公开资料显示,它通过 Meta Model API、Meta AI for Mac 和 Muse Code 提供访问;本站只整理这些公开事实,并提供独立的浏览器转录体验。

实时转录

现在就把声音变成文字

直接说话,实时查看文字,并可复制或下载整理后的转录结果。

Live browser transcription
Speak naturally, watch words appear in real time, then copy or download your transcript.
Ready
Elapsed time: 00:00
Your live transcript will appear here. You can also load a prepared example to preview the transcript controls.

Select a language, then allow microphone access to begin.

官方已验证

一个模型,三种实时信号

Meta 将转录、说话人标签和对话轮次边界放进同一个流式模型,而不是依赖多个后处理系统拼接。

Streaming ASR
Processes audio as it arrives instead of waiting for a complete file.
20+ speakers
Native speaker diarization for long, multi-person conversations.
Endpointing
Detects speech onset and when a conversational turn is complete.
Multilingual
Trained on 70+ languages, with 25 extensively verified at launch.
模型设计

先听,还是现在输出?

每个 80ms 音频块到达时,模型决定继续听取上下文,或输出文字。Adaptive Delay 会依据词语难度动态改变等待时间。

80ms audio chunk

A compact audio representation enters the stream.

Listen or emit

The autoregressive model asks for more audio or returns text.

Adaptive delay

Harder words get more context; easier words arrive sooner.

Evidence, dated

排名会变化,来源不该模糊

Meta 表示 Muse Voice Transcribe 在发布时位列 Artificial Analysis 流式语音转文字与公开说话人分离基准第一。该表述的有效日期为 2026 年 9 月 1 日。

查看基准方法
常见问题

快速核对访问、价格和边界

这是 Meta 官方网站吗?

不是。本站是独立资料站和浏览器端转录工具,所有模型能力说明都应以 Meta AI Research 和当前 Meta Model API 文档为准。

Muse Voice Transcribe 免费吗?

本站的浏览器演示不销售 API 额度。Meta Model API 公布的 Muse Voice Transcribe 价格为每音频小时 $0.18;Mac 和 Muse Code 的使用路径不等同于 API 计费文档。

如何使用 Muse Voice Transcribe?

开发者应从 Meta Model API 文档开始评估 muse-voice-transcribe-1.0。非开发者可关注 Meta AI for Mac 中由 Muse Voice Transcribe 支持的听写功能。

Mac 上可以用吗?

Meta 表示 Muse Voice Transcribe 已用于 Meta AI for Mac 和 Muse Code 的听写场景;可用地区、账户要求和产品入口应以 Meta 当前说明为准。

支持哪些语言?

Meta 称该模型训练覆盖 70+ 语言,其中 25 种在发布时经过更充分验证,并支持多语言和句内 code-switching。

它和 Whisper 有什么不同?

Muse Voice Transcribe 面向实时流式 ASR,并把说话人分离和端点检测放在同一模型中。Whisper 常用于批量转录和自托管场景;实际选择取决于延迟、隐私、成本和部署要求。

Research sources

从一手资料开始,而不是从营销数字开始。

模型能力以 Meta AI Research 和当前开发者文档为准,第三方测试均标注来源与日期。

打开官方发布