Meta发布实时音频感知AI模型Muse Voice Transcribe,支持20余人分轨转写

来源:PANews · 2026-09-02

AI 摘要

一句话摘要: Meta发布实时音频感知模型Muse Voice Transcribe,支持多人分轨转写,定价每小时0.18美元。 关键事实: 模型整合流式语音识别、说话人分离与端点检测,支持70余种语言及20余人分轨;定价每1000分钟3美元,API可调用;在流式语音转文本排行榜中位列第一。 涉及主体: Meta, Muse Voice Transcribe, IT之家, 9to5Mac, Artificial Analysis 可能影响: 降低实时多说话人转写成本,推动会议、直播等场景的AI音频应用落地,可能加剧语音AI模型的价格竞争。 是否值得继续跟踪: 是,因其在实时多说话人场景的技术领先性和低价策略可能影响行业定价标准,且Meta后续迭代值得关注。 噪音/炒作风险: 低,基于具体技术指标和公开定价,且榜单排名可验证,非概念性炒作。

阅读原文 →

← 更多文章