Meta发布Muse Voice Transcribe:支持实时转写、20余人分轨识别,千分钟3美元

Meta推出首个实时音频感知模型 Muse Voice Transcribe,并通过 Meta Model API 提供调用,定价为每1000分钟音频3美元。该模型整合流式语音识别、说话人分离和端点检测,可在20余名说话者的录音中自动分轨转写,支持超过1小时音频及70多种语言,25种语言已完成验证。Meta称其截至2026年9月1日位列 Artificial Analysis 流式语音转文本榜首。

上一篇:

下一篇:

发表回复

登录后才能评论