Meta发布Muse Voice Transcribe:实时语音转写进入新阶段

据9to5Mac报道,Meta于9月2日推出Muse Voice Transcribe,作为其首个可通过Meta Model API接入的实时音频感知模型。该系统以每1000分钟音频3美元(约每小时0.18美元)的计费标准面向开发者开放,具备流式自动语音识别、说话人分离及端点检测功能,支持用户在录音过程中即时获取转录结果。

多语言支持与高并发对话解析能力获验证

该模型覆盖超过70种语言,其中25种已完成质量认证,可处理长达一小时以上的音频片段,并能在单次录制中精准区分20位以上发言者,同时生成每位参与者的独立音轨,显著提升复杂场景下的内容可读性与分析效率。