Meta的AI布局又落一子。扎克伯格宣布,Muse Voice Transcribe于当日正式推出,这是MSL(Meta超级智能实验室)首个实时音频感知模型。
这款模型在流式语音转文字任务上达到SOTA(当前最优)水平。更关键的是,它在单一模型内原生支持说话人分离和端点检测,无需额外拼接多个系统。
![]()
这意味着,实时会议转录、多人口述记录等场景,有望在更低的延迟和复杂度下实现。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.