塔斯娱乐资讯网

平时参加线上会议,不少语音转写工具一到多人讨论就乱作一团,分不清是谁在发言,遇上

平时参加线上会议,不少语音转写工具一到多人讨论就乱作一团,分不清是谁在发言,遇上背景嘈杂、说话中英夹杂,输出的文字错漏百出,会后整理记录要耗费大量时间。Meta今天上线全新流式音频模型Muse Voice Transcribe,把实时语音转写的体验往上提了一大截。不用等录音全部结束,说话的同时文字就同步生成,多人开会的时候,它能够自动区分每一位发言者,不用后期手动拆分标记。会议室里风扇、键盘带来的环境噪音干扰,也不会轻易打乱识别效果。平时做访谈、录制播客,多人对话内容可以直接生成实时字幕,句子里面中英文来回切换,也可以顺畅识别出来。结束之后直接拿到条理清晰的文稿,不用熬夜逐句听录音敲字。对于普通打工人来说,省去反复回放音频整理笔记的麻烦,大量节省时间。后续开发者接入这项能力之后,线上会议软件、播客工具都可以用上这套能力,普通人日常办公、做内容创作,都能实实在在感受到便利。