Meta的新实时音频模型是打造永不停歇倾听的AI助手的基础。
Meta 发布 Muse Voice Transcribe 实时转录模型,该模型以 80 毫秒处理语音片段、区分说话人及检测句子边界。据 Artificial Analysis 报道,此模型在市场中提供最低价格的最准确流式转录服务。Meta 视其为通过智能眼镜等设备监听真实对话的个人 AI 代理的基础构建模块。
EVENT DOSSIER
2026 年 9 月 6 日,Meta 发布了名为 Muse Voice Transcribe 的实时音频转录模型。该模型具备以 80 毫秒处理语音片段、区分不同说话人及检测句子边界的能力。据 Artificial Analysis 报道,此模型在市场中提供了价格最低且最准确的流式转录服务。Meta 计划将该模型作为构建能够持续监听真实对话的个人 AI 代理的基础模块,并预计将应用于智能眼镜等设备中。
Meta Muse Voice Transcribe 发布实时语音转录模型
Meta 发布 Muse Voice Transcribe 实时转录模型,该模型以 80 毫秒处理语音片段、区分说话人及检测句子边界。据 Artificial Analysis 报道,此模型在市场中提供最低价格的最准确流式转录服务。Meta 视其为通过智能眼镜等设备监听真实对话的个人 AI 代理的基础构建模块。