【OpenAI 在 API 中推出 GPT-Live-1 全双工语音模型】金色财经报道,9 月 10 日,OpenAI 官方宣布在 API 中推出 GPT-Live-1 全双工语音模型。起因是传统语音代理需拼接语音识别、大语言模型和语音合成三个组件,每次交接增加延迟并易丢失对话节奏与上下文。经过研发,GPT-Live-1 将听和说整合在单一模型中,可实时响应打断和确认,同时将深度推理委托给后端模型如 GPT-6Astra 或 Luna。结果显示,该模型在全双工基准测试中较 GPT-Realtime-2.1 提升 30 个百分点,配合 GPT-6Astra 在 Tau3 语音智能评测中排名第一;语言学习平台 Speak 早期评估显示思考停顿期间的打断减少近 80%,某医疗客户代码库简化 80% 并减少 2.3 万行代码。该模型支持电话部署、12 种新语音,前端语音层定价为每分钟 0.05 美元,目前已在 API 中可用,Yelp、Fin、Cognition 等企业已接入测试。

原文链接:https://openai.com/index/introducing-gpt-live-1-in-the-api/

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。