OpenAI推出GPT-Live-1 API,支持全双工语音对话

PANews 9月11日消息,OpenAI宣布在API中推出GPT-Live-1全双工语音模型,可同时听取和生成语音,改善对打断、停顿、背景噪音及长时间对话的处理,并支持电话场景。开发者可通过系统提示控制语气、语速和对话风格,还可将深度推理与工具调用委托给GPT-6 Astra等后端文本模型或第三方模型。

OpenAI称,GPT-Live-1在Full Duplex Bench上的表现较GPT-Realtime-2.1提高30个百分点;语言学习平台Speak的早期测试显示,该模型对学习者思考停顿的误打断较传统轮次系统减少近80%。GPT-Live-1现已开放API,前端语音层定价为每分钟0.05美元,后端模型及智能体框架费用另计。

分享至:

作者:PA一线

本内容只为提供市场信息,不构成投资建议。

关注PANews官方账号,一起穿越牛熊
PANews APP
英国Monument Bank将其3.3亿美元零售代币化存款计划推迟数月至11月推出
PANews 快讯