OpenAI, GPT-Live-1 API 출시… 전이중 음성 대화 지원

PANews 9월 11일 보도, OpenAI가 API에 GPT-Live-1 전이중 음성 모델을 출시했다고 발표했습니다. 이 모델은 음성을 동시에 듣고 생성할 수 있으며, 끼어들기, 일시 정지, 배경 소음 및 장시간 대화 처리 능력를 개선하고 전화 시나리오를 지원합니다. 개발자는 시스템 프롬프트를 통해 어조, 말하기 속도 및 대화 스타일을 제어할 수 있으며, 심층 추론과 도구 호출을 GPT-6 Astra와 같은 백엔드 텍스트 모델 또는 타사 모델에 위임할 수도 있습니다.

OpenAI는 GPT-Live-1이 Full Duplex Bench에서 GPT-Realtime-2.1보다 30% 포인트 향상된 성능을 보였다고 밝혔습니다. 언어 학습 플랫폼 Speak의 초기 시험에 따르면, 이 모델은 학습자의 사고 일시 정지에 대한 오류 끼어들기가 기존 턴 시스템보다 거의 80% 감소했습니다. GPT-Live-1은 현재 API로 공개되었으며, 프론트엔드 음성 계층 가격은 분당 0.05달러이고, 백엔드 모델 및 에이전트 프레임워크 비용은 별도로 부과됩니다.

공유하기:

작성자: PA一线

이 내용은 시장 정보 제공만을 목적으로 하며, 투자 조언을 구성하지 않습니다.

PANews 공식 계정을 팔로우하고 함께 상승장과 하락장을 헤쳐나가세요
PANews APP
英国Monument Bank将其3.3亿美元零售代币化存款计划推迟数月至11月推出
PANews 속보