字節跳動發佈音視頻全雙工大模型SeedRealtime

PANews 8月5日消息,據財聯社報道,字節跳動正式推出原生音視頻全雙工大模型SeedRealtime。SeedRealtime用統一架構原生融合音頻、視頻與文本,能在連續的多模態信息流上實時交互,帶來「邊看、邊聽、邊說」的全新體驗。端到端人工評測結果顯示,相比級聯模型,SeedRealtime的音視頻對話節奏問題減少了一半——模型對說話時機的把握更加自然,「話未說完被搶斷、話音已落卻回應遲緩、或是被背景雜音與閒聊誤觸發」等卡殼現象顯著減少;同時,單次對話能夠完整、順暢交流的概率也有明顯提升。目前,SeedRealtime已在豆包App全量上線。

分享至:

作者:PA一线

本內容只為提供市場資訊,不構成投資建議。

關注PANews官方賬號,一起穿越牛熊
PANews APP
日本金融廳重組加密監管架構,新設「加密資產與穩定幣課」
PANews 快訊