PANews 8월 5일 소식, 차이롄서(财联社) 보도에 따르면 바이트댄스가 네이티브 오디오·비디오 전이중 대형 모델 SeedRealtime을 정식 출시했습니다. SeedRealtime은 통합 아키텍처로 오디오, 비디오, 텍스트를 네이티브 융합해 연속적인 멀티모달 정보 흐름 속에서 실시간 상호작용하며, ‘보면서 듣고 말하는’ 완전히 새로운 경험을 선사합니다. 엔드투엔드 사용자 평가 결과, 캐스케이드 모델과 비교해 SeedRealtime의 오디오·비디오 대화 리듬 문제가 절반으로 줄었습니다. 모델이 말 타이밍을 더 자연스럽게 포착하게 되면서 “말이 끝나기 전에 끊기거나, 말이 끝났는데도 응답이 느리거나, 배경 소음이나 잡담에 오작동하는” 등의 끊김 현상이 현저히 감소했습니다. 동시에 단일 대화가 완전하고 매끄럽게 오갈 확률도 눈에 띄게 향상되었습니다. 현재 SeedRealtime은 더우바오(Doubao) 앱에 전체 적용되었습니다.
바이트댄스, 음성·영상 전이중 대형 모델 SeedRealtime 출시
공유하기:
작성자: PA一线
이 내용은 시장 정보 제공만을 목적으로 하며, 투자 조언을 구성하지 않습니다.
PANews 공식 계정을 팔로우하고 함께 상승장과 하락장을 헤쳐나가세요
추천 읽기
관련 특집
PANews 앱
24시간 블록체인 업계 소식을 추적하고 심층 기사를 분석합니다.




