알리바바 통이첸원, Qwen3.8-Omni-Flash 공개…영상 입력 비용 전작 대비 약 89% 절감

PANews 9월 18일 소식, 알리바바 통이첸원이 에이전트 역량을 중심으로 구축한 첫 전모달(全模态) 모델 Qwen3.8-Omni-Flash를 공개했다. 네이티브 오디오·비디오 이해, 추론 및 도구 호출을 단일 모델에 통합해 콘텐츠 이해, 작업 계획, 도구 호출, 결과 전달까지의 전체 프로세스를 완성할 수 있다. 이 모델은 100만 토큰 컨텍스트를 지원하며, 긴 영상에서 핵심 구간을 능동적으로 찾아낼 수 있다. OmniVideoBench 테스트에서 에이전트 인지 모드는 정적 이해 대비 토큰 소모를 51.8% 줄였고, 영상 입력 비용은 Qwen3.5-Omni-Plus 대비 약 89% 감소했다. 공식 측에 따르면 이 모델의 오디오·비디오 역량은 Gemini 3.8 Flash에 근접하며, WildClawBench-MM과 UniClawBench 두 테스트에서의 에이전트 성능은 평균 19.5점 향상됐다. 또한 Qwen-MM-Plugins는 오픈소스로 공개됐으며, Qwen-Live Harness는 추후 출시될 예정이다.

공유하기:

작성자: PA一线

이 내용은 시장 정보 제공만을 목적으로 하며, 투자 조언을 구성하지 않습니다.

PANews 공식 계정을 팔로우하고 함께 상승장과 하락장을 헤쳐나가세요
PANews APP
UNI 고래, 바닥 매수 1년 만에 첫 대규모 차익 실현…지난 4시간 동안 50만 UNI 매도
PANews 속보