PANews 9月18日の報道によると、アリババの「通義千問」は、エージェント能力を中心に構築した初の全モダリティモデル「Qwen3.8-Omni-Flash」を発表した。ネイティブな音声・動画理解、推論、ツール呼び出しを単一モデルに統合し、コンテンツの理解、タスクの計画、ツールの呼び出し、結果の提供という一連のフローを完結できる。同モデルは100万トークンのコンテキストに対応し、長尺動画内の重要なセグメントを能動的に特定可能。OmniVideoBenchテストでは、エージェント知覚モードが静的理解と比べてトークン消費を51.8%削減し、動画入力コストはQwen3.5-Omni-Plus比で約89%低下した。公式によると、同モデルの音声・動画能力はGemini 3.8 Flashに迫り、WildClawBench-MMとUniClawBenchの2つのテストにおけるエージェント性能は平均19.5ポイント向上した。また、Qwen-MM-Pluginsはすでにオープンソース化されており、Qwen-Live Harnessは今後リリースされる予定だ。
アリババ「通義千問」がQwen3.8-Omni-Flashを発表、動画入力コストは前世代比約89%削減
共有先:
著者:PA一线
この内容は市場情報の提供のみを目的としており、投資助言を構成しません。
PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
おすすめ記事
PANewsアプリ
24時間ブロックチェーン業界情報を追跡し、深掘り記事を解析。



