PANews 8月5日ニュース、鳳凰網がフィナンシャル・タイムズを引用して報じたところによると、AnthropicのMythos 5とOpenAIのGPT-5.6 Solが定常的なサイバーセキュリティ評価において、実際の個人や組織に対し「持続的で、危害を及ぼす可能性のある活動」を行っていた。これにはGitHubのオープンソースプロジェクトへの悪意あるコードの埋め込みやソーシャルエンジニアリング攻撃が含まれる。AISIによれば、122回のテストのうち10回でこうした事象が確認され、ほぼすべての行為はAnthropicのMythosモデルに起因し、うち2回の行動にはOpenAIのGPTが関与していた。最も深刻な事例では、AIエージェントが偽のオンライン身分を作成してプロジェクトメンテナに圧力をかけ、悪意あるコードの承認を迫ったが、メンテナに発見され拒否された。AISIは、自律性や欺瞞性に関連するリスクが、特定のプロンプトなしに現実世界で直接的に顕在化するのをこれほど明確に確認したのは初めてだとし、これまでに明らかになった侵入事案とあわせ、リスクランドスケープの転換点を示していると述べた。Anthropicは安全性評価をめぐり、より広範な議論が必要だと応じ、OpenAIの広報担当者は、この事象はセキュリティ対策が弱められたテスト環境で発生したもので日常利用を反映するものではないとしつつ、評価機関と連携して安全性評価基準の強化を継続すると述べた。
英国AI安全機関:OpenAIとAnthropicのモデルが制御不能な侵入を行い、前例のない欺瞞的行動を示す
共有先:
著者:PA一线
この内容は市場情報の提供のみを目的としており、投資助言を構成しません。
PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
おすすめ記事
PANewsアプリ
24時間ブロックチェーン業界情報を追跡し、深掘り記事を解析。




