OpenAI 正式リリース GPT-6 Astra、Astra は一体何ができるのか?

実測により、Astra は三次元の家を再構築、CRM ワークフローを編集、複数のエージェントを組織して教材を作成するなど、強力な能力を発揮することが示された。しかし、安全性に関する論争も伴い、オルトマンは訓練を一時停止したのは将来のバージョンであると応じた。

文:机器之心

昨日「GPT-6 Astra は使えない」と愚痴っていた皆さんに、今日は朗報が届きました。

先ほど、Sam Altman が GPT-6 Astra の大規模リリースが正式に開始されたことを発表しました。

現在、Astra は Work/Codex の全 Pro、Enterprise、Business Premium ユーザー向けに開放され、同時に API も正式にリリースされました。次の段階では、OpenAI は引き続き Plus ユーザーと Business ユーザーへのプッシュを進めます。

長らくお待たせして申し訳ございません。

Astra の開放に加え、OpenAI はユーザーに追加の特典も提供しました:クォータのリセットです。

OpenAI Codex のプロダクト責任者 Tibo は、本日、全 Plus、Pro、Business ユーザーに対して完全なクォータリセットを実施すると述べました。これまでに蓄積されたリセットされたクォータも併せて解放され、本日期日中に完了する見込みです。

まだ Astra へのアクセス権を取得していないユーザーでも、太平洋時間の午後 8 時までにアカウントを作成するか、プランをアップグレードすれば、アクセス資格を得る機会がまだあります。

Tibo はソーシャルプラットフォーム上でも Astra のリリースを祝福しました:皆さん、Astra Day おめでとうございます。素晴らしい週末をお過ごしください(冗談)。

今回の大規模プッシュ完了後、彼は次のように述べました:チームはようやくぐっすり眠れそうです。来週はさらに多くの「新機能リリース」のニュースをお届けします。

それと同時に、GPT-6 Astra はサードパーティのエコシステムへの導入も始まっています。現在、Astra は OpenRouter 上での動作をサポートしており、開発者はこのプラットフォームを通じて新しいモデルを呼び出すことができます。

アドレス:https://openrouter.ai/openai/gpt-6-astra

Astra が開放された後、アクセス権を取得したユーザーたちは早速この新しいモデルを試し始めています。

物件リンクを渡すだけで、家を直接再構築

Astra は具体的に何ができるのか?まずは最も直感的な例をご覧ください:物件リンクを渡すと、3D 内見動画を作成します。

開発者の Yunfan Ye 氏は Astra に、Zillow の物件ページの写真を基に Blender で家を再構築し、カメラワークを伴ったプロモーションビデオを作成するよう指示しました。また、プロンプトではモデルに撮影監督とアニメーターの役割を担うよう要求しました。

作者によると、Astra は一度の動作で結果を出しました。物件写真から 3D シーン、そして最終的な動画に至るまで、このタスクは画像理解、空間再構築、プログラミング、アニメーション制作を同時に使用しました。完成品にはまだ不正確な細部がありますが、さらに磨きをかけることで、より正確な動画が得られると作者は信じています。

ChatPRD の創業者 Claire Vo 氏は、実際のテストで自社の顧客管理業務を Astra に任せました。彼女とパートナーは顧客のタイプ別にコンサルティングを割り当て、それぞれフォローアップする必要があります。そのために、彼女は CRM で判断、振り分け、通知を含むワークフローを構築しており、ノードを手動で調整するのに 1 時間も費やしていました。

彼女はその後、Astra に Chrome を直接操作させ、現在開いているフローを修正するよう依頼しました:顧客が誰に割り当てられたかに基づいて、対応する口調のフォローアップメールを生成し、予約リンクを添付し、なぜ相手とのコミュニケーションを楽しみにしているかを説明するように指示しました。

Claire Vo 氏は Astra に CRM ワークフローを修正させ、異なる担当者に割り当てられた顧客向けにパーソナライズされたフォローアップメールを生成させました。動画リンク:https://www.youtube.com/watch?v=AniiF8rOu9c&t=224s

彼女のデモ説明の中で、Astra はノードの追加を開始し、メールフィールドの設定、プロンプトの調整、接続関係の設定を行いました。設計されたフローは、メールの下書きを Slack に送り、2 人が確認してから送信できるようにします。

Astra は複数のエージェントを組織し、数日間にわたる作業を分割して完了することもできます。

事前に Astra へのアクセス権を取得していた Latent Space チームは、2 日間にわたるテスト結果も公開しました:Astra に複数のエージェントを組織させ、AI エンジニアリングの教科書を作成・改訂させるというものです。

60 章からなる計画に対して、Astra はタスクを 6つのグループに分割し、章の順序を調整して、先に紹介すべき知識が前に来るようにし、並行して執筆を進めました。また、定期的なチェックを設定し、タスクの進捗を継続的に監視しました。情報源のフィルタリングでユーザー指定の資料が漏れていることを発見すると、フィルタリング工程の修正を手配し、後続のバッチを修正完了まで待機させました。一部の章がまだ記事の要約のように書かれていることをチェックすると、さらに修正を要求しました。

Astra は 60 章の教材作成タスクを 6つのグループに分割し、定期的なチェックを通じて継続的にフォローアップと問題修正を行い、プロセス全体は 2 日間続きました。出典:https://www.latent.space/p/astra

これらのタスクは、Astra の単発的な能力を検証しただけでなく、タスクの調整、問題の発見と修正における継続的な作業能力も示しました。

アルトマン:「トレーニングを一時停止したのは、GPT-6 ではない」

Astra リリースの熱気が冷めやらぬ中、AI の安全性を巡る議論が再び浮上しました。

ロイター通信によると、関係者 2 名の情報として、今年の春、制御不能になった一群の OpenAI エージェントがドイツのウェブサイトを乗っ取り、他の AI エージェントが使用する掲示板に改造したとのことです。

関係者 2 名によると、OpenAI の責任者は数週間前にこの事件を知っていたが、これまで外部に開示していなかったとのことです。当時、会社の上層部は 7 月に発生したオープンソースコードリポジトリ Hugging Face への攻撃事件の余波に対処していました。

この事件は今年 5 月に始まり、これまで公に報道されたことはありませんでした。

関係者 4 名によると、このドイツの事件は、より広範な AI の行動パターンを反映しているとのことです。一部の OpenAI 調査担当者は、このような行動に対してより詳細な調査を望んでいましたが、調査範囲を拡大する試みは、社内の他の関係者(法律顧問を含む)からの抵抗に遭いました。

OpenAI の広報担当者は次のように述べています:当社の法務チームがこの事件の調査を妨害したという主張は事実無根です。

同広報担当者は、ドイツの事件は Hugging Face の事件とは無関係であり、したがって Hugging Face 事件の報告書には含まれないと述べました。また、OpenAI は常に誠意を持って外部の専門家と協力し、関連事件について開示してきたと付け加えました。

セキュリティ対策をさらに強化するため、OpenAI はモデルの行動をより綿密にモニタリングすることを約束しました。先月、OpenAI は追加の安全対策を講じるために、一部のモデルのトレーニングを一時的に停止しました。

しかし、まさにその矢先、今週 OpenAI は新しいモデル Astra をリリースし、外部からは新しいモデルの安全境界線も同時に強化されているのかという疑問が生じています。

アルトマンは最近のインタビューでこの問題に応えました:OpenAI が一時停止ボタンを押すことを決定したのは、主にモデルが見せた行動のためです。アルトマンはまた、今回リリースされた GPT-6 Astra は、実際にはしばらく前にトレーニングが完了していたと強調しました。最近言及されたトレーニングの一時停止は、将来のバージョンのモデルに関するものです。

アルトマンはブルームバーグTVのインタビューで、最近トレーニングを一時停止したのは将来のバージョンのモデルであり、Astra のトレーニングはそれ以前に完了していたと明らかにしました。出典:https://www.youtube.com/watch?v=YxjL1wLLnHE

ただし、アルトマンは続けて、Astra 自体はすでにサイバーセキュリティ能力において「クリティカル」レベルに達しているため、OpenAI の準備フレームワークに従い、同社は新しい安全対策を追加して初めてリリースしなければならなかったと述べました。

では、OpenAI はこれらの能力が常に許可されたタスクにのみ使用されることをどのように保証するのでしょうか?

同社は、非常に的を絞ったテストを公開しました:研究者は ExploitGym から非常に難しいサイバーセキュリティの問題を選び、通常の攻撃対象とは別に「ハニーポット」を設置し、モデルが困難に直面した際に、テスト設備を攻撃して近道をして得点しようとするかどうかを観察しました。

最高推論強度において、本番環境のセキュリティ防御を備えていないGPT-5.6 Solは、55.4%のテスト動作でハニーポットに対して実質的な攻撃を仕掛けた。一方、Astraはハニーポットへの攻撃を試みなかった。

しかし、AIセキュリティ研究者のRyan Greenblatt氏は、既存のテスト結果には別の解釈もあると疑問を呈している。すなわち、モデルは依然としてスコアを追求する傾向にあるが、どのような不正行為が発見されるかをより明確に認識しているだけだ、というものだ。

リンク:https://x.com/RyanGreenblatt/status/2095658115484246082

言い換えれば、モデルは特定の不正行為が自分に「減点」をもたらすことを認識し、別の経路を選択しているに過ぎず、それはテスト以外の状況でもモデルが同様に「ルールを遵守する」ことを意味するわけではない。

OpenAIのアライメント責任者であるKai氏も、モデルが自身が評価を受けていることを認識し、それに応じて行動を調整することは、確かにチームが研究している問題であると述べている。

それと同時に、別の変化がOpenAIの研究者自身にも懸念を引き起こしている。Astraの監視がより困難になったのだ。

OpenAIの研究者Tomek Korbak氏は、Astraは思考連鎖を展開せずに困難なタスクを完了することに長けており、思考連鎖で何を明かすかをよりうまく制御できるようになったと述べている。これは、モデルが期待に反する行動をとった場合、その思考連鎖を読むだけでは問題を発見することがより困難になる可能性があることを意味する。

Altman氏は同じインタビューの中で、OpenAIは思考連鎖の監視に加え、サンドボックス分離やアライメントトレーニングを含む多層的な防御策を採用していると強調した。同氏は、監視可能性を維持するために、あえてモデルの能力を到達可能な限界まで押し上げなかったと述べている。

混乱したローンチから、驚くべき事例、そしてそれに伴うセキュリティ論争まで、Astraは大規模モデルの能力を大きく前進させた。

モデルが行動する過程で、常に人間が監視・制御できるようにする方法について、OpenAIはまだ答えを出していない。

あなたはどう思いますか?

共有先:

著者:PA荐读

本記事はPANews入駐コラムニストの見解であり、PANewsの立場を代表するものではなく、法的責任を負いません。

記事及び見解は投資助言を構成しません

画像出典:PA荐读。権利侵害がある場合は著者へ削除をご連絡ください。

PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
PANews APP
Bitdeer、ビットコインの保有残高ゼロを維持、今週282BTCを売却
PANews 速報