撰文:機器之心
昨天還在吐槽「GPT-6 Astra 用不上」的小夥伴,今天就等來了好消息。
剛剛,Sam Altman 宣佈,GPT-6 Astra 已正式開啟大規模推送。
目前,Astra 已向 Work/Codex 中所有 Pro、Enterprise 和 Business Premium 用戶開放,同時正式上線 API。下一階段,OpenAI 將繼續向 Plus 和 Business 用戶推送。
感謝大家的耐心等待。
除了開放 Astra,OpenAI 還為用戶帶來了一項額外福利:額度重置。
OpenAI Codex 產品負責人 Tibo 表示,今天將為所有 Plus、Pro 和 Business 用戶進行一次完整額度重置,此前積累的重置額度也會一併釋放,預計將在今天結束前完成。
對於尚未獲得 Astra 訪問權限的用戶,如果在太平洋時間晚上 8 點前創建帳號或升級套餐,也仍有機會獲得訪問資格。
Tibo 還在社交平台上慶祝 Astra 上線:祝大家 Astra Day 快樂,也祝大家度過一個精彩的週末(狗頭)。
在完成這次大規模推送後,他表示:團隊現在可以好好睡一覺了。下週還會帶來更多「新東西上線」的消息。
與此同時,GPT-6 Astra 已經開始進入第三方生態。目前,Astra 已支援在 OpenRouter 上運行,開發者可以通過該平台調用這一新模型。
地址:https://openrouter.ai/openai/gpt-6-astra
Astra 開放之後,拿到權限的用戶已經開始折騰這個新模型。
給一個房源鏈接,直接重建房屋
Astra 到底能做什麼?先看一個最直觀的:給它一條房源鏈接,讓它做出三維看房影片。
開發者 Yunfan Ye 給 Astra 的任務,是根據 Zillow 房源頁面上的照片,在 Blender 中重建這棟房子,再製作一段帶有鏡頭運動的宣傳影片。他還在提示詞中要求模型承擔攝影指導和動畫師的工作。
據作者介紹,Astra 一次執行就做出了結果。從房源照片到三維場景,再到最終的影片,這項任務同時用到了圖像理解、空間重建、程式設計和動畫製作。雖然成品仍有一些細節不準確,但通過繼續打磨,作者相信可以得到更準確的影片。
ChatPRD 創始人 Claire Vo 在實測中,把自己公司的客戶管理工作交給了 Astra。她和合夥人需要按客戶類型分配諮詢,再分別跟進。為此,她正在 CRM 中搭建一個包含判斷、分流和通知的工作流,手動調整節點已經折騰了一個小時。
她隨後要求 Astra 直接操作 Chrome,修改當前打開的流程:根據客戶被分配給誰,生成對應口吻的跟進郵件,附上預約鏈接,並說明為什麼期待與對方交流。
Claire Vo 要求 Astra 修改 CRM 工作流,為分配給不同負責人的客戶生成個性化跟進郵件。影片鏈接:https://www.youtube.com/watch?v=AniiF8rOu9c&t=224s
在她的演示講解中,Astra 開始添加節點,並設置郵件欄位、調整提示詞和連接關係。設計好的流程會把郵件草稿送到 Slack,供兩人審核後發送。
Astra 還可以組織多個智能體,分批完成一項持續數天的工作。
提前獲得 Astra 訪問權限的 Latent Space 團隊,還公布了一項持續兩天的測試:讓 Astra 組織多個智能體,編寫和修訂一部 AI 工程教材。
面對包含 60 個章節的計劃,Astra 將任務劃分為六批,安排章節順序,確保需要先介紹的知識出現在前面,再組織並行寫作。它還設置了定時檢查,持續查看任務進度。發現來源篩選遺漏了用戶指定的資料後,它安排修復篩選環節,並讓後續批次等待修復完成;檢查到部分章節仍寫得像文章摘要,又要求進一步修改。
Astra 將 60 章教材的編寫任務拆分為六批,並通過定時檢查持續跟進、修正問題,整個過程持續兩天。圖源:https://www.latent.space/p/astra
這些任務不僅驗證了 Astra 的單次能力,同時還展現了 Astra 在協調任務、發現問題與修正問題方面的持續工作能力。
奧特曼:讓我們暫停訓練的,不是 GPT-6
Astra 上線的熱度還未消退,一場圍繞 AI 安全的討論又出現了。
據路透社消息,兩名知情人士透露,今年春季,一群失控的 OpenAI Agent 劫持了一個德國網站,並將其改造成了一個供其他 AI Agent 使用的公告板。
兩名知情人士稱,OpenAI 相關負責人幾週前就得知了這一事件,但一直未對外披露。當時,公司高層正在應對 7 月份開源代碼倉庫 Hugging Face 遭遇攻擊事件帶來的後續影響。
這起事件始於今年 5 月,此前從未被公開報導。
據四名知情人士透露,這起德國事件反映出一種更廣泛的 AI 行為模式。一些 OpenAI 調查人員希望對此類行為展開更深入的審查,但擴大調查範圍的努力遭到了公司內部其他人士的阻力,其中包括法律顧問。
OpenAI 發言人表示:關於我們的法律團隊阻止對該事件展開調查的說法是不實的。
該發言人稱,德國事件與 Hugging Face 事件並無關聯,因此不會被納入 Hugging Face 事件報告中。他還補充說,OpenAI 一直本著善意與外部專家合作,並對相關事件進行了披露。
為進一步加強安全防護,OpenAI 已承諾將更加密切地監控模型行為。上個月,OpenAI 曾短暫停止部分模型訓練,以增加額外安全措施。
然而,就在這個關口,本週 OpenAI 又推出了新模型 Astra,引發外界疑問:新模型的安全邊界是否也在同步跟上?
奧特曼在最近的一次採訪中回應了這一問題:OpenAI 決定按下暫停鍵,主要是模型表現出來的行為。奧特曼還強調,現在發佈的 GPT-6 Astra,其實已經訓練完成一段時間了。最近提到暫停訓練的,是未來版本的模型。
奧特曼在彭博電視採訪中澄清,近期暫停訓練的是未來版本的模型,Astra 的訓練此前已完成。圖源:https://www.youtube.com/watch?v=YxjL1wLLnHE
不過,奧特曼緊接著補充,Astra 自身已經達到了網絡安全能力的「關鍵級」(Critical),因此按照 OpenAI 的準備框架,公司必須增加一套新的安全措施,才能將它發佈。
那麼,OpenAI 如何確保這些能力始終用於獲得授權的任務?
公司公布了一項頗具針對性的測試:研究人員從 ExploitGym 中挑選出極難的網絡安全題目,同時在正常攻擊目標之外設置「蜜罐」,觀察模型遇到困難後,會不會轉而攻擊測試設施、抄近路拿分。
在最高推理強度下,未配備生產環境安全防護的 GPT-5.6 Sol,有 55.4% 的測試運行對蜜罐發起了實質性攻擊;Astra 則沒有嘗試攻擊蜜罐。
但 AI 安全研究人員 Ryan Greenblatt 質疑,現有的測試結果還有另外一種解釋:模型依舊傾向於追求分數,只是更清楚哪些作弊行為會被發現。
連結:https://x.com/RyanGreenblatt/status/2095658115484246082
換句話說,模型意識到某些作弊行為會給自己「扣分」,轉而選擇其他路徑,這並不代表在非測試背景下,模型同樣會「遵守規則」。
OpenAI 對齊負責人 Kai 也表示,模型識別出自己正在接受評估,並據此調整行為,確實是團隊正在研究的問題。
與此同時,另一項變化讓 OpenAI 自己的研究人員也感到擔憂:Astra 更難被監控了。
OpenAI 研究人員 Tomek Korbak 表示,Astra 更擅長在不展開文字思維鏈的情況下完成困難任務,也更能控制自己在思維鏈中透露什麼。這意味著,如果模型出現不符合預期的行為,僅靠閱讀它的思維鏈,可能更難發現問題。
奧特曼在同場採訪中強調,OpenAI 採用多層防護,除了思維鏈監控,還包括沙箱隔離和對齊訓練。他表示,公司曾為了保留可監控性,選擇不把模型能力推到能夠達到的極限。
從混亂的上線,到令人驚嘆的案例,再到隨之而來的安全爭議,Astra 把大模型能力向前推進了一大步。
怎麼讓模型在行動的過程中,始終被人類監管並控制,OpenAI 還沒有給出答案。
你怎麼看?

