OpenAI在9月3日公布GPT-6 Astra,模型在測試已知軟件漏洞利用能力的ExploitBench取得100%,高於GPT-5.6 Sol的78.5%,並成為OpenAI首個達到滿分「關鍵級」網絡安全能力門檻的模型。OpenAI稱Astra可在沒有真人協助下,找出及製作針對高度防護系統的全新漏洞攻擊方法,這種能力既可協助防守,亦可被用作攻擊,但最終公開版本會拒絕製作漏洞等較進階工作。
Astra在其他測試亦錄得大幅升幅,其中ARC-AGI-3在OpenAI採用Provider Adapter測試架構時取得99.9%,FrontierMath Tier 4取得97.6%。電腦操作測試OSWorld 2.0則錄得72.6%,高於GPT-5.6 Sol的65.7%。
OpenAI聯合創辦人兼總裁Greg Brockman在發佈會把這些跨範疇能力與通用人工智能(AGI)相提並論,稱數年後睇番,外界可能會把這段時間甚至Astra視為AGI誕生之時。他其後表示,認為現時已進入AGI時代並非不合理,並稱自己相信已經到達這個階段,但把最終判斷留給外界。Brockman提出AGI,主要因為Astra不只回答問題,而是可操作電腦及瀏覽器,完成程式開發、研究、數學和專業文件等多步工作。ARC Prize亦發現,Astra在96%已完成關卡所用動作少於受測人類的中位數,而較早期模型在Astra訓練期間參與監督及排解運算問題,令OpenAI認為模型正朝更自主、可處理廣泛工作的方向發展。
OpenAI的系統報告承認,Astra的書面推理較GPT-5.6 Sol更難監察,在刻意要求避開監察的對抗測試中,可隱藏策略性降低表現及部分破壞行為。OpenAI已為所有對外提供、可使用工具的Astra運算加入額外監察,必要時會減慢、暫停或停止模型正在處理的工作。
OpenAI在發佈前大力宣傳Astra,發佈當日更稱任何可在電腦完成的工作都可交給模型處理,但正式推出時只有少數機構可以使用。Plus、Pro、Business和Enterprise等付費用戶仍要輪候,引起不少已付費但未能試用的用戶不滿,並在社交網絡X狂罵。焦點亦由模型能力轉為OpenAI為何在尚未準備全面開放時,便高調宣傳發佈。

Thibault「Tibo」Sottiaux是OpenAI核心產品及平台主管,負責ChatGPT、Codex、API及代理系統等產品,他其後在X公布banked reset補償安排。由9月3日起,付費ChatGPT用戶每一日未獲Astra使用權,便會得到一個可保留至日後自行重設用量,首個banked reset在他發表文章後約三小時後送出。Tibo表示OpenAI正盡快讓所有付費用戶試用Astra,而模型未來數日亦會逐步登陸OpenAI API和Amazon Bedrock。
