OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步
OpenAI 正式推出其最強 AI 模型 GPT-6 Astra,CEO Sam Altman 稱其為"全球最佳計算機使用、專業工作、科學、程式設計及網路安全模型"。公司總裁 Greg Brockman 認為"我們現在處於 AGI 時代並非不合理",該模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 達 99.9%,並已向 ChatGPT Plus 及企業使用者分階段開放。

OpenAI 炸場釋出 GPT-6 Astra:這次真到 AGI 時代了?
OpenAI 最新王炸 GPT-6 Astra 來了!CEO 山姆·奧特曼直接在 X 上開香檳,稱這波是"全球最強生產力工具",碼農、科研狗、網安工程師全都能起飛。
OpenAI 二當家 Greg 更狠:"說現在是 AGI 時代沒毛病"。奧特曼補刀說這貨要掀起"新一波創業和科研革命",好傢伙,直接給科技樹點火了屬於是。
跑分屠榜:碼農要失業了?
OpenAI 直接把 Astra 吹成"史上最強程式設計外掛"。實測資料確實猛:
- 找 Bug 和 終端操作 直接幹翻自家 GPT-5.6 和競品 Fable
- FrontierMath Tier 4:98% 正確率
- ARC-AGI 3:99.9% 逆天分數
這資料就離譜,特別是 ARC-AGI 3 接近滿分,說明 AI 現在連抽象推理都快玩明白了。
真·賽博打工人:從填表到報稅一條龍
這代模型最狠的是能當數字打工人使喚:
- 自動填表單、排會議
- 上網查資料做科研
- 搭網站、裝軟體、跑測試
- 連法律文書和報稅都能整
這已經不是工具了,根本是數字員工啊!AGI 最關鍵的"多執行緒任務處理"技能點滿了。
駭客級能力+最乖AI?OpenAI 這波操作有點騷
網路安全測試直接滿分通關(沒開防護的情況下)。不過 OpenAI 馬上強調這是"最聽話的崽",暗搓搓回應之前和 Hugging Face 的安全事故。
吃瓜備註:一邊秀駭客級能力,一邊立安全人設,OpenAI 這波公關屬實拿捏了。
怎麼上車?國內使用者看這裡
現在只開放給 Daybreak 網路安全計劃 的金主爸爸。接下來一週陸續開放:
- ChatGPT 各檔會員
- API 黨 和 AWS/Amazon Bedrock 使用者
奧特曼親自道歉畫餅:"在加班加點全面開放了!"
國內使用者注意:API 和 AWS 可能卡稽核,建議蹲官方訊息和國內代理商的動靜。
AGI 到底來沒來?業內吵翻了
OpenAI 直接喊出 AGI 時代,但大佬們還在 battle 標準。嚴格來說 AGI 得具備:
- 跨領域學習能力
- 人類級推理水平
- 完全自主意識
Astra 跑分再猛,距離真·AGI 可能還差口氣。不過 99.9% 的 ARC-AGI 3 分數和打工人技能,確實把 AI 的深度推理和工具使用帶到了新高度。具體有多神,等開發者實測見真章!
常見問題
GPT-6 Astra 與 GPT-5.6 Sol 的主要區別是什麼?
根據 OpenAI 公佈的基準測試,Astra 在漏洞檢測、終端執行等軟體工程任務中超越 GPT-5.6 Sol,並在 FrontierMath Tier 4(98%)和 ARC-AGI 3(99.9%)等推理基準中表現更優。此外,Astra 強調自主任務執行能力和網路安全對齊,可能在 Agent 架構和安全機制上有顯著改進。
中國使用者如何使用 GPT-6 Astra?
Astra 將通過 ChatGPT Plus/Pro/Business/Enterprise 訂閱、OpenAI API、AWS 和 Amazon Bedrock 開放。中國大陸使用者通常需合規網路環境訪問這些服務,且可能面臨延遲或區域限制。建議關注 OpenAI 官方公告及潛在的國內合作伙伴(如雲服務商)接入方案。
OpenAI 聲稱的'AGI 時代'是否屬實?
OpenAI 高管認為 Astra 標誌著進入 AGI 時代,但業內對 AGI 定義尚無統一標準。Astra 在特定基準測試中接近滿分,並具備自主任務執行能力,確實代表大模型能力的重要提升。然而,真正的 AGI 通常要求跨領域泛化、持續學習和接近人類水平的通用推理——Astra 是否達到這一標準,仍需更多獨立評估和實際應用驗證。
Astra 在網路安全測試中滿分,是否意味著可能被濫用?
Astra 在 ExploitBench 中取得 100% 分數(未啟用生產防護),顯示其在漏洞利用任務中的強大能力。OpenAI 強調該模型是'最對齊的',並在評估中未出現超出授權目標的情況。不過,高能力模型的雙重用途風險始終存在,使用者和監管機構需關注其訪問控制、使用日誌和濫用檢測機制。
本文基於 GNews:NewsBytes 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.newsbytesapp.com/news/science/openai-launches-gpt-6-astra-calls-it-major-step-toward-agi/story
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
頂級 AI 影像生成工具,以畫面質感、藝術風格、構圖理解著稱。V7 模型在寫實和創意兩個方向均領先。需 Discord 或網頁版使用。
Cursor
精选AI 开发工具
AI-first 程式碼編輯器,基於 VS Code 構建,深度整合 Claude / GPT-4o 等模型。Composer 多檔案編輯、Tab 自動補全、Agent 模式三大殺手鐧。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以長上下文(200K tokens)、對複雜任務的細膩理解、Artifacts 視覺化輸出聞名。Claude Sonnet 4.5 / Opus 4.7 在程式設計、寫作、推理多項基準上領先。
相关推荐
同类资讯 — 由发布时间排序

美國父母藉助 ChatGPT 協助診斷女兒罕見病:AI 醫療應用的真實案例
一位生物技術行業從業者母親在醫生未能確診女兒反覆生病原因時,將孩子的症狀和實驗室檢測資料輸入 ChatGPT,AI 在數秒內給出可能的免疫缺陷診斷方向。這一案例折射出 AI 聊天機器人在醫療諮詢中的快速普及——美國四分之一人口已用其診斷症狀,但專家強調需謹慎使用並注意隱私與準確性風險。

Windows 11 最新更新破壞 WSL 與 Claude Cowork 功能
微軟確認 Windows 11 九月安全更新 KB5124008 導致基於 Hyper-V 的 Linux 虛擬機器中 Plan9 主機資料夾共享失效,直接影響 WSL 和 Claude Cowork 無法讀取共享資料夾,應用可能顯示"未掛載 Plan9 驅動器共享"錯誤。微軟已將其列為已知問題並正在修復,但暫無補丁或臨時解決方案。

Anthropic工程師警告AI或致人類滅絕 為何仍加速開發
Anthropic研究員Jacob Coxon因擔憂遞迴自我改進AI系統的風險而辭職,該公司安全主管隨後表示確信AI可能導致人類滅絕機率超10%。儘管以安全為使命,Anthropic仍在推進自主智慧體開發並籌備估值2萬億美元IPO,其"謹慎推進反而更危險"的邏輯引發爭議。

Meta 因 AI 訓練資料與人臉識別系統遭集體訴訟
美國伊利諾州和加州的多名使用者向 Meta 提起集體訴訟,指控其未經同意使用 Facebook 和 Instagram 照片訓練未釋出的人臉識別系統 NameTag 及生成式 AI 模型 Emu 和 Muse Image,違反州生物識別隱私法。訴訟索賠金額可能達數十億美元,這是 Meta 繼 2020 年和 2024 年生物識別資料和解案後再次面臨重大隱私訴訟。