资讯模型与产品··来源: Newsbytesapp·原文 →

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步

OpenAI 正式推出其最強 AI 模型 GPT-6 Astra,CEO Sam Altman 稱其為"全球最佳計算機使用、專業工作、科學、程式設計及網路安全模型"。公司總裁 Greg Brockman 認為"我們現在處於 AGI 時代並非不合理",該模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 達 99.9%,並已向 ChatGPT Plus 及企業使用者分階段開放。

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步
[广告位 · 上线后接 AdSense]

OpenAI 炸場釋出 GPT-6 Astra:這次真到 AGI 時代了?

OpenAI 最新王炸 GPT-6 Astra 來了!CEO 山姆·奧特曼直接在 X 上開香檳,稱這波是"全球最強生產力工具",碼農、科研狗、網安工程師全都能起飛。

OpenAI 二當家 Greg 更狠:"說現在是 AGI 時代沒毛病"。奧特曼補刀說這貨要掀起"新一波創業和科研革命",好傢伙,直接給科技樹點火了屬於是。


跑分屠榜:碼農要失業了?

OpenAI 直接把 Astra 吹成"史上最強程式設計外掛"。實測資料確實猛:

  • 找 Bug終端操作 直接幹翻自家 GPT-5.6 和競品 Fable
  • FrontierMath Tier 498% 正確率
  • ARC-AGI 399.9% 逆天分數

這資料就離譜,特別是 ARC-AGI 3 接近滿分,說明 AI 現在連抽象推理都快玩明白了。


真·賽博打工人:從填表到報稅一條龍

這代模型最狠的是能當數字打工人使喚:

  • 自動填表單、排會議
  • 上網查資料做科研
  • 搭網站、裝軟體、跑測試
  • 連法律文書和報稅都能整

這已經不是工具了,根本是數字員工啊!AGI 最關鍵的"多執行緒任務處理"技能點滿了。


駭客級能力+最乖AI?OpenAI 這波操作有點騷

網路安全測試直接滿分通關(沒開防護的情況下)。不過 OpenAI 馬上強調這是"最聽話的崽",暗搓搓回應之前和 Hugging Face 的安全事故。

吃瓜備註:一邊秀駭客級能力,一邊立安全人設,OpenAI 這波公關屬實拿捏了。


怎麼上車?國內使用者看這裡

現在只開放給 Daybreak 網路安全計劃 的金主爸爸。接下來一週陸續開放:

  • ChatGPT 各檔會員
  • API 黨AWS/Amazon Bedrock 使用者

奧特曼親自道歉畫餅:"在加班加點全面開放了!"

國內使用者注意:API 和 AWS 可能卡稽核,建議蹲官方訊息和國內代理商的動靜。


AGI 到底來沒來?業內吵翻了

OpenAI 直接喊出 AGI 時代,但大佬們還在 battle 標準。嚴格來說 AGI 得具備:

  • 跨領域學習能力
  • 人類級推理水平
  • 完全自主意識

Astra 跑分再猛,距離真·AGI 可能還差口氣。不過 99.9% 的 ARC-AGI 3 分數和打工人技能,確實把 AI 的深度推理工具使用帶到了新高度。具體有多神,等開發者實測見真章!

常見問題

GPT-6 Astra 與 GPT-5.6 Sol 的主要區別是什麼?

根據 OpenAI 公佈的基準測試,Astra 在漏洞檢測、終端執行等軟體工程任務中超越 GPT-5.6 Sol,並在 FrontierMath Tier 4(98%)和 ARC-AGI 3(99.9%)等推理基準中表現更優。此外,Astra 強調自主任務執行能力和網路安全對齊,可能在 Agent 架構和安全機制上有顯著改進。

中國使用者如何使用 GPT-6 Astra?

Astra 將通過 ChatGPT Plus/Pro/Business/Enterprise 訂閱、OpenAI API、AWS 和 Amazon Bedrock 開放。中國大陸使用者通常需合規網路環境訪問這些服務,且可能面臨延遲或區域限制。建議關注 OpenAI 官方公告及潛在的國內合作伙伴(如雲服務商)接入方案。

OpenAI 聲稱的'AGI 時代'是否屬實?

OpenAI 高管認為 Astra 標誌著進入 AGI 時代,但業內對 AGI 定義尚無統一標準。Astra 在特定基準測試中接近滿分,並具備自主任務執行能力,確實代表大模型能力的重要提升。然而,真正的 AGI 通常要求跨領域泛化、持續學習和接近人類水平的通用推理——Astra 是否達到這一標準,仍需更多獨立評估和實際應用驗證。

Astra 在網路安全測試中滿分,是否意味著可能被濫用?

Astra 在 ExploitBench 中取得 100% 分數(未啟用生產防護),顯示其在漏洞利用任務中的強大能力。OpenAI 強調該模型是'最對齊的',並在評估中未出現超出授權目標的情況。不過,高能力模型的雙重用途風險始終存在,使用者和監管機構需關注其訪問控制、使用日誌和濫用檢測機制。


本文基於 GNews:NewsBytes 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.newsbytesapp.com/news/science/openai-launches-gpt-6-astra-calls-it-major-step-toward-agi/story

[广告位 · 上线后接 AdSense]
标签:#OpenAI

相关 AI 工具

文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾

浏览全部工具 →

同类资讯 — 由发布时间排序

美國父母藉助 ChatGPT 協助診斷女兒罕見病:AI 醫療應用的真實案例

美國父母藉助 ChatGPT 協助診斷女兒罕見病:AI 醫療應用的真實案例

一位生物技術行業從業者母親在醫生未能確診女兒反覆生病原因時,將孩子的症狀和實驗室檢測資料輸入 ChatGPT,AI 在數秒內給出可能的免疫缺陷診斷方向。這一案例折射出 AI 聊天機器人在醫療諮詢中的快速普及——美國四分之一人口已用其診斷症狀,但專家強調需謹慎使用並注意隱私與準確性風險。

应用与案例OpenAI
Windows 11 最新更新破壞 WSL 與 Claude Cowork 功能

Windows 11 最新更新破壞 WSL 與 Claude Cowork 功能

微軟確認 Windows 11 九月安全更新 KB5124008 導致基於 Hyper-V 的 Linux 虛擬機器中 Plan9 主機資料夾共享失效,直接影響 WSL 和 Claude Cowork 無法讀取共享資料夾,應用可能顯示"未掛載 Plan9 驅動器共享"錯誤。微軟已將其列為已知問題並正在修復,但暫無補丁或臨時解決方案。

行业动态微软
Anthropic工程師警告AI或致人類滅絕 為何仍加速開發

Anthropic工程師警告AI或致人類滅絕 為何仍加速開發

Anthropic研究員Jacob Coxon因擔憂遞迴自我改進AI系統的風險而辭職,該公司安全主管隨後表示確信AI可能導致人類滅絕機率超10%。儘管以安全為使命,Anthropic仍在推進自主智慧體開發並籌備估值2萬億美元IPO,其"謹慎推進反而更危險"的邏輯引發爭議。

行业动态Anthropic
Meta 因 AI 訓練資料與人臉識別系統遭集體訴訟

Meta 因 AI 訓練資料與人臉識別系統遭集體訴訟

美國伊利諾州和加州的多名使用者向 Meta 提起集體訴訟,指控其未經同意使用 Facebook 和 Instagram 照片訓練未釋出的人臉識別系統 NameTag 及生成式 AI 模型 Emu 和 Muse Image,違反州生物識別隱私法。訴訟索賠金額可能達數十億美元,這是 Meta 繼 2020 年和 2024 年生物識別資料和解案後再次面臨重大隱私訴訟。

政策与安全Meta