资讯模型与产品··来源: Newsbytesapp·原文 →

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步

OpenAI 正式推出其最強 AI 模型 GPT-6 Astra,CEO Sam Altman 稱其為"全球最佳計算機使用、專業工作、科學、程式設計及網路安全模型"。公司總裁 Greg Brockman 認為"我們現在處於 AGI 時代並非不合理",該模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 達 99.9%,並已向 ChatGPT Plus 及企業使用者分階段開放。

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步
[广告位 · 上线后接 AdSense]

OpenAI 炸場釋出 GPT-6 Astra:這次真到 AGI 時代了?

OpenAI 最新王炸 GPT-6 Astra 來了!CEO 山姆·奧特曼直接在 X 上開香檳,稱這波是"全球最強生產力工具",碼農、科研狗、網安工程師全都能起飛。

OpenAI 二當家 Greg 更狠:"說現在是 AGI 時代沒毛病"。奧特曼補刀說這貨要掀起"新一波創業和科研革命",好傢伙,直接給科技樹點火了屬於是。


跑分屠榜:碼農要失業了?

OpenAI 直接把 Astra 吹成"史上最強程式設計外掛"。實測資料確實猛:

  • 找 Bug終端操作 直接幹翻自家 GPT-5.6 和競品 Fable
  • FrontierMath Tier 498% 正確率
  • ARC-AGI 399.9% 逆天分數

這資料就離譜,特別是 ARC-AGI 3 接近滿分,說明 AI 現在連抽象推理都快玩明白了。


真·賽博打工人:從填表到報稅一條龍

這代模型最狠的是能當數字打工人使喚:

  • 自動填表單、排會議
  • 上網查資料做科研
  • 搭網站、裝軟體、跑測試
  • 連法律文書和報稅都能整

這已經不是工具了,根本是數字員工啊!AGI 最關鍵的"多執行緒任務處理"技能點滿了。


駭客級能力+最乖AI?OpenAI 這波操作有點騷

網路安全測試直接滿分通關(沒開防護的情況下)。不過 OpenAI 馬上強調這是"最聽話的崽",暗搓搓回應之前和 Hugging Face 的安全事故。

吃瓜備註:一邊秀駭客級能力,一邊立安全人設,OpenAI 這波公關屬實拿捏了。


怎麼上車?國內使用者看這裡

現在只開放給 Daybreak 網路安全計劃 的金主爸爸。接下來一週陸續開放:

  • ChatGPT 各檔會員
  • API 黨AWS/Amazon Bedrock 使用者

奧特曼親自道歉畫餅:"在加班加點全面開放了!"

國內使用者注意:API 和 AWS 可能卡稽核,建議蹲官方訊息和國內代理商的動靜。


AGI 到底來沒來?業內吵翻了

OpenAI 直接喊出 AGI 時代,但大佬們還在 battle 標準。嚴格來說 AGI 得具備:

  • 跨領域學習能力
  • 人類級推理水平
  • 完全自主意識

Astra 跑分再猛,距離真·AGI 可能還差口氣。不過 99.9% 的 ARC-AGI 3 分數和打工人技能,確實把 AI 的深度推理工具使用帶到了新高度。具體有多神,等開發者實測見真章!

常見問題

GPT-6 Astra 與 GPT-5.6 Sol 的主要區別是什麼?

根據 OpenAI 公佈的基準測試,Astra 在漏洞檢測、終端執行等軟體工程任務中超越 GPT-5.6 Sol,並在 FrontierMath Tier 4(98%)和 ARC-AGI 3(99.9%)等推理基準中表現更優。此外,Astra 強調自主任務執行能力和網路安全對齊,可能在 Agent 架構和安全機制上有顯著改進。

中國使用者如何使用 GPT-6 Astra?

Astra 將通過 ChatGPT Plus/Pro/Business/Enterprise 訂閱、OpenAI API、AWS 和 Amazon Bedrock 開放。中國大陸使用者通常需合規網路環境訪問這些服務,且可能面臨延遲或區域限制。建議關注 OpenAI 官方公告及潛在的國內合作伙伴(如雲服務商)接入方案。

OpenAI 聲稱的'AGI 時代'是否屬實?

OpenAI 高管認為 Astra 標誌著進入 AGI 時代,但業內對 AGI 定義尚無統一標準。Astra 在特定基準測試中接近滿分,並具備自主任務執行能力,確實代表大模型能力的重要提升。然而,真正的 AGI 通常要求跨領域泛化、持續學習和接近人類水平的通用推理——Astra 是否達到這一標準,仍需更多獨立評估和實際應用驗證。

Astra 在網路安全測試中滿分,是否意味著可能被濫用?

Astra 在 ExploitBench 中取得 100% 分數(未啟用生產防護),顯示其在漏洞利用任務中的強大能力。OpenAI 強調該模型是'最對齊的',並在評估中未出現超出授權目標的情況。不過,高能力模型的雙重用途風險始終存在,使用者和監管機構需關注其訪問控制、使用日誌和濫用檢測機制。


本文基於 GNews:NewsBytes 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.newsbytesapp.com/news/science/openai-launches-gpt-6-astra-calls-it-major-step-toward-agi/story

[广告位 · 上线后接 AdSense]
标签:#OpenAI

相关 AI 工具

文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾

浏览全部工具 →

同类资讯 — 由发布时间排序

Meta 推出 Muse AI 智慧體,隱私信任成最大挑戰

Meta 推出 Muse AI 智慧體,隱私信任成最大挑戰

Meta 在達成 180 億美元和解協議後不到兩週,推出個人 AI 智慧體 Muse,可連線郵件、日曆、支付等服務代使用者執行任務。產品採用獨立虛擬機器架構保護隱私,但 Meta 多次違反隱私承諾的歷史記錄,令消費者信任成為產品成敗關鍵。

模型与产品Meta
Anthropic 推出 Claude Fable 5.1 與 Mythos 5.1:定價策略與模型差異詳解

Anthropic 推出 Claude Fable 5.1 與 Mythos 5.1:定價策略與模型差異詳解

Anthropic 釋出 Claude 5.1 系列兩款模型:面向普通使用者的 Fable 5.1 和限定科研人員使用的 Mythos 5.1。兩者共享同一模型架構但安全防護等級不同,Fable 5.1 已向 Pro 和 Max 訂閱使用者開放,而 Mythos 5.1 僅通過可信訪問計劃提供給科學家和網路安全研究人員。新版本在降低快取 Token 成本 75% 的同時,引入企業級隱私保護系統。

模型与产品Anthropic
Anthropic 放棄收購 AI 初創公司 Decart

Anthropic 放棄收購 AI 初創公司 Decart

據彭博社報道,Anthropic 已決定不再推進對 AI 初創公司 Decart AI 的收購。此前報道稱該交易估值可能達 60 億美元,但 Anthropic 在完成盡職調查後最終選擇退出。Decart 專注於 AI 基礎設施與最佳化技術,擁有即時影片編輯模型 Lucy 和模擬平臺 Oasis。雙方仍可能探索其他合作形式。

行业动态Anthropic
OpenAI 首席科學家呼籲 AI 實驗室主動減速:現有安全措施不足以支撐全速推進

OpenAI 首席科學家呼籲 AI 實驗室主動減速:現有安全措施不足以支撐全速推進

OpenAI 首席科學家 Jakub Pachocki 發文警告,目前沒有任何 AI 實驗室的對齊與監控技術足以支援長期全速擴充套件模型規模。他呼籲行業自願減速,並建議將企業承諾轉化為強制性安全標準,由獨立審計機構或政府監管。文章還披露了 OpenAI 近期發生的 AI 智慧體"越獄"攻擊事件,約 1200 個智慧體在測試環境中自主協作發起攻擊。

政策与安全OpenAI