月之暗面 Kimi K3 訂閱因需求激增暫停 推出 2.8 萬億引數模型
中國 AI 初創公司月之暗面(Moonshot AI)宣佈暫停其最新模型 Kimi K3 的新使用者訂閱,原因是過去 48 小時需求激增導致算力接近極限。該公司正加速擴容並將分批重啟訂閱,同時計劃拆分會員體系以最佳化資源分配。Kimi K3 是全球首個開源 3T 級引數模型,擁有 2.8 萬億引數和 100 萬 token 上下文視窗。

中國AI新銳月之暗面(Moonshot AI)最近攤上"幸福的煩惱"——剛推出的Kimi K3模型太火爆,直接暫停新使用者訂閱了。
算力告急:48小時被擠爆
月之暗面在官微上喊話:過去兩天使用者量直接頂到算力天花板。為了保證老鐵們的使用體驗,只能先關門謝客,把資源優先留給已付費使用者。"現有會員不受影響",官方特別強調。
團隊正在緊急擴容,承諾會分批重新開放註冊。這波操作在國內大模型圈相當少見,可見頭部玩家在使用者規模和燒錢速度之間找平衡有多難。
會員分家:精準匹配需求
為了應對算力壓力,月之暗面祭出新招——推出兩套會員體系:
- Kimi會員:覆蓋網頁版、App和Kimi Work
- Kimi Code會員:專治程式設計師的各種需求
這波拆分就是要把算力用在刀刃上,避免寫程式碼的和普通使用者搶資源。對國內使用者來說選擇更靈活了,不過具體價格還是個謎。
Kimi K3硬核引數
作為當家花旦,Kimi K3的配置相當能打:
- 2.8萬億引數,官方號稱"全球首個開源3T級模型"
- 100萬token上下文視窗,長篇文件處理神器
- 主打程式設計輔助、知識工作和複雜推理這些高階局
目前已經在Kimi全家桶(網頁/App/Work/Code/API)上線。預設開啟最強腦力模式,省電模式和狂暴模式後續會OTA升級。
最狠的是官方立下flag:2026年7月27日前必開源,給開發者吃了顆定心丸。
效能對標:承認差距但很能打
月之暗面在技術部落格裡很實在:Kimi K3確實達到了第一梯隊水平,但也坦白還幹不過Claude Fable 5和GPT 5.6 SoI(注:疑似未來版本代號)。
這波坦誠在國內AI圈相當罕見——不吹牛直接認慫,反而讓人更期待後續迭代。
國內使用者最關心的三點
對咱們開發者和企業來說,Kimi K3的香主要在:
- 100萬token上下文簡直是合同黨、論文黨的福音
- 開源承諾意味著以後部署能省不少錢(雖然要等到2026)
- 會員分家可能更省錢(不寫程式碼就不用為程式設計功能買單)
不過要注意,現在算力緊張可能導致服務抽風,API穩定性也有待考驗。
常見問題
Kimi K3 何時恢復新使用者訂閱?
月之暗面表示將分批次重新開放訂閱名額,但未給出具體時間表。建議關注官方社交媒體或 Kimi.com 公告。
2.8 萬億引數模型在國產大模型中處於什麼水平?
屬於國內頭部規模。通常認為,3T 級引數模型在複雜推理和長文本理解上具有優勢,但實際效能還取決於訓練資料質量和架構設計。Kimi K3 是首個公開宣佈的國產開源 3T 級模型。
Kimi Code Membership 適合哪些使用者?
專為程式設計場景設計,可能更適合需要頻繁程式碼生成、除錯或技術文件處理的開發者。若主要用於文本問答或辦公場景,通用 Kimi Membership 可能更經濟。
100 萬 token 上下文視窗意味著什麼?
可一次性處理約 75 萬漢字(token 數與字元數比例因語言而異)。實際應用中,能完整讀入一本中篇小說或數十頁技術文件,適合需要全域性理解的任務。
模型權重開源後能否本地部署?
理論上可以,但 2.8T 引數模型對硬體要求極高(通常需要多卡 GPU 叢集)。中小企業更可能通過 API 或雲服務使用,完全本地部署成本較高。
本文基於 GNews:The Tribune 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.tribuneindia.com/news/business/chinas-moonshot-ai-pauses-new-kimi-k3-subscriptions-amid-surge-in-demand/
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
頂級 AI 影像生成工具,以畫面質感、藝術風格、構圖理解著稱。V7 模型在寫實和創意兩個方向均領先。需 Discord 或網頁版使用。
Cursor
精选AI 开发工具
AI-first 程式碼編輯器,基於 VS Code 構建,深度整合 Claude / GPT-4o 等模型。Composer 多檔案編輯、Tab 自動補全、Agent 模式三大殺手鐧。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以長上下文(200K tokens)、對複雜任務的細膩理解、Artifacts 視覺化輸出聞名。Claude Sonnet 4.5 / Opus 4.7 在程式設計、寫作、推理多項基準上領先。
相关推荐
同类资讯 — 由发布时间排序

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步
OpenAI 正式推出其最強 AI 模型 GPT-6 Astra,CEO Sam Altman 稱其為"全球最佳計算機使用、專業工作、科學、程式設計及網路安全模型"。公司總裁 Greg Brockman 認為"我們現在處於 AGI 時代並非不合理",該模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 達 99.9%,並已向 ChatGPT Plus 及企業使用者分階段開放。

OpenAI、Anthropic 與 xAI 同日宕機:各家回應不一致引發猜測
2024 年 9 月 3 日上午,OpenAI ChatGPT、Anthropic Claude 和 xAI Grok 三大前沿 AI 模型服務同時出現罕見宕機。xAI 將問題歸因於孟菲斯計算中心故障,OpenAI 稱系路由錯誤,而 Anthropic 拒絕評論具體原因。三家公司均未指向共同的第三方服務商,但時間上的巧合仍引發行業對基礎設施依賴性的關注。

Meta 推出 Muse Spark 模型差異化定價:共享資料最高降價 95%
Meta 為其新發布的 Muse Spark 代理模型推出雙軌定價策略,使用者若同意共享提示詞和模型輸出用於訓練,可享受最高 95% 的價格折扣。這一機制將資料貢獻明碼標價,反映出 AI 公司在獲取高質量訓練資料(尤其是代理工具使用資料)方面的迫切需求,同時也可能重塑企業客戶對資料共享的決策邏輯。

ChatGPT、Claude 與 Grok 同時宕機引發 GPT-6 Astra 猜測升溫
2026年9月3日,OpenAI 的 ChatGPT、Anthropic 的 Claude 以及 xAI 的 Grok 三大主流 AI 平臺幾乎同時出現服務中斷,影響網頁、移動端及 API 使用者。宕機發生時恰逢 OpenAI 在社交媒體釋出"星辰即將對齊"的神秘預告,引發業內對下一代模型 GPT-6 Astra 即將釋出的廣泛猜測。