资讯模型与产品··来源: Tribuneindia·原文 →

月之暗面 Kimi K3 订阅因需求激增暂停 推出 2.8 万亿参数模型

中国 AI 初创公司月之暗面(Moonshot AI)宣布暂停其最新模型 Kimi K3 的新用户订阅,原因是过去 48 小时需求激增导致算力接近极限。该公司正加速扩容并将分批重启订阅,同时计划拆分会员体系以优化资源分配。Kimi K3 是全球首个开源 3T 级参数模型,拥有 2.8 万亿参数和 100 万 token 上下文窗口。

月之暗面 Kimi K3 订阅因需求激增暂停 推出 2.8 万亿参数模型
[广告位 · 上线后接 AdSense]

中国AI新锐月之暗面(Moonshot AI)最近摊上"幸福的烦恼"——刚推出的Kimi K3模型太火爆,直接暂停新用户订阅了。

算力告急:48小时被挤爆

月之暗面在官微上喊话:过去两天用户量直接顶到算力天花板。为了保证老铁们的使用体验,只能先关门谢客,把资源优先留给已付费用户。"现有会员不受影响",官方特别强调。

团队正在紧急扩容,承诺会分批重新开放注册。这波操作在国内大模型圈相当少见,可见头部玩家在用户规模和烧钱速度之间找平衡有多难。

会员分家:精准匹配需求

为了应对算力压力,月之暗面祭出新招——推出两套会员体系

  • Kimi会员:覆盖网页版、App和Kimi Work
  • Kimi Code会员:专治程序员的各种需求

这波拆分就是要把算力用在刀刃上,避免写代码的和普通用户抢资源。对国内用户来说选择更灵活了,不过具体价格还是个谜。

Kimi K3硬核参数

作为当家花旦,Kimi K3的配置相当能打:

  • 2.8万亿参数,官方号称"全球首个开源3T级模型"
  • 100万token上下文窗口,长篇文档处理神器
  • 主打编程辅助、知识工作和复杂推理这些高端局

目前已经在Kimi全家桶(网页/App/Work/Code/API)上线。默认开启最强脑力模式,省电模式和狂暴模式后续会OTA升级。

最狠的是官方立下flag:2026年7月27日前必开源,给开发者吃了颗定心丸。

性能对标:承认差距但很能打

月之暗面在技术博客里很实在:Kimi K3确实达到了第一梯队水平,但也坦白还干不过Claude Fable 5和GPT 5.6 SoI(注:疑似未来版本代号)。

这波坦诚在国内AI圈相当罕见——不吹牛直接认怂,反而让人更期待后续迭代。

国内用户最关心的三点

对咱们开发者和企业来说,Kimi K3的香主要在:

  1. 100万token上下文简直是合同党、论文党的福音
  2. 开源承诺意味着以后部署能省不少钱(虽然要等到2026)
  3. 会员分家可能更省钱(不写代码就不用为编程功能买单)

不过要注意,现在算力紧张可能导致服务抽风,API稳定性也有待考验。


本文基于 GNews:The Tribune 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.tribuneindia.com/news/business/chinas-moonshot-ai-pauses-new-kimi-k3-subscriptions-amid-surge-in-demand/

常见问题

Kimi K3 何时恢复新用户订阅?
月之暗面表示将分批次重新开放订阅名额,但未给出具体时间表。建议关注官方社交媒体或 Kimi.com 公告。
2.8 万亿参数模型在国产大模型中处于什么水平?
属于国内头部规模。通常认为,3T 级参数模型在复杂推理和长文本理解上具有优势,但实际性能还取决于训练数据质量和架构设计。Kimi K3 是首个公开宣布的国产开源 3T 级模型。
Kimi Code Membership 适合哪些用户?
专为编程场景设计,可能更适合需要频繁代码生成、调试或技术文档处理的开发者。若主要用于文本问答或办公场景,通用 Kimi Membership 可能更经济。
100 万 token 上下文窗口意味着什么?
可一次性处理约 75 万汉字(token 数与字符数比例因语言而异)。实际应用中,能完整读入一本中篇小说或数十页技术文档,适合需要全局理解的任务。
模型权重开源后能否本地部署?
理论上可以,但 2.8T 参数模型对硬件要求极高(通常需要多卡 GPU 集群)。中小企业更可能通过 API 或云服务使用,完全本地部署成本较高。
[广告位 · 上线后接 AdSense]
标签:#Anthropic

相关 AI 工具

文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾

浏览全部工具 →

同类资讯 — 由发布时间排序

Pangram 获 900 万美元融资,与 Substack 合作推 AI 内容检测工具

Pangram 获 900 万美元融资,与 Substack 合作推 AI 内容检测工具

AI 生成内容正渗透到求职简历、产品评论甚至保险理赔中,互联网信任危机加剧。AI 检测初创公司 Pangram 近期完成 900 万美元融资,并与内容订阅平台 Substack 达成合作,为读者标注作者是否使用 AI 撰写文章。该公司还推出了新的 AI 图像检测工具,试图成为互联网的"信任层"。

行业动态AI 安全
谷歌推出 Fairwind 计划:用 Gemini 3.8 Flash Cyber 自动修复漏洞

谷歌推出 Fairwind 计划:用 Gemini 3.8 Flash Cyber 自动修复漏洞

谷歌启动 Fairwind 限定访问计划,向政府和关键基础设施运营商提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,实现漏洞自动发现与修复。该计划已吸引全球超 650 家合作伙伴,将人工修复周级任务压缩至分钟级,重点保护公共部门、能源医疗等关键领域。谷歌同步承诺通过 Google.org 在全球投入超 1 亿美元网络安全资金。

应用与案例谷歌
OpenAI 新模型 Astra 因网络安全风险延迟发布 强化防护后即将推出

OpenAI 新模型 Astra 因网络安全风险延迟发布 强化防护后即将推出

OpenAI 宣布即将发布新一代模型 Astra,但因今年夏季发生的网络攻击事件,公司暂停开发两周并全面强化安全措施。Astra 被列为首个达到"关键网络安全阈值"的模型,意味着其具备发现和利用网络安全漏洞的能力。发布后将限制高级功能访问,仅向少数测试者开放。

模型与产品OpenAI
谷歌推出 Google Pics 图像生成编辑工具并集成至 Workspace

谷歌推出 Google Pics 图像生成编辑工具并集成至 Workspace

谷歌宣布面向 Google AI Pro/Ultra 订阅用户及多数 Workspace 企业客户推出 Google Pics,这是一款基于 Nano Banana 模型的图像生成与编辑工具。该产品既可独立使用,也将集成到 Docs、Slides 和 Drive 中,支持对象分割、图内文字编辑翻译、多人协作等功能,让用户无需跨应用切换即可完成图像创作。

模型与产品谷歌