谷歌 Gemini AI 新计费规则详解:按算力收费与额度查询指南
谷歌已将 Gemini AI 的计费方式从"请求次数"改为"算力消耗",不同复杂度的任务消耗不同额度。免费用户、Plus($8/月)、Pro($20/月)和 Ultra($100-200/月)套餐的额度分别为基准、2倍、4倍和5-20倍,并支持每5小时和每周重置。用户可在设置中查看实时用量,但谷歌保留根据容量动态调整限额的权利。

从"次数计费"到"算力计费",谷歌这次玩真的了!
今年夏天,谷歌对旗下 Gemini AI 进行大升级,最狠的是直接把计费规则改了:不看你用了多少次,就看你的请求有多烧算力。
说白了就是:以前一天能肝3个视频,现在要是内容太复杂,可能只能肝2个。官方文档写得明明白白,额度消耗看三点:
- 你开的啥套餐(白嫖党还是氪金大佬)
- 任务有多难(查天气和写代码能一样吗)
- 选的啥模型(Gemini 3.5 Flash、Pro这些)
模型可以手动切换,但越牛逼的模型烧额度越快。
四档套餐价格大公开
美国用户可选四档(国内小伙伴先看能不能用):
| 套餐 | 月费 | 额度倍数 |
|---|---|---|
| 白嫖版 | $0 | 基准线 |
| AI Plus | $8 | 2倍 |
| AI Pro | $20 | 4倍 |
| AI Ultra | $100/$200 | 5倍/20倍 |
所有用户都能用 Flash-Lite、Flash 和 Pro 三种模型,但越高级的越烧钱。模型还分三种"思考模式"(Standard、Extended、Deep Think),响应质量和额度消耗都不同。
上下文窗口区别更大:
- 白嫖党:32K tokens(约2.4万词)
- Plus用户:128K tokens(约9.6万词)
- Pro/Ultra大佬:100万 tokens(约75万词)
怎么查自己还剩多少额度?
查余额姿势:
- 网页端:左下角齿轮 → Usage limits
- 手机端:左上角菜单 → 齿轮 → Usage limits
会看到两条进度条:
- 5小时限额:用完等CD(页面有倒计时)
- 每周限额:每周刷新一次
氪金大佬用完额度也不会直接凉凉,系统会自动降级到最基础模型。
这些坑你得知道
谷歌明说了:"看服务器心情随时改限额",白嫖党首当其冲。这种骚操作虽然方便谷歌,但用户就很蛋疼——今天能用的额度可能比昨天少一半。
国内用户特别注意:
- 可能要科学上网
- 付费得用国际支付
- 稳定性?谷歌没保证
本文基于 GNews:WIRED 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.wired.com/story/how-googles-new-gemini-rates-work-and-how-to-track-your-usage/
常见问题
- 为什么我的 Gemini 请求突然被限制了?
- 谷歌已从按次数计费改为按算力消耗计费。若你使用了更复杂的模型(如 Pro)、更深度的思考模式(Deep Think)或生成视频等高算力任务,会更快触及5小时或每周限额。可在设置的 Usage limits 中查看实时用量。
- 免费版和 AI Plus($8/月)的实际差异有多大?
- AI Plus 的算力额度是免费版的2倍,且上下文窗口从3.2万词扩展到9.6万词,适合需要长对话或批量处理任务的用户。但谷歌未公开免费版的具体基准额度,实际体验可能因任务类型差异较大。
- 付费后是否能完全避免限额?
- 不能。即使是最高档的 AI Ultra($200/月),仍有每周限额(虽然是 Pro 版的20倍)。触及限额后会降级到基础模型,而非完全停用。此外,谷歌保留根据服务器容量动态调整限额的权利,可能无预警变更。
- 中国大陆用户如何使用 Gemini 付费服务?
- 目前 Gemini 在中国大陆可能需要特定网络环境访问,且付费订阅通常需要国际信用卡或 Google Pay。建议先测试免费版可用性,再考虑付费。官方未针对中国市场提供本地化支付或服务保障。
- 如何选择合适的 Gemini 模型和思考深度?
- 简单查询(如翻译、摘要)可用 Flash-Lite + Standard 模式节省额度;复杂任务(如代码生成、长文档分析)可选 Pro + Extended 或 Deep Think。可在输入框手动切换模型,建议先用低配模型测试,不满意再升级。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

OpenAI 发布 GPT-6 Astra 模型:声称迈入 AGI 时代的关键一步
OpenAI 正式推出其最强 AI 模型 GPT-6 Astra,CEO Sam Altman 称其为"全球最佳计算机使用、专业工作、科学、编程及网络安全模型"。公司总裁 Greg Brockman 认为"我们现在处于 AGI 时代并非不合理",该模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 达 99.9%,并已向 ChatGPT Plus 及企业用户分阶段开放。

OpenAI、Anthropic 与 xAI 同日宕机:各家回应不一致引发猜测
2024 年 9 月 3 日上午,OpenAI ChatGPT、Anthropic Claude 和 xAI Grok 三大前沿 AI 模型服务同时出现罕见宕机。xAI 将问题归因于孟菲斯计算中心故障,OpenAI 称系路由错误,而 Anthropic 拒绝评论具体原因。三家公司均未指向共同的第三方服务商,但时间上的巧合仍引发行业对基础设施依赖性的关注。

Meta 推出 Muse Spark 模型差异化定价:共享数据最高降价 95%
Meta 为其新发布的 Muse Spark 代理模型推出双轨定价策略,用户若同意共享提示词和模型输出用于训练,可享受最高 95% 的价格折扣。这一机制将数据贡献明码标价,反映出 AI 公司在获取高质量训练数据(尤其是代理工具使用数据)方面的迫切需求,同时也可能重塑企业客户对数据共享的决策逻辑。

ChatGPT、Claude 与 Grok 同时宕机引发 GPT-6 Astra 猜测升温
2026年9月3日,OpenAI 的 ChatGPT、Anthropic 的 Claude 以及 xAI 的 Grok 三大主流 AI 平台几乎同时出现服务中断,影响网页、移动端及 API 用户。宕机发生时恰逢 OpenAI 在社交媒体发布"星辰即将对齐"的神秘预告,引发业内对下一代模型 GPT-6 Astra 即将发布的广泛猜测。