AI 资讯行业动态 · 更新于 2026年9月20日 · 3 分钟阅读

打工人福音:国产顶级大模型白菜价,12 元跑百万字,缓存命中只要 1.5 元

打工人福音:国产顶级大模型白菜价,12 元跑百万字,缓存命中只要 1.5 元
本文目录

打工人福音:国产顶级大模型白菜价,12 元跑百万字,缓存命中只要 1.5 元

大模型一直在涨价?不,这一次轮到国产厂商把价格打下来了。2026 年 8 月 3 日,阿里发布旗舰模型 Qwen3.8-Max,智能水平直逼 Claude,但价格只有国际顶流的零头——国内每百万 Tokens 输入仅 12 元。

价格到底有多狠?

  • 输入:12 元/百万 Tokens,大约是 100 万字的量级
  • 输出:36 元/百万 Tokens
  • 缓存命中:仅 1.5 元/百万 Tokens——反复问同一批资料,几乎不要钱

横向对比:Qwen3.8-Max 的国际定价只有 Opus 5 的 40%(输入)和 24%(输出)。也就是说,同样顶级的智能,花不到一半的钱。

这对打工人意味着什么?

如果你用 AI 写周报、做数据分析、翻译文档、写代码,以前可能因为 API 贵而省着用;现在 12 元/百万字的价格,意味着你完全可以放开用。

举个直观的例子:一篇 2000 字的报告,用 Qwen3.8-Max 生成,成本约 0.07 元——连一块钱都不到。

为什么国产模型敢卖这么便宜?

一是技术路线:稀疏 MoE 架构让推理成本大幅下降;二是市场策略:用低价抢开发者生态,再通过生态反哺。对用户来说,这是实打实的红利期。

提醒一句

价格便宜归便宜,使用前还是建议先小额试用、核对输出质量,重要工作留人工把关。

你现在用的 AI 工具一个月花多少钱?评论区聊聊。

便宜之后,哪些用法终于划算了

价格降下来,改变的不只是”省钱”,而是”有些以前不敢做的事现在敢做了”。举几个具体的:

  • 批量处理。以前一百份文档要算成本,现在可以直接全量跑一遍,再挑不合适的重做。批量试错的成本大幅下降。
  • 反复迭代。同一段内容改五遍、十遍,在旧价格下是要犹豫的,现在几乎不用考虑。而”多改几遍”恰恰是内容质量提升最有效的手段。
  • 长上下文分析。把整份资料放进上下文再提问,比切成小段问准确得多。长上下文消耗的 token 更多,但价格下来之后这个用法就成立了。

要提醒的是:便宜不等于该无条件用。输出质量仍需核对,重要内容一定要人工过一遍。另外”缓存命中只要 1.5 元”的前提是同一批上下文被反复提问,如果你的用法是每次都换新内容,享受不到这部分优惠。

想省钱,三个能立刻用的习惯

  1. 提问前先精简。把无关的聊天记录、冗余背景删掉再发。上下文越长,成本越高。
  2. 同类任务合并处理。一次给一批相似任务,比一个一个追问更省。
  3. 固定模板复用。每次用同一套提示词结构,既稳定又能命中缓存。提示词基础可以看 Prompt 提示词零基础学习。

去哪用

网页端直接对话是最省事的方式,入口见 千问。日常办公场景的落地用法可以对照 AI 办公工具 合集;想横向比较不同对话模型的中文表现,看 AI 聊天工具。价格后续若有调整,产品发布 栏目会跟进。

Avatar photo

龙主编

龙主编,AI智习室官方媒体主编。 专注 AI 行业观察与实操分享,擅长将复杂技术转化为通俗易懂的实战指南。 坚信 AI 不是取代人类,而是赋能每个人。 内容风格: 真实案例 + 详细干货 + 可操作性 使命: 让普通人也能抓住 AI 时代的红利。