标题里说”API 成本降 33%”,这个数字是准的——它特指这一轮最猛的一刀:OpenAI 把旗舰 GPT-5.6 Sol 的输出 token 从 30 美元砍到 20 美元,降幅正好 33%(输入降 20%),多家媒体 8 月 22 日已坐实。全行业不是都降 33%,而是 20%–33% 不等。对靠 API 吃饭的副业党来说,结论不变:用 AI 的成本,正在肉眼可见地变便宜。本文把公开报道里的真实数字摆出来,再算算这跟你的副业有什么关系。
这一轮到底降了多少(据公开报道)
先把话说清楚:以下数据均来自公开媒体报道,不是厂商官宣稿,也不是我瞎编的精确金额。我们只在有出处的地方写数字,没出处的一律用”据公开报道”带过。
| 厂商 / 模型 | 公开报道的降价动作 | 来源 |
|---|---|---|
| OpenAI GPT-5.6(Sol 档) | 输出价从 30 美元降至 20 美元 / 百万 Token,降幅约 33%(输入从 5 美元降至 4 美元,降 20%);8 月 21 日生效,促销至少持续到 11 月 21 日;不到一个月内第二次降价 | IT之家、36氪、新浪财经,2026-08-22 |
| OpenAI 其他模型 | 上月底已下调:中端模型降约 20%,低成本模型降幅高达约 80% | 同上 |
| Google Gemini 3.7 Flash | 本月中旬发布,以”前代一半价”作为首发价(据公开报道输入约 0.75 美元、输出约 3.75 美元 / 百万 Token),半价策略据称持续至 2026-12-31 | 搜狗新闻、搜狐,2026-08 |
| Anthropic | 本月早些时候宣布取消原定涨价计划,将首发优惠价作为永久价格持续 | 多家媒体,2026-08 |
所以”降 33%”怎么来的?它对应 OpenAI GPT-5.6 Sol 的输出 token 降幅(30→20 美元,约 33%),这是 8 月 22 日多家媒体已坐实的具体数字;全行业则是 20%–33% 区间——Gemini 打半价(约 50%)、OpenAI 中端 Terra 降 20%、Anthropic 放弃原定涨价。各家口径不一,建议以各厂商定价页实时数据为准,本文数字会随时间漂移。
为什么突然打起价格战
据公开报道与分析,三股力量叠在一起:
① 开源模型倒逼。DeepSeek 这类高效开源路线把”够用且便宜”变成现实,闭源厂商不降就丢客户。报道提到,客户正转向成本极低的开源大模型。
② 资本回报焦虑。烧钱太猛、回报不确定,模型公司需要用”降价换规模”讲新故事、稳住估值。咨询机构”企业 DNA”直言这波降价速度”颇不寻常”,前沿模型正从奢侈品变成基建竞赛。
③ Agent workload 放大需求。智能体任务消耗的 Token 可能是普通聊天的十几倍,降价能直接撬动应用层用量暴涨——厂商赌的是”薄利多销”。
对副业党,这意味着什么
你是这轮降价里明确的受益方。你不做模型、不养 GPU,你只是 API 的消费者。成本降一档,下面几类副业的利润空间就松一截:
内容生成自动化。批量写小红书、公众号、商品详情、短视频脚本——调用量越大,单价下降越值钱。原来跑一套日更流水线嫌贵,现在可以放心加量。
AI 客服 / 自动回复。用模型做售前问答、工单初筛,按对话计费,降价直接压低边际成本,小本副业也能扛住 7×24。
数据处理与爬虫清洗。让模型做抽取、归类、翻译,调用频率高,单价敏感,降价等于给每条任务省出真金白银。
个人 Agent / 工作流。你搭的自动化助手跑得越勤,省钱越明显。据公开报道,Agent 类任务消耗的 Token 远高于普通聊天,所以降价对”爱折腾自动化”的人最友好。
但别高兴太早:三个提醒
1. 降价是波动的,不是永久承诺。只有 Anthropic 明确把优惠价”永久化”;OpenAI、Gemini 的促销价可能回调。副业模型别把成本假设钉死在最低点。
2. 便宜 ≠ 该浪费。成本下来了,更该做缓存、做批处理、选对口模型(重活大模型、轻活小模型),别因为便宜就无脑全用旗舰档。
3. 真正的壁垒不在调用成本,在场景。API 越便宜,同质化越严重。你能不能赚到钱,取决于你解决了哪个具体人群的具体问题,而不在于你省了几毛钱 Token。
一句行动建议
趁现在是用 AI 最便宜的时候,把你一直想做但”算不过账”的副业想法,重新算一遍账:把真实调用量套进当前公开定价(以各厂商定价页为准),如果跑通了,就动手。窗口每个星期都在开大一点,但好场景永远稀缺。
· · · · ·
📌 关注「AI智习室」,带你用”据公开报道”的谨慎姿势追 AI 行情,不吹水、不编造,只帮你把降价真正变成口袋里的利润。