OpenAI 将其小型 AI 模型的价格下调了 80%,距离发布仅三周
OpenAI 于 7 月 9 日推出了其 GPT-5.6 模型系列。7 月 30 日,这家公司把其中最小的一个模型价格降到了原来的五分之一。两者之间只隔了三周。刚好够把一杯吃了一半的酸奶吃完。
用这个模型生成相当于七本小说的内容,原本要花 6 美元。现在只要 1.20 美元。而这次降价可不是什么假期礼物。
数字上发生了什么变化
我们先从一个到处都在出现的词说起:令牌,英文叫 token。它是一小段文字,模型会把它吞进去,再吐出来。一百万个令牌大致相当于 700,000 个词。也就是七八本小说。我们给模型阅读的内容,也就是输入,和它写出来的内容,也就是输出,是分开付费的。输出始终贵得多。
小型模型遭遇了迎头痛击般的打折。高端模型则一分钱都没动。
以下是三个系列的详细情况:
- Luna,快速的小型模型:输入价格从 1 美元降至 20 美分,输出价格从 6 美元降至 1.20 美元。降幅为 80%。
- Terra,中端模型:输入价格从 2.50 美元降至 2 美元,输出价格从 15 美元降至 12 美元。降幅为 20%。
- Sol,高端模型:输入价格仍为 5 美元,输出价格仍为 30 美元。什么都没降。一分钱都没有。
最后这一点比前两点说明了更多问题。只要旁边没人用更低的价格提供同样的东西,奢侈品货架就不会打折。
官方解释,以及我们猜得到的解释
OpenAI 用技术进步解释这次降价:总运营成本降低了 20%,生成令牌的效率提高了超过 15%。这大概是真的。但这解释不了为什么几乎全部降幅都集中在最小的模型上。
另一个解释可以归结为一个名字:DeepSeek。它的 V4 Flash 版本输入价格为 14 美分,输出价格为 28 美分。在这个价位上,一个输出价格为每百万令牌 6 美元的模型,已经不能靠漂亮话来为自己辩护了。它必须重新看看自己的价签。市场上的价格差距已经荒谬得离谱。最贵的尖端模型每生成一百万个令牌要花 180 美元,而 DeepSeek V4 Flash 只要 28 美分。这贵了 643 倍。可是在这两种情况下,最终客户看到的主要还是从一个盒子里出来的文字。
就我个人而言,我觉得这挺健康的。两年来,大家一直告诉我们,人工智能成本太高,没法拿来大甩卖。结果只需要一个认真的竞争对手,价格一夜之间就崩了。
真正划算的地方藏在脚注里
还有一件事比宣布的降价更划算,但几乎没人提到。GPT-5.6 对它最近已经读过的文字少收费 90%。这就是所谓的缓存,一种临时记忆,可以避免模型每次都按原价重复阅读同样的内容。
左边,模型每次回答问题都从第一页开始重读你的资料。右边,它放好了书签。差别主要体现在账单底部。
具体来说,当你和一个助手聊天时,每发一条新消息,整段对话历史都会重新传给它。你上一个问题,它的回答,你粘贴进去的文档,所有内容都从头再来。没有缓存,你得一次又一次按全价支付这次重读的费用。有了缓存,在 Luna 这里,没有变化的那部分每百万令牌的价格会从 20 美分降到 2 美分。
有一个坦诚的代价需要说明。第一次缓存一段文本的费用是正常费率的1.25倍。因此,这项操作要从第二次读取开始才划算。对于一段对话或一个智能代理,也就是一个在同一份资料上自主工作一小时的程序来说,第二次读取几乎马上就会到来。
具体来说,这对你有什么改变
你可能并不是直接按百万个令牌向OpenAI付费。因此,这些费率看起来可能离你的日常生活很远。但正是它们决定了应用可以为你提供哪些功能,以及价格是多少。
当原材料几乎不再花钱时,人们就会把它到处都用上。包括那些没人要求它出现的地方。
1. 付费功能会变成包含在内的功能
一家每月卖3欧元应用的小企业,很难轻易加入一个每月每位用户要花掉它40欧分的人工智能功能。它会把这项功能留给高级订阅,或者干脆不用。把这笔成本除以五,计算结果就完全不同了。这样一来,这项功能就可以进入基础套餐。
你的邮件摘要、食谱应用里的翻译、照片修饰或文档整理,都可能出现这种变化。单独看,没有什么惊天动地的地方。但几十个小功能可能不再是付费选项。
2. 人工智能进入那些价格不高的物件
只要一次请求还很贵,人们就会把人工智能留给客户愿意支付高价的产品:企业软件、高档汽车或专业订阅。每百万个令牌只要20欧分之后,人们就可以开始把它放进网络盒子、对讲机、超市收银机或玩具里。
这和电子芯片的故事一样。在70年代,一颗微处理器的价格相当于一辆二手车,而且要待在有空调的房间里。如今,你的厨房里就有三十来颗。它们大多数执行的任务,和让烤箱时钟闪烁一样光荣。当价格暴跌时,产品不只是变得更便宜。它还会出现在以前没人想过要放进去的地方。
3. 不断上涨的账单会停止上涨
这是最贴近日常生活的后果。如果你支付的订阅服务使用了人工智能,你的供应商自己的账单可能刚刚大幅缩水。他大概不会把差额还给你,没人会这么做。但他可以停止涨价,转而在套餐包含的功能上竞争。
我们还是留点余地,因为我们卖的不是梦想。这次降价针对的是小模型。真正困难的任务使用高端模型,而它的价格没有变化。因此,不要期待所有地方都出现奇迹。足够简单的任务,更可能逐步转向小模型。而且由于今天的小模型很快就会比一年前的大模型更强,这最终会涉及很多任务。
我的看法
让我感到吃惊的不是降价的幅度。而是速度。从一个模型发布到它的价格降为五分之一,只用了三周。在这个行业里,一张价目表如今的寿命和一根法棍面包一样长。
对于那些用这些工具构建产品的人来说,教训非常具体:永远不要根据当天的费率来制定商业计划,也永远不要押注单一供应商。价格还会继续下降。至于你今天使用的模型,它可能在圣诞节前就会出现在清仓货架上。
对其他所有人来说,这里面藏着一个好消息。人工智能过去很难以低成本整合进手机服务,如今正逐渐成为其中最便宜的元素之一。剩下昂贵的事情,是知道拿它来做什么。



Join the conversation
You need an account to comment on this article. Creating one is free and takes under a minute.
No comments yet.