
自 7 月下旬开始,OpenAI、Anthropic 等美国主流 AI 企业集中下调中端模型的调用价格,希望以此留住对成本较为敏感的客户群体,这部分用户正在逐步转向性价比更高的中国大模型产品。与此同时,Anthropic 与 OpenAI 还把一部分企业客户从固定订阅模式调整为按量计费,根据实际算力消耗结算费用,这一变化直接推高部分企业的 AI 使用账单。面对不断上涨的开支,不少企业选择限制 AI 接口调用上限,或是开始测试其他低价替代模型。
市场环境变化之下,月之暗面(Kimi)、深度求索(Deepseek)等国内 AI 厂商收获不少来自硅谷、欧洲等地的新增客户,美国外卖平台 DoorDash、民宿平台 Airbnb 均对外表示,已经引入中国大模型,以此控制自身 AI 相关支出。国内 AI 实验室近期持续迭代产品,不断缩小同美国顶尖模型之间的性能差距,也让美国科技行业产生顾虑,即便持续投入巨额资本巩固技术优势,依旧存在客户流失的风险。业内分析认为,OpenAI 和 Anthropic 的降价动作,代表美国闭源大模型的竞争逻辑发生改变,过去行业更多看重模型跑分与能力上限,如今价格同样成为不可忽视的竞争要素。
AI 数据研究机构 Silicon Data 发布的 token 价格指数显示,受头部厂商主动调价影响,7 月中旬之后的近一个月时间,企业采购美国主流大模型的实际开销下降接近四分之一。本轮降价主要瞄准中端产品,直接对标来自中国的同类竞品。当地时间 7 月 30 日,OpenAI 宣布调整 GPT‑5.6 Luna 定价,输入 token 每百万由 1 美元下降 80% 至 0.20 美元,输出 token 每百万由 6 美元下调至 1.20 美元。Anthropic 在 7 月下旬推出 Opus5,输入 token 每百万定价 5 美元,输出 token 每百万定价 25 美元,仅为自家 Fable5 模型的一半,该企业还取消了原本计划 9 月落地的 Sonnet5 涨价方案。输入 token 指代用户提交给模型的内容,输出 token 代表 AI 生成返回的内容,两项通常分开计费。
不过行业也提醒,单纯对比官方公布的 token 报价,并不能直接判断不同模型的真实使用成本。一方面性能更强的模型完成相同任务消耗 token 数量更少,任务失败重试概率更低,即便单次 token 标价更高,整体任务总开销反而更低。另一方面多数模型设置多档算力模式,不同档位对应不同算力资源,既会改变输出质量,也会直接影响最终账单。AI 评测机构 ArtificialAnalysis 从数学、科学、代码、推理等多个维度完成基准测试,测试结果显示,中等算力档位下的 Anthropic Opus5,任务表现、单任务开销,与开启最高算力档位的月之暗面 Kimi K3 处于同一水平。OpenAI GPT‑5.6 Luna 调至最高算力档位后,性能接近深度求索 V4 Flash 最高档位,但是单任务成本大约是后者两倍。
本文由智算芯能前沿网编辑整理,转载请注明出处。
