OpenAI Codex 负责人 Thibault Sottiaux(Tibo)提醒,比较 AI 模型价格不能只看「每百万 Token 多少钱」,tokenizer 差异会让单价对比失真。

关键数据

  • 测试同一段文本:GPT-5.6 Sol 用 766 Token,Claude Opus 5 估需 1170 Token,Sol 少约 34.5%

  • 输入单价相同:均为 5 美元/百万 Token

  • 输出单价:Sol 30 美元,Opus 5 为 25 美元,单看输出 Opus 5 更便宜

  • 按输出计总费:Sol 约 0.023 美元,Opus 5 约 0.029 美元,Sol 反而便宜约 21%


Tibo 用披萨打比方:切成 8 块、每块 2 美元,总价 16 美元;切成 16 块、每块 1.25 美元,总价却要 20 美元。「每块更便宜」不等于整张更便宜。

他认为更合理的比价方式是看「完成一次任务的总花费」,同时把模型成功率和实际 Token 用量计入考量。