9月23日凌晨,OpenAI把两款新模型的价格砍到GPT-5.6同档的一半:Luna输入每百万token只要0.1美元。但你在ChatGPT聊天框里,暂时用不到它们。同一天,Anthropic发布Claude Opus 5.5,默认设置下典型负载成本比Opus 5低四成。两家比的不是谁更聪明,是谁的单位任务成本更低、谁能占住干活的那个入口。两家同一天上新,砍价砍在不同位置OpenAI这次推出GPT-6家族两款:Sol面向复杂编码与智能体工作流,Luna是高并发档。对GPT-5.6同档当前费率直接对半:Sol每百万token输入2美元、输出10美元;Luna输入0.1美元、输出0.5美元。官方称Sol在xhigh档下AutomationBench拿到33.2%,折算每个任务0.27美元;DeepSWE v1.1的max档68.8%,Luna为66.6%。两者上下文窗口105万token,支持文本与图像输入。Anthropic的打法不同:Opus 5.5宣称在多数工作上可媲美Fable 5.1,输入输出4美元和20美元每百万token,比Opus 5低两成;缓存命中0.2美元,低六成。一家砍单价,一家砍缓存价。而缓存,恰好是这次最容易被忽略的地方。便宜的不是模型,是那些要重复读的部分一句话说清:按token计费的账单里,最贵的不是你那句提问,是每一轮都要重新读一遍的上下文。拆开看。agent跑任务时,同一份代码库、同一份文档会被反复送进模型。命中缓存的部分,单价大约是输入价的十分之一:Luna的缓存读每百万token0.01美元,输入是0.1美元,差十倍。但上下文一旦超过