老金实测:提示词删82%之后,MiniMax退步,GPT-5.6没省Token
前段时间,老金不是发了一个解读A社发表的删除80%的提示词的文章了么。这两天真的把Meta_Kim的重构了,然后在Claude Code和Codex里,跑了一套48次的A/B实测矩阵。3类任务 × 2套提示词 × 每套4次 × 2个平台,一共48次。每一次都在隔离工作区里完成真实代码任务,要过公开测试,也要过模型事先不知道的隐藏测试。不是让模型回答一道题,再凭感觉说谁更聪明。结果是这样。。。Claude Code里的MiniMax-M3确实少吃了Token,但常用任务退步,不能采用。Codex里的GPT-5.6 Sol把质量完整守住了,可Token几乎没省,照样没有通过我的上线门槛。同一套精简...