Codex Token 消耗太快?改 4 个设置,能省下 80%

Codex 用起来是真快,Token 也是真不经烧。活还没干几个,先看眼用量,一大半已经没了,翻记录全是它客套来客套去的话。别急着怪任务大,多数时候是默认设置没动过。今天把这几个开关捋一遍,按着点几下,能省回来不少。

先改语气。打开设置,在个性化里把语气从友好拨到务实。友好这档是漂亮话大户,你让它写个脚本,它先夸一句”好想法”,收尾再来段总结表扬,这些话跟你的任务半毛钱关系没有,Token 照样一分不少地扣。切到务实,它开口就是结论,多余的铺垫全省了。

Codex 设置面板,把语气从友好拨到务实

接着填自定义指令。设置里有个空框,你在里面写的话,Codex 每轮干活都会自动遵守,不用每次重新交代一遍。网上流传的 Karpathy 模板能直接抄,核心就四条:不瞎猜,保持简单不做多余任务,目标驱动,只写必要的代码。把这四条粘进去,它每轮输出都会收敛不少。

再打开记忆。开关在设置里,打开后 Codex 会慢慢记下你的偏好、常用项目和工作风格,越用越懂你,下次不用从头介绍背景。每次对话开头那几段重复交代,就这么省掉了。

最后是权限模式。平时只是拖个小工具、整理文件、做个演示,不碰公司的机密文件,就把完全访问打开。开了之后它干活不用每步停下来等你确认,一口气跑完,来回点确认的那部分消耗也省了。

设置改完,真正烧 Token 的地方还在使用习惯上。

最值钱的一条:动手前先进计划模式。拿个真任务说,你想让它整理一堆散文件,先切到计划模式,把思路理清楚再让它动手。琢磨方案这步,模式可以拉到最高,多想一步,后面返工就少一步。真到执行环节,反而开中档就够,它照着定好的方案干活就行。开最高它会对着一个已经敲定的方案反复权衡,又慢又费。想的时候让它想透,干的时候别让它多想。

跑偏了要当场拦。任务做到一半方向歪了,越早打断越省钱,拖到最后是时间也花了 Token 也烧了。发现不对直接发指令把它拉回来,别心疼那半截上下文。

顺手的小问题丢给侧边任务。主线跑着突然冒出个小疑问,别打断主线去问,点右上角开个侧边任务窗口,在里面问就行,既不打断主任务,也不往主线上下文里塞脏东西。同一个需求想对比两种做法,用斜杠选”新任务中继续”,它会带着当前窗口的全部记忆另开一窗,省得你重新交代背景。

习惯之外,还有两个工具能接着省。

一个叫 Ponytail,GitHub 上过了十一万星。AI 写代码的毛病都一个样:三十行能办完的事,它能给你铺到八十行。装上它,动手前先过一道决策:这东西到底要不要写、代码库里有没有现成、标准库能不能搞定、系统自带功能够不够用。作者拿真实项目跑过对照,能砍掉一半左右的冗余代码,Token 跟着省一截。

Ponytail 帮 AI 砍掉冗余代码

另一个是微软开源的 MarkItDown,把 Word、PDF 一键转成干净的纯文本再喂给 Codex。文档越干净它读得越快,不容易漏内容,表格也不会串行出错,省掉反复返工的那笔消耗。

改完别急着上大任务。先拿一个平时最费 Token 的小活,改前跑一遍记下用量,改完再跑一遍,两边一比,省多少自己心里就有数了。