最近我的Codex额度烧得有点离谱,已经到了我难以承受的程度。大家可能都知道,我做了一个名为AIHOT的AI热点资讯产品。最近我主要在做的,都是关于AIHOT底层优化的工作,核心目标有两个:一是尽可能降低成本,二是提升系统底层的性能。
具体来说,就是压榨模型API成本、压缩抓取成本、尝试用算法替代模型、寻找过度设计的地方、排查性能瓶颈等等。甚至因为突破了百万月活,流量和请求费用已经到了我扛不住的地步,我又在疯狂想办法压缩流量传输、降低成本,几乎把边缘缓存用到了极致。
为了做热度榜,我把监控的信源增加到了快2000个的量级。每天大模型API的费用也是几百块地烧。基本上就是一天烧掉一个200刀的Pro会员号,直接快干成日抛了,三个号轮着转,一个用完切下一个,继续做任务。
一边是AIHOT每天后端在疯狂烧钱,一边是为了优化AIHOT的烧钱而在Codex上疯狂烧钱。我感觉自己每天起床就像陷入了某种赛博循环,钱就像流水一样哗啦啦消失了。
我不太懂代码,只能当个产品经理去规划流程架构,知道目标是什么。但具体怎么实现?有没有更突破的方法?指望我这个愚蠢的人脑去想这个事肯定不行,所以必须有一个很强的大模型,根据我的需求和目标,调研完我们过去所有的日志数据,给一个很棒的开发规划,后续我去执行才行。
最近我经常用GPT-6 Astra Max来分析和规划,甚至有两个降本的任务,我直接上了GPT-6 Astra Ultra,出完计划后用GPT-6 Astra High来实施。所以Codex额度根本扛不住,消耗大头甚至来自于前面的分析规划,用Ultra分析规划一次,我的200刀会员周额度直接能没掉10%。
穷则思变。人一旦被额度逼到墙角,脑子就会异常活跃。我就想怎么最大化利用ChatGPT的网页版。大家都知道,网页版ChatGPT有一个超强的模型GPT-6 Pro,而且这个东西其实是Pro会员一个非常容易被忽略的隐藏福利。因为它的额度跟Codex分开,并不消耗你的Codex额度。200刀的Pro会员,一周有200次Pro对话额度。讲道理,这玩意一直是我心中极其好用的模型。7月份没有GPT-6只有GPT-5.6 Sol的时候,我就聊过,说这玩意的Review水平和深度都极强。
但GPT-6 Pro一直有一个问题,就是无法看到我的真实业务数据和场景。它可以通过插件方式链接我的Github,看到我所有的PR记录和实际代码,但他还是看不到我这么多月的所有服务器日志记录,还有真实的线上数据库。如果你看不到这些东西,怎么去分析数据,推理找到底层突破,从而给出真实的规划方案呢?比如昨天到底进来了多少条数据,每天的高峰数据到底是多少,某个模型调用一天烧多少钱,烧在什么地方,缓存命中率是多少等等。
本质上,代码告诉AI这套系统理论上应该怎么运行;生产数据告诉AI这套系统实际上是怎么运行的;PR历史则告诉AI它为什么一路变成了今天这个屎山。这就是过去我用GPT-6 Pro做方案规划最大的痛点,它一切都只能根据现有代码推测,无法根据真实数据进行分析回测。
于是我就一直在想办法怎么解决这个问题。我知道有各种桥接方式,把GPT-6 Pro的额度拉到Codex本地,但它来用。但过去无数种经验告诉我这种方式有风险,我不太想冒这个险。然后,我想起了MCP。在网页版ChatGPT的聊天模式中,可以调用插件,但不能调用Skill,而插件的底层其实就是MCP。那如果把我的服务器直接封装成MCP,然后变成一个插件,能跟Github插件一样,直接让GPT-6 Pro通过MCP协议读取我的服务器所有数据,这样是不是就行了?
说干就干,我直接给Codex发了一句话:“给AIHOT增加一个供ChatGPT使用的生产业务数据只读MCP Server,让GPT-6 Pro能安全查询AIHOT所有服务器的真实数据。但是一定要最小权限、只读、可审计,不能影响生产性能,也不能暴露密钥和敏感数据。”它自己就封装完了。
为了保护服务器安全,我只给了只读权限。它不能对我的服务器进行任何操作,只能读数据。同时也为了保护私有MCP的数据安全,它也提问说需要OAuth登录服务。那太简单了,因为我们用的是飞书,我过去在公司里直接开发了一整套飞书的认证中心供同事使用,我直接就把飞书的鉴权接进去了,只有我自己飞书账号登录后才能用。
然后过了大概半小时,Codex给我开发完了。因为它强大的Computer use操控能力,甚至都给我上传好了,自己做完了实验。成了。
MCP是个好东西,真的,万物皆可MCP,你可以把你任何本地电脑上、服务器上的东西封装成MCP,然后做成你的私有插件,全部让GPT-6 Pro调用了,这个想象空间有多大,能做的事有多少,我相信大家的想象力一定比我丰富。
接下来再说一下怎么用,以及怎么跟Codex更好的协同。打开我们的Codex,点击左上角的快速聊天,吊起ChatGPT的聊天模式。这时候就会在右下角给你弹一个窗,把模型选成GPT-6 Pro,点击加号,选择你自己的插件。因为我既需要给数据也需要给代码和PR记录,所以我是同时调用我自己的插件和Github插件。这个时候你就可以提出你的需求了。比如我说,我希望继续降低成本。他就会直接读取我们所有数据,开跑。
大概GPT-6 Pro思考推理了40分钟以后,终于跑完了,然后给我了一个非常详细的方案,我看了一下,质量真的极高。这一次,如果你直接用GPT-6 Astra在Codex里去跑,我觉得周额度的10%是真的能干掉的。所以通过这种方式,真的就节省了周额度的10%,而且也是完全符合OpenAI的所有规则,没有干任何出格的事情。
那有了这个方案之后,我们怎么扔到Codex里面,去直接执行呢。方法也巨简单,你完全不需要把那个md文档和方案下载下来再上传之类的,你直接点击聊天窗口的添加到Codex。你会发现,这个对话已经到你的Codex窗口上了。接着,写一句执行的万能Prompt:“帮我验证,并且做掉这里面提到的所有值得做的优化,然后统一上线。”我自己习惯在执行的时候,把推理等级开到“高”了,大家开到“中”也行,但是不建议用“轻度”,至少我自己觉得效果不是特别好,有时候来来回回的失败或者不验证,搞起来特别麻烦。
马上GPT-6 Sol大概率就上了,GPT-6 Sol上了之后,执行这块,我可能会无脑切换到GPT-6 Sol了,只有一些高难的任务我觉得我才会切换到GPT-6 Astra。上面Prompt写好以后,直接发送,我也不知道过了多久,因为我直接睡觉去了。起床一看,开发完了。这个任务,最终好像也只花了我周额度的4%左右。还是很爽的。
讲道理,GPT-6 Pro这么强,每周还给我200次额度,让它躺在那里吃灰,然后另一边一天烧一个Codex账号,我是真的觉得我扛不住。只要你是Pro会员,不管你是100刀的,还是200刀的,都可以试试,把你的真实数据和业务,封装成MCP,让GPT-6 Pro去使用,应该能减少很多你的Codex token消耗。
同时,我还是要强调一下,这种遵守规则的MCP和插件调用的方式,99.99%不会有啥风险,更不会给你降智或者风控啥的,但是如果你去用一些三方的桥接插件,把GPT-6 Pro的额度反代出来用Codex来开发,如果被风控了,别找我。账号安全第一。
最后,总结一下这套工作流。ChatGPT上的GPT-6 Pro通过MCP的方式把真实世界接入进来,进行详细分析做规划和架构。然后Codex的GPT-6 Astra High负责具体的开发执行。省钱省心又省力。我只需要提需求和做决策就行了。哦不对,我还要负责付钱。AI啊,真好玩。
