最近跑各种 Agent、做爬虫清洗和本地 Bot,海外主流模型(Claude、Grok、GPT-4o)用量掉得飞快,稍微整几段长文本周额度就直接见底。
之前在推特上看到有大佬分享分流思路,试着折腾了一下,体验意外顺滑。
核心思路就是把“昂贵模型”与“廉价苦力”解耦:
- 昂贵模型(Grok / Claude):只负责顶层大脑调度、意图识别与流程判断,不碰长篇累牍的具体活。
- 苦力模型(智谱 GLM-5.3-Flash / Coding Plan):专接脏活累活,比如大段代码重构、长文本清洗、文档草稿拟定,以及走 ZCode CLI 跑代码任务。
智谱平台平时有 Coding Plan,加上经常每晚放水送 1 亿 Token(推特上也有老哥晒了刚领到的 ZCode Global Build 1 亿 GLM-5.3-Flash 额度券,虽然限时到次日上午,但夜间跑自动任务和脚本刚好完全消化掉)。
附上官方 1 亿 Token 领券界面与推特老哥的分流配置:
挂在后台跑长任务基本可以一直运行不断流,速度非常跟手,最大的好处是完全不心疼额度消耗,把有限的高端模型配额留给核心难题。
大家目前跑本地 Agent、工作流或者定时脚本,日常都是拿哪个模型当低成本/免费苦力跑长任务的?
这么说下就可以让他用flash执行了吗,感觉时间久了他就忘记了
免费版的用户能使用 ZCode 获得的额度吗?会获得吗?
@kyochi-lian #2 就是免费版,每天晚上可以获得1亿的token,第二天早上10点到期。官方天天在推特做活动,晚上的时候打开zcode的就有。
@SkyLightVPS #3 刚知道损失了几个亿,心痛
在用5.3flash,真的巨便宜巨好用
现在GLM5.3flash夜间畅用,不是只能在zcode客户端使用吗?能让国外模型当大脑指挥GLM干活吗
官方号是哪个?