models 10 分钟 更新于 2026年9月12日
按成本分流:模型、组合与计量
不是每个任务都配用旗舰模型。一条简单的分流策略能把账单砍掉一个数量级。
「默认模型」是建 bot 时最贵的习惯。每日摘要、日志修剪、格式检查这些活,不需要你手里最聪明的模型——只需要一个可靠的模型。诀窍在于分清哪些是哪些,然后刻意分流。
bot 工作的三个层级
判断题。策略、有分寸的写作、决定什么重要。用最强模型。这里出错,返工和信任都是双倍贵。
**可靠苦力。**摘要、分类、抽取、清单比对、排版。中档模型用零头的价格干得几乎一样好——任务本身有界,提示词套路才是真正扛活儿的。
管道活。「有没有变化?更新日志。」便宜模型、微型提示词、高频率。粗心的建造者就是在这里,为一句「今天没有」烧掉配额的。
十行分流策略
当你的技术栈支持选模型(原生支持,或通过接入其他供应商),把策略写进提示词或调度 bot:
强模型只用于:我要发布的初稿、涉及钱的决策、以及 config.md 标注「判断」的事项。快模型用于:摘要、日志更新、格式检查、以及上轮输出为「无可汇报」的任何运行。拿不准属于哪类,问我一次,然后记进 config.md。
两个立竿见影的效果:账单降了,强模型的注意力不再浪费在「这条视频是不是新的」上。
钱实际花在哪
- **频率 × 篇幅。**每小时一次的散文格式,比每天一次的严格格式贵得多。先砍格式,再砍频率。
- **全量重读。**只有新视频重要,却每次都拉完整字幕。状态文件既是记忆工具,也是成本工具。
- **重试循环。**一个每小时重试的失败例程,能烧一整晚的配额。每周期最多重试一次,然后停下来说明——这也是排错闭环的一部分。
- **配额盲区。**舰队玩家会养一个额度管家盯着仪表盘并通知其他 bot。无聊,但省下的是整个周末。
接入更便宜的模型
一个流行模式(见把 DeepSeek 接进 Grok Bot):Grok Bot 继续当大脑和界面,但通过工作区脚本把批量工作外包给更便宜的供应商 API。上面的分流规则原样适用——层级标签比品牌名字重要。
什么时候不能降级
- 任何署你名字的初稿。
- 任何「读错一点就变成不可逆动作」的场景。
- 新案例的头两周——你还在摸索「可靠」对它意味着什么。
降级管道,别降级判断。策略就这一句。