模型选择与高价模型成本管理
来源:GitHubStore、投资聚义厅、赛博禅心 日期:2026-06-12
核心判断
Fable 5 的出现强化了一个现实:最强模型会越来越贵,不适合所有任务都直接调用。投资聚义厅提到 Fable 5 试用后将完全按 token 计价,token 价格约为 Opus 4.8 两倍,平均消耗也更高。
WhichLLM 这类本地模型选择工具和 Headroom 这类上下文压缩工具,会成为 AI 编程工作流中的成本层。
使用原则
- 高价模型用于高价值长任务、关键推理、复杂工具调用。
- 本地模型用于草稿、分类、简单抽取和低风险预处理。
- 上下文压缩和模型路由需要成为工作流默认组件。