【免费下载链接】zerostack
Lightweight coding agent written in Rust, optimized for memory footprint and performance
zerostack 是一个用 Rust 编写的轻量级编码 Agent,主打极低的内存占用与高性能。它的Quick Models(快速模型)功能让你把常用大模型起个别名,用/models命令或Alt+M快捷键一键切换;配合Prompt 级模型切换,切到某个提示词时还能自动跳到对应模型。本文将教你如何用这套组合,在廉价模型与高价模型之间丝滑切换,把 token 成本花在刀刃上。
为什么需要模型切换?
用 AI 写代码时,不同任务适合不同档位的模型:
- 写代码、调试:用高价旗舰模型,推理更稳、少犯错;
- 批量改名、补文档、简单修改:用廉价模型,又快又省;
- 回答常识问题:根本不需要动用重型模型。
如果每次都要手敲长长的模型名 + 提供商,太麻烦了。zerostack 的 Quick Models 就是来解决这件事的——一个别名同时绑定模型和提供商,输入短名字即可切换。
💡 核心思路:日常任务用便宜模型跑,关键时刻切到高价模型,成本立省一大截。
什么是 Quick Models(快速模型)
Quick Models 是配置里的一组别名,每个别名把provider(提供商)和model(模型名)打包在一起。相比直接填长模型字符串,它更短、更不易出错。
在配置文件中定义(支持 YAML 或 TOML):
[quick_models.fast] provider = "openrouter" model = "deepseek/deepseek-v4-flash" [quick_models.quality] provider = "anthropic" model = "claude-sonnet-4"定义完成后,你可以:
- 在配置里设置默认模型;
- 会话中用
/models打开交互式选择器; - 用
/models <name>直接切到指定别名。
一键切换模型:3 种最快方法
方法一:/models 命令(推荐新手)
在 TUI 输入框输入/,选择命令:
/models— 列出配置中所有 Quick Models;/models <name>— 切换到指定别名,例如/models fast。
这是最直观的方式,切完立即生效,无需重启。
方法二:Alt+M 模糊选择器(高手之选)
按下Alt+M打开快速模型切换器,支持模糊过滤:
Tab在 Quick / Provider 之间切换;Enter立即应用(等价于执行/models <name>)。
适合模型多、名字长的场景,键盘盲打即可精准命中。
方法三:会话内动态切换 + 子 Agent 模型
/model— 显示当前模型;/models-subagent <name>— 单独给子 Agent指定模型,让后台任务用便宜模型跑,主会话保持高价模型。
Prompt 级模型切换:切提示词自动换模型
这是最"聪明"的玩法。配置里的[prompt_to_model]映射表,把提示词名对应到快速模型名:
[prompt_to_model] plan = "quality" code = "quality" review = "quality" brainstorm = ""效果非常直观:
| 操作 | 模型行为 |
|---|---|
/prompt plan或.plan | 自动切到quality |
/prompt code或.code | 自动切到quality |
/prompt brainstorm | 空字符串""=不切换,保持当前模型 |
/prompt default | 回退到会话默认模型 |
🔥 关键点:空字符串
""表示"不改动",非常适合那些"只想换提示词、不想换模型"的场景。
切换时聊天窗口会写一行确认:switched to model: quality (from prompt 'plan'),让你清楚知道当前用的是什么。
实操:按任务搭配廉价 / 高价模型
下面是一份可参考的配置思路——计划与写码用高价模型,头脑风暴用廉价模型:
[quick_models.quality] provider = "anthropic" model = "claude-sonnet-4" # 高价旗舰,负责核心开发 [quick_models.fast] provider = "openrouter" model = "deepseek/deepseek-v4-flash" # 廉价高速,负责杂活 [prompt_to_model] brainstorm = "fast" plan = "quality" code = "quality" review = "quality"使用流程:
.brainstorm 给我三个方案→ 自动落到fast,便宜快速地产出想法;.plan 细化推荐方案→ 自动升到quality,深度设计;.code 按计划实现→ 保持quality,稳定写码。
整个过程不用手敲任何模型名,切提示词即切模型。
成本透明:随时盯住 token 花费
zerostack 状态栏会实时显示本次会话的 token 成本,切换模型后一目了然。相关配置:
input_token_cost/output_token_cost— 在quick_models中为某模型设置单价;show_cost_always— 设为true时,即便成本是$0.0000也显示在状态栏。
状态栏还支持把cost、model、context_used等字段拼进自定义样式,让花费和当前模型始终可见。
完整功能参考
想深入了解,可查看项目自带文档与源码:
- 快速上手:docs/GET_STARTED.md
- 命令速查:docs/COMMANDS.md
- 配置详解(含 Prompt-to-model 切换):docs/CONFIG.md
- 内置提示词目录:data/prompts/
- 模型目录与定价逻辑源码:src/models_catalog.rs、src/pricing.rs
- 模糊选择器实现:src/ui/pickers/models.rs
📌 小技巧:首次运行
/prompt autoconfig,可以让 Agent 帮你交互式地阅读文档、写好上述配置,省去手动编辑。
小结
- Quick Models:用短别名打包"模型 + 提供商",
/models、Alt+M一键切换; - Prompt 级切换:
[prompt_to_model]让切提示词自动换模型,空字符串""保持原模型; - 成本可视:状态栏实时展示 token 花费,把预算花在真正需要高价模型的环节。
这套组合让"廉价模型干杂活、高价模型干正事"变得毫无门槛,是控制 AI 编码成本的高效方案。
【免费下载链接】zerostack
Lightweight coding agent written in Rust, optimized for memory footprint and performance
相关推荐
如何在消费级GPU上运行Wan2.1-T2V-1.3B:8GB显存实现高清视频生成
如何在消费级GPU上运行Wan2.1 T2V 1.3B:8GB显存实现高清视频生成 Wan2.1 T2V 1.3B是一款高效的文本到视频生成模型,能够在仅8GB
人工智能基础模型大模型计算机视觉Qwen3-235B大模型:如何一键切换双模式提升AI效率?
Qwen3 235B大模型:如何一键切换双模式提升AI效率? 导语 :Qwen3 235B大模型凭借创新的"双模式切换"技术,在保持高性能推理能力的同时实现效率
大模型深度学习NLWeb Model Router 设计指南:基于 OpenRouter 的按需廉价模型路由层
NLWeb Model Router 设计指南:基于 OpenRouter 的按需廉价模型路由层 导读 本文完整解析 NLWeb 开源仓库中 ModelRout
AI 应用MCP 服务AI Agent后端前端
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考