☰
zerostack Quick Models 指南:如何一键切换廉价与高价大模型
2026/10/11 11:35:02 网站建设 项目流程

【免费下载链接】zerostack

Lightweight coding agent written in Rust, optimized for memory footprint and performance

项目地址:https://gitcode.com/gh_mirrors/zer/zerostack
点击查看免费下载

zerostack 是一个用 Rust 编写的轻量级编码 Agent,主打极低的内存占用与高性能。它的Quick Models(快速模型)功能让你把常用大模型起个别名,用/models命令或Alt+M快捷键一键切换;配合Prompt 级模型切换,切到某个提示词时还能自动跳到对应模型。本文将教你如何用这套组合,在廉价模型与高价模型之间丝滑切换,把 token 成本花在刀刃上。

为什么需要模型切换?

用 AI 写代码时,不同任务适合不同档位的模型:

  • 写代码、调试:用高价旗舰模型,推理更稳、少犯错;
  • 批量改名、补文档、简单修改:用廉价模型,又快又省;
  • 回答常识问题:根本不需要动用重型模型。

如果每次都要手敲长长的模型名 + 提供商,太麻烦了。zerostack 的 Quick Models 就是来解决这件事的——一个别名同时绑定模型和提供商,输入短名字即可切换。

💡 核心思路:日常任务用便宜模型跑,关键时刻切到高价模型,成本立省一大截。

什么是 Quick Models(快速模型)

Quick Models 是配置里的一组别名,每个别名把provider(提供商)和model(模型名)打包在一起。相比直接填长模型字符串,它更短、更不易出错。

在配置文件中定义(支持 YAML 或 TOML):

[quick_models.fast] provider = "openrouter" model = "deepseek/deepseek-v4-flash" [quick_models.quality] provider = "anthropic" model = "claude-sonnet-4"

定义完成后,你可以:

  • 在配置里设置默认模型;
  • 会话中用/models打开交互式选择器;
  • 用/models <name>直接切到指定别名。

一键切换模型:3 种最快方法

方法一:/models 命令(推荐新手)

在 TUI 输入框输入/,选择命令:

  • /models— 列出配置中所有 Quick Models;
  • /models <name>— 切换到指定别名,例如/models fast。

这是最直观的方式,切完立即生效,无需重启。

方法二:Alt+M 模糊选择器(高手之选)

按下Alt+M打开快速模型切换器,支持模糊过滤:

  • Tab在 Quick / Provider 之间切换;
  • Enter立即应用(等价于执行/models <name>)。

适合模型多、名字长的场景,键盘盲打即可精准命中。

方法三:会话内动态切换 + 子 Agent 模型

  • /model— 显示当前模型;
  • /models-subagent <name>— 单独给子 Agent指定模型,让后台任务用便宜模型跑,主会话保持高价模型。

Prompt 级模型切换:切提示词自动换模型

这是最"聪明"的玩法。配置里的[prompt_to_model]映射表,把提示词名对应到快速模型名:

[prompt_to_model] plan = "quality" code = "quality" review = "quality" brainstorm = ""

效果非常直观:

操作模型行为
/prompt plan或.plan自动切到quality
/prompt code或.code自动切到quality
/prompt brainstorm空字符串""=不切换,保持当前模型
/prompt default回退到会话默认模型

🔥 关键点:空字符串""表示"不改动",非常适合那些"只想换提示词、不想换模型"的场景。

切换时聊天窗口会写一行确认:switched to model: quality (from prompt 'plan'),让你清楚知道当前用的是什么。

实操:按任务搭配廉价 / 高价模型

下面是一份可参考的配置思路——计划与写码用高价模型,头脑风暴用廉价模型:

[quick_models.quality] provider = "anthropic" model = "claude-sonnet-4" # 高价旗舰,负责核心开发 [quick_models.fast] provider = "openrouter" model = "deepseek/deepseek-v4-flash" # 廉价高速,负责杂活 [prompt_to_model] brainstorm = "fast" plan = "quality" code = "quality" review = "quality"

使用流程:

  1. .brainstorm 给我三个方案→ 自动落到fast,便宜快速地产出想法;
  2. .plan 细化推荐方案→ 自动升到quality,深度设计;
  3. .code 按计划实现→ 保持quality,稳定写码。

整个过程不用手敲任何模型名,切提示词即切模型。

成本透明:随时盯住 token 花费

zerostack 状态栏会实时显示本次会话的 token 成本,切换模型后一目了然。相关配置:

  • input_token_cost/output_token_cost— 在quick_models中为某模型设置单价;
  • show_cost_always— 设为true时,即便成本是$0.0000也显示在状态栏。

状态栏还支持把cost、model、context_used等字段拼进自定义样式,让花费和当前模型始终可见。

完整功能参考

想深入了解,可查看项目自带文档与源码:

  • 快速上手:docs/GET_STARTED.md
  • 命令速查:docs/COMMANDS.md
  • 配置详解(含 Prompt-to-model 切换):docs/CONFIG.md
  • 内置提示词目录:data/prompts/
  • 模型目录与定价逻辑源码:src/models_catalog.rs、src/pricing.rs
  • 模糊选择器实现:src/ui/pickers/models.rs

📌 小技巧:首次运行/prompt autoconfig,可以让 Agent 帮你交互式地阅读文档、写好上述配置,省去手动编辑。

小结

  • Quick Models:用短别名打包"模型 + 提供商",/models、Alt+M一键切换;
  • Prompt 级切换:[prompt_to_model]让切提示词自动换模型,空字符串""保持原模型;
  • 成本可视:状态栏实时展示 token 花费,把预算花在真正需要高价模型的环节。

这套组合让"廉价模型干杂活、高价模型干正事"变得毫无门槛,是控制 AI 编码成本的高效方案。

【免费下载链接】zerostack

Lightweight coding agent written in Rust, optimized for memory footprint and performance

项目地址:https://gitcode.com/gh_mirrors/zer/zerostack
点击查看免费下载

相关推荐

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询