| name | qwen-performance-boost |
| description | 最大化 Qwen 模型在 Claude Code 中的成本优势与执行效率。通过并行派发、批量处理、Token 优化等策略,实现 3-5 倍成本优化。触发:Qwen 优化、成本优化、并行任务、批量处理、Token 优化、加速执行。 |
Qwen 性能优化 · 成本优势最大化
适用范围
- 模型配置:Bailian CodingPlan Lite(Qwen 系列模型)
- 优化目标:成本优势最大化(3-5 倍)、执行效率提升、Token 消耗优化
- 配合机制:
plan-model-auto-routing.mdc、thesis-subagent-self-review
核心策略
1. 并行任务派发(核心加速)
当任务包含多个独立子任务时,必须并行派发:
# 示例:多章节文献综述深化
Agent(Explore, "深化 1.4 节文献综述", run_in_background=True)
Agent(Explore, "深化 2.2 节文献综述", run_in_background=True)
Agent(Explore, "深化 3.1 节文献综述", run_in_background=True)
加速原理:Qwen 响应速度快,并行 3-5 个任务总耗时≈单个任务耗时
2. 批量处理模式
对重复性任务,使用单 prompt 批量处理而非多次调用:
# 低效:多次调用
Agent(Explore, "检查第 1 章图号")
Agent(Explore, "检查第 2 章图号")
Agent(Explore, "检查第 3 章图号")
# 高效:单次批量
Agent(Explore, "批量检查第 1-5 章所有图号,输出统一清单")
3. Token 优化技巧
3.1 精简上下文
- 只读取必要文件(使用
Read 指定 offset/limit)
- 避免全库扫描(用
Glob/Grep 精准定位)
- 大文件分块处理(每次 500-1000 行)
3.2 Prompt 模板化
使用固定模板减少冗余说明:
【任务】{具体任务}
【输入】{文件路径/数据}
【输出格式】{清单/表格/代码}
【约束】{关键限制}
3.3 结果缓存
- 可复用结论写入
docs/项目知识库/网络知识补充/
- 策略经验写入
docs/项目知识库/agent-学习与优化记录.md
- 下次同类任务先查缓存,避免重复调用
4. 任务分层模型路由
| 任务类型 | 推荐模型档位 | Qwen 对应模型 | 说明 |
|---|
| 简单代码生成/补全 | FAST | Qwen-Plus | 样板代码、单元测试、文档生成 |
| 中等复杂度分析 | BALANCED | Qwen-Max | 代码审查、模块重构、Bug 诊断 |
| 复杂架构/推理 | DEEP | Qwen-Max + 分步 | 架构设计、跨模块分析(拆分为多轮) |
执行流程
流程一:接收任务后的优化决策
-
识别任务类型:
- 多独立子任务 → 并行派发
- 重复性操作 → 批量处理
- 大文件处理 → Token 优化
- 复杂推理 → 分步执行
-
选择执行模式:
- 单任务 → 直接执行
- 多独立子任务 → 并行派发(
run_in_background=True)
- 重复性任务 → 批量处理
流程二:并行任务派发
- 识别可并行的子任务(无依赖关系)
- 为每个子任务启动
Agent(Explore, ...) 或 Agent(general-purpose, ...)
- 使用
run_in_background=True 后台执行
- 收集所有结果后汇总
流程三:批量任务处理
- 识别重复性操作(如多章节同号检查、多文件同名替换)
- 合并为单个 prompt,明确列出所有目标
- 要求输出统一格式的结果清单
- 主对话负责结果分发/写入
流程四:Token 优化执行
- 读取前:先用
Glob/Grep 精准定位,避免读大文件
- 读取时:指定
offset/limit 分块读取大文件
- 写入时:用
Edit 精准替换,避免整文件重写
- 总结时:输出关键结论,避免冗长推理过程
触发词
- Qwen 优化、成本优化、并行任务、批量处理
- Token 优化、加速执行、最大化 Qwen 优势
- 多章节同时处理、批量检查、并行派发
- 如何省钱、如何加速、如何优化
Qwen 优势场景
| ✅ 优先使用 Qwen | ⚠️ 谨慎使用(需分步) |
|---|
| 样板代码生成 | 跨模块架构重构 |
| 单元测试编写 | 复杂算法设计 |
| 文档生成/翻译 | 深度逻辑推理 |
| 批量文件操作 | 高风险数据修改 |
| 代码风格统一 | 核心安全逻辑 |
| 文献格式检查 | |
配合 Skill
| Skill | 配合方式 |
|---|
thesis-subagent-self-review | 子 Agent 评审默认用 Qwen-Plus |
thesis-agent-learning | 知识索引刷新用 Qwen 批量处理 |
thesis-task-execute | 任务执行优先 Qwen,高风险切回 Claude |
claude-code-bailian | 配置与故障排查 |
详细说明
- 并行任务最佳实践:
docs/_management/plans/Claude_Code_Subagent_最佳实践指南.md
- Token 优化技巧:本 Skill 第 3 节
- 配置问题:
claude-code-bailian Skill