Feature Description / 功能描述
当前 subagent dispatch 启动的子代理默认使用与主对话相同的模型。在并发度较高时,多个子代理同时调用同一模型,容易触发模型平台提供商的并发/速率限制(rate limit)。
希望支持为 subagent 指定另一个独立的模型配置,默认仍与主模型相同。
Motivation / 动机
- 主对话使用高端模型时,多个 subagent 同时调用会快速消耗并发配额和 token,导致请求被限流甚至失败。
- subagent 执行的任务通常不需要与主对话同等能力的模型,使用轻量模型即可完成。
- 目前没有机制让 subagent 使用不同模型,只能被动等待限流。
Expected Behavior / 预期行为
- 默认值保持与主模型一致,不影响现有行为。
- 用户可将 subagent 配置为轻量/更便宜的模型,降低并发压力和成本。
Feature Description / 功能描述
当前 subagent dispatch 启动的子代理默认使用与主对话相同的模型。在并发度较高时,多个子代理同时调用同一模型,容易触发模型平台提供商的并发/速率限制(rate limit)。
希望支持为 subagent 指定另一个独立的模型配置,默认仍与主模型相同。
Motivation / 动机
Expected Behavior / 预期行为