执行摘要
修复 tau-bench 配置键名不匹配问题
tau-bench 的 RunConfig 定义的是 agent_strategy 而非 agent,旧的键名会被 Pydantic 静默忽略,导致通过 TAU_CONFIGS 修改 agent 类型不生效(始终使用默认的 tool-calling)。
可直接合并。少量改动但修复了实际存在的 bug,建议在发布说明中提及。
无 review 讨论。
tau-bench 的 RunConfig 定义的是 agent_strategy 而非 agent,旧的键名会被 Pydantic 静默忽略,导致通过 TAU_CONFIGS 修改 agent 类型不生效(始终使用默认的 tool-calling)。
可直接合并。少量改动但修复了实际存在的 bug,建议在发布说明中提及。
无 review 讨论。
examples/tau-bench/generate_with_tau.py 中将 TAU_CONFIGS 字典中的 agent 键改为 agent_strategy,对应的注释也同步更新。examples/tau-bench/README.md 中同步更新配置示例中的键名。| 文件 | 模块 | 状态 | 重要度 |
|---|---|---|---|
examples/tau-bench/generate_with_tau.py |
Tau-Bench | modified | 4.49 |
examples/tau-bench/README.md |
Tau-Bench | modified | 1.89 |
examples/tau-bench/generate_with_tau.py
core-logic
修复核心配置键名,确保 `TAU_CONFIGS` 中指定的 agent 类型能被 `RunConfig` 正确解析。
# Tau-bench configuration
TAU_CONFIGS = {
"env": "retail", # Select between ["retail", "airline"]
"agent_strategy": "tool-calling", # 修复:原为 "agent",但 RunConfig 使用 agent_strategy
"user_model": "gemini-2.5-flash-lite", # Cheap Model for user simulator
"task_split": "train", # Select between ["train", "test", "dev"] for retail
"user_strategy": "llm", # Select between ["llm", "react", "verify", "reflection"]
"model_provider": "auto_router", # Unused, required
"model": "qwen3-4b", # Unused, required
"user_model_provider": "gemini",
}
当前评论区没有形成足够清晰的争议点或结论,后续有更多讨论时会体现在这里。
风险极低。仅涉及配置字典的键名修正,且 agent_strategy 是 tau-bench RunConfig 定义的合法字段,不会引发异常。
影响范围仅限于 tau-bench 示例,使用 TAU_CONFIGS 的脚本将能正确识别 agent 类型配置。不影响 slime 核心库或其他示例。
当前没有检测到明确关联的 Issue 链接,后续同步到相关引用后会出现在这里。
参与讨论