Qwen3.8 系列新增双 TITO 家族名共享固定渲染模板
值得精读,重点看三处设计决策:(1) 两个公共枚举映射到同一个 tokenizer 类的工厂写法,如何避免复制 renderer;(2) 固定默认 reasoning 模式并显式拒绝冲突 kwargs 的保护机制,防止缓存前缀静默失配;(3) FIXME 驱动的临时行为显式化,为后续 request-argument 优先级重构留出清晰的演进路径。若团队要新增类似“共享序列化契约、不同公共名”的模型家族,可直接复用本 PR 的模式。
标签列表
聚合结果
Qwen3.8 系列新增双 TITO 家族名共享固定渲染模板
值得精读,重点看三处设计决策:(1) 两个公共枚举映射到同一个 tokenizer 类的工厂写法,如何避免复制 renderer;(2) 固定默认 reasoning 模式并显式拒绝冲突 kwargs 的保护机制,防止缓存前缀静默失配;(3) FIXME 驱动的临时行为显式化,为后续 request-argument 优先级重构留出清晰的演进路径。若团队要新增类似“共享序列化契约、不同公共名”的模型家族,可直接复用本 PR 的模式。
TITO 新增 Qwen3.6 模板,拆分 Qwen3.5/3.6 序列化合约
值得精读。核心看点在于"按家族拆分模板而非共享模板"的设计决策:当两个模型家族的渲染合约存在细微序列化差异时,共享模板会静默改变旧家族行为,拆分并配以参数化测试锁定差异是稳健做法。建议关注 `tito_tokenizer.py` 中 `FIXED_TEMPLATE` 注册模式、`preserve_thinking` 与 `clear_thinking` 的语义区别,以及 e2e 测试如何用 `tito_session_mismatch_rate` 指标做 CI gate。合并时注意 reviewer 提到的与 PR 2711 的兼容性提醒。
原始 PR · 作者 zyzshishui · 合并时间 2026-08-21 07:14
桥接模式恢复训练从检查点步骤继续
此 PR 值得精读,特别是理解桥接模式的恢复逻辑。设计上通过在参数验证阶段调整 `start_rollout_id` 的默认值,避免修改下游 `create_training_models` 的复杂逻辑,是简洁且低风险的修复。重点关注 Codex 提出的 release tracker 边界情况,未来可考虑补充处理。