Prhub

THUDM/slime · 标签视图

标签列表

聚合结果

multimodal 相关 PR

2026-08-12
缺陷修复 重要性 8.01 洞察度 6.00

修复 tau-bench 推理模板令牌增量与掩码错误

值得精读。该 PR 展示了处理『聊天模板重写历史』和『多轮生成前缀掩码』的完整思路,尤其是 fail-closed 设计、独立渲染单条消息并校验后缀、以及用掩码而不是删除来保留生成前缀的做法。对使用 Qwen3 推理模板的 tau-bench 类多轮训练场景具有直接参考价值。

缺陷修复 重要性 7.01 洞察度 5.00

修复 filter_long_prompt 混合多模态数据顺序错乱

值得精读:修复点集中、测试设计精巧(用替身与桩避免引入 transformers),是优化引入回归后最小代价恢复正确性的典型样例。数据管线与 VLM 训练相关同学建议细看 filter_long_prompt 的实现与测试写法。

2026-06-10

#2044 support rich image config for vlm

原始 PR · 作者 demouo · 合并时间 2026-06-10 14:06

功能 重要性 5.17 洞察度 5.00

VLM 支持丰富图像配置

值得精读。该 PR 展示了如何以最小侵入方式扩展多模态输入格式,设计简洁。后续可考虑添加单元测试覆盖新分支。

2026-04-16
缺陷修复 重要性 4.97 洞察度 3.00

修复多智能体场景下评估日志记录时对列表类型样本的处理错误。

该 PR 值得快速浏览,特别是对于处理多智能体或异步生成场景的开发者。关注点在于如何优雅地处理函数返回类型的多态性,避免硬编码假设。

2026-04-07
功能 重要性 5.00 洞察度 4.00

在权重转换工具中添加从原始HF检查点补充缺失权重的功能,提升Qwen3.5模型转换完整性。

该PR值得关注其设计思路:通过维护已转换权重名称集合和从原始检查点补充缺失项的方式,优雅地解决了部分权重转换问题。建议精读save_tensors函数中新增的权重补充逻辑,理解其如何保持转换完整性同时避免重复。

缺陷修复 重要性 4.00 洞察度 3.00

修复GPT模型前向传播中position_ids参数缺失导致的TypeError。

该PR值得快速浏览以了解回归修复模式。关注点: 1. 学习如何通过添加默认参数(position_ids: None)解决前向签名不匹配问题。 2. 结合PR #1807分析重构引入的副作用,理解Megatron模型前向参数构建的演进。 3. 对于涉及核心训练路径的变更,建议补充单元测试以避免类似回归。

#1750 feat: add npu patch for qwen3-vl-8b grpo & ppo

原始 PR · 作者 cjy0x · 合并时间 2026-04-07 11:19

功能 重要性 7.00 洞察度 5.00

添加NPU补丁以支持Qwen3-VL-8B模型的GRPO和PPO训练。

该PR值得精读,特别是对于涉及硬件适配或多模态训练的工程师。重点关注: 1. `slime.patch`中的资源分配逻辑变更,如Ray API替换,这可能影响分布式训练稳定性。 2. 补丁中的手动代码替换(如cuda→npu),需理解其背后的兼容性设计决策。 3. 环境配置和版本依赖,以评估部署可行性。建议结合README.md进行实操验证。

2026-04-05

#1807 sync from internal

原始 PR · 作者 zhuzilin · 合并时间 2026-04-05 18:11

重构 重要性 4.00 洞察度 5.00

重构Megatron模型forward参数构建逻辑,提升多模态训练兼容性。

该PR值得精读,尤其是关注forward_kwargs字典构建模式的设计决策。这种重构提升了代码可维护性,并为多模态输入扩展提供了更清晰的接口。建议结合PR #1760(多模态OPD支持)理解上下文。