新增 BFCL 数据集,支持 vllm bench serve 工具调用性能评测
建议所有从事 tool-calling 相关开发或评测的工程师精读此 PR,重点了解 `BFCLDataset` 的 schema 翻译设计和请求覆盖机制。该设计为后续添加其他自定义基准数据集提供了可复用的模式。
A high-throughput and memory-efficient inference and serving engine for LLMs
新增 BFCL 数据集,支持 vllm bench serve 工具调用性能评测
建议所有从事 tool-calling 相关开发或评测的工程师精读此 PR,重点了解 `BFCLDataset` 的 schema 翻译设计和请求覆盖机制。该设计为后续添加其他自定义基准数据集提供了可复用的模式。
统一 ColBERT 模型权重加载为 AutoWeightsLoader
该 PR 值得精读,展示了如何利用 AutoWeightsLoader 统一权重加载,代码量减少且逻辑清晰。建议关注 WeightsMapper 的设计和 skip_prefixes 的使用场景。
调整 CODEOWNERS,缩减配置所有权范围
建议合并。这是一次合理的 OWNERS 缩减,避免了复杂的 review 路由策略,简单直接。值得借鉴的是如何通过精确路径匹配来减少噪音。
原始 PR · 作者 shenoyvvarun · 合并时间 2026-06-10 14:29
修复 Harmony 工具描述为空字段时的 pydantic 错误
建议快速合入。这是明显的兼容性问题,修复简单且测试覆盖充分。值得关注的是 `create_tool_definition` 函数的后续演进,可能需要对其他字段做类似的防御性处理。
Rust 前端新增 seed_oss 和 step3p5 推理解析器
- **值得精读**:特别是 `Step3p5ReasoningParser::process` 的换行缓存机制和 `DelimitedReasoningParser` 的 `initialize` 设计(如何通过 prompt token 推断初始状态)。 - **关注点**:解析器工厂的模式注册顺序和 `default_in_reasoning` 语义确定策略,这对于以后添加类似解析器很重要。
原始 PR · 作者 YellowFoxH4XOR · 合并时间 2026-06-10 13:35
修复 HWC 图片尺寸读取错误
推荐精读:这是一个简洁但典型的布局敏感性 bug 修复,展示了多模态推理中张量布局的隐式假设如何导致难以排查的运行时错误。建议关注 `get_image_size` 和 `get_frame_size` 保持一致的策略,以及参数化测试的设计模式。
移除 Chat Completion 流式生成中的死状态
值得精读,以了解如何利用 `Parser` 内部状态消除重复逻辑,这种模式可推广到其他需要累积文本/序列状态的场景。
修复 MoE 权重加载路径映射,添加 .routed_experts 前缀
这是一个典型的适配型 bugfix,展示了多模型对单一底层重构的协同修改。值得建议相关模型维护者关注,确保自己的自定义加载代码与主干保持一致。设计决策:将前缀统一改为 routed_experts,保持了与 #41184 的一致性。
参与讨论