Prhub

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

监控状态:已开启 最近同步:2026-08-21 18:24 同步状态:空闲 下次计划:2026-08-21 19:24

PR 列表

更多筛选
2026-05-26

#43530 Fix CuPy runtime deps and restore humming

原始 PR · 作者 mmangkad · 合并时间 2026-05-26 20:59

缺陷修复 重要性 6.73 洞察度 5.00

修复 CuPy 14.1.0 的 pytest 冲突并恢复 humming 支持

建议在 humming.py 中保留适当的安装提示(例如在类 __init__ 中重新添加检查),或迁移至更优雅的延迟错误报告。同时跟踪 cupy 14.1.1 或更高版本,尽快将版本限制从 `<14.1.0` 放宽为 `!=14.1.0`。

重构 重要性 7.64 洞察度 5.00

InternLM2 迁移至 AutoWeightsLoader

该 PR 设计清晰,遵循已有模式,适合作为参考样本帮助其他模型的迁移工作。建议阅读 InternLM2Model.load_weights 和 InternLM2ForCausalLM.load_weights 的变更以理解 AutoWeightsLoader 的使用方式。

功能 重要性 8.71 洞察度 6.00

自定义图像基准数据集支持多图像与交错内容

建议阅读该 PR,特别是 `CustomImageDataset` 的 `load_data` 和 `sample` 方法的设计,以及请求构建的适配模式。对于需要定制 benchmark 数据集的团队具有参考价值。整体清理且安全,可正常合入。

功能 重要性 7.73 洞察度 6.00

HMA 默认启用,仅连接器不支持时自动禁用

该 PR 值得精读。核心设计决策是将默认值反转,同时通过递归检测 MultiConnector 来保持兼容性。`supports_hma_config` 方法的设计清晰,可作为判断功能的单一入口。警告信息的改进也值得参考。

参与讨论