Prhub

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

监控状态:已开启 最近同步:2026-08-20 18:31 同步状态:空闲 下次计划:2026-08-20 19:31

PR 列表

更多筛选
2026-07-25
功能 重要性 5.20 洞察度 3.00

XPU Graph 启用时输出实验性警告

该 PR 设计简洁明确,值得作为 XPU 平台文档的补充,建议用户关注警告中的限制说明。对理解 XPU 平台的当前状态有参考价值。

#49655 [BUGFIX] Fix log capture in KV test

原始 PR · 作者 zhenwei-intel · 合并时间 2026-07-25 08:36

缺陷修复 重要性 4.12 洞察度 3.00

修复 KV 测试日志捕获问题

快速合并。该 PR 虽小但解决了 CI 稳定性问题,值得合入。建议关注 `caplog_vllm` fixture 的实现,未来类似场景可直接复用。

重构 重要性 9.00 洞察度 2.00

回滚 #48597 的 Blackwell 解码优化,还原大量 NVIDIA DeepSeek V3.2 内核变更

建议阅读原始 PR #48597 以理解回滚的上下文。对于关注 Blackwell 性能的用户,可关注后续更稳定的优化合并。此 PR 本身无深入洞察价值,但可作为回滚操作的参考案例。

缺陷修复 重要性 7.27 洞察度 5.00

修复 FS KV 卸装层的 O_DIRECT 兼容性和 API 服务器测试的不稳定

该 PR 值得精读,特别是 `probe_o_direct` 的设计模式:在初始化时进行一次探针,而不是在每个 I/O 操作时处理错误,平衡了性能和健壮性。此外,spawn 子进程提取到轻量模块的做法也是处理多进程测试的好范例。

参与讨论