XPU 上跳过 fused_shared_expert 测试
该 PR 简单直接,无需精读。关注测试跳过策略的合理性,确保未来功能支持时能及时调整。
标签列表
聚合结果
XPU 上跳过 fused_shared_expert 测试
该 PR 简单直接,无需精读。关注测试跳过策略的合理性,确保未来功能支持时能及时调整。
更新 Gaudi HPU committer 名单
无需精读。这是一次维护性文档更新,符合项目治理流程。值得关注的是文档中维护者名单的及时更新习惯。
XPU 测试依赖将 sentencepiece 降级至 0.2.1
该 PR 为常规依赖版本调整,逻辑简单,无需精读。值得留意的是上游 sentencepiece issue 的进展,若后续版本提供兼容选项,可考虑升级。
修复 XPU 测试中 HfRunner 退出内存阈值超时
值得快速浏览,作为一个典型的跨平台测试基础设施修复示例:当某个平台的内存回收语义与已有特殊处理平台一致时,直接复用其基线记录机制是最低成本的方案。可关注 `tests/utils.py` 中 `record_gpu_memory_usage_stats` 与 `wait_for_memory_to_settle` 的具体实现,理解动态阈值的设计约束。
重编译 XPU 测试依赖,升级 pytest 修复 caplog 失败
值得简单阅读:根因分析清晰展示了 pytest 日志捕获行为差异,重新编译锁定文件对齐版本的做法合理;但需关注传递依赖大版本跳跃带来的潜在 CI 风险,建议合入后持续观察 XPU 测试结果。
修复 XPU 上 Mamba 指针高位溢出崩溃
值得精读。该 PR 是一个「小改动、大含义」的典型案例:用 3 行辅助函数解决跨平台设备指针表示差异,且通过位模式保持测试证明安全。值得关注的设计决策包括:不把 buffer 改为 uint64(保持 kernel ABI 不动,降低回归面)、复用 Python 整数范围判断规避 numpy 平台差异、以及用 `_FakeDataPtrTensor` 在无硬件环境模拟高位指针的测试技巧。后续在 XPU 上扩展其他 kernel 元数据路径时可复用该模式。
原始 PR · 作者 chaojun-zhang · 合并时间 2026-08-19 10:25
修复 XPU 指针 dtype 与溢出,EC 卸载支持 Intel GPU 并扩 CI
值得精读。核心看点有三:一是 `set_ptrs()` 用 numpy 视图绕开 torch 标量赋值限制的取舍,二是 PR body 中 2.13/2.14 兼容性矩阵的分析方法(对任何跨版本库升级都有借鉴意义),三是与 RFC #50834 的体系化关联——它展示了一个看似局部的小修复如何为全仓 dtype 约定提供依据。建议结合 KV offload 的 `gpu_worker.py` 中同一模式的先例一起阅读。
修复 XPU 单测 OOM 与无 graph 死循环
值得 XPU/Intel GPU 相关贡献者精读,重点是"把平台特有测试机制泛化为通用原语"的设计手法:先有 ROCm 的延迟显存回收等待,再通过重命名与平台分支扩展覆盖 XPU,避免复制一份平行实现。对普通读者而言这是一条小而有代表性的测试基建收口 PR,其中 graph 禁用时的 skip 防护模式也可以在其它依赖 CUDA graph/SYCL graph 的用例中复用。