#48143 [Perf] Optimize `clamp` to `clamp_`
原始 PR · 作者 yewentao256 · 合并时间 2026-07-17 06:41
将 `clamp` 替换为 `clamp_` 以减少 GPU 内存分配
建议优先验证 `sparse_mla.py` 中 `clamp_` 的安全性,确认 `block_table_tensor` 是否被其他路径共享。如果风险不可接受,应回退为 `.clamp()`。其他文件的变更相对安全,可以保留。此 PR 不宜直接适用于要求高度稳定性的场景。
参与讨论