以 image-processor-backend 参数取代废弃的 use_fast 快图像处理器
值得精读,尤其是 `_apply_image_processor_backend` 对 ProcessorMixin kwargs 泄漏问题的处理手法(只替换 image 子处理器、保留 processor 的 tokenizer/chat_template),这是与 Transformers ProcessorMixin 交互时容易踩坑的设计决策。建议关注两个后续验证点:1) `auto` 默认值在常见 VLM(Qwen2.5-VL、LLaVA、InternVL 等)上的实际 backend 选择与精度影响;2) 是否需要在 vLLM 等依赖同一 `use_fast` 语义生态的地方同步推广。
参与讨论