[fix] Fix MiniCPM-V-4.6 image preprocessing behavior (#10478)

This commit is contained in:
马境远
2026-05-12 11:35:23 +08:00
committed by GitHub
parent 53e77a9bfa
commit ca50f22c38
3 changed files with 30 additions and 135 deletions

View File

@@ -17,7 +17,6 @@
import copy
import inspect
import os
from dataclasses import dataclass
from typing import TYPE_CHECKING, Any, Literal, Optional
@@ -475,13 +474,6 @@ class MultiModalDataCollatorForSeq2Seq(DataCollatorForSeq2Seq):
features["position_ids"] = torch.arange(seq_length).long().repeat(bsz, 1)
return {"data": features, "input_ids": features["input_ids"], "labels": features["labels"]}
if (
self.model is not None
and getattr(self.model.config, "model_type", None) == "minicpmv4_6"
and "target_sizes" in features
): # for minicpmv4_6 with new transformers (NaViT API, no image_bound)
features["downsample_mode"] = os.getenv("DOWNSAMPLE_MODE", "16x")
return features