mirror of
https://github.com/hiyouga/LLaMA-Factory.git
synced 2026-07-28 19:56:13 +08:00
[data] optimize qwen3 loss computation (#7923)
This commit is contained in:
@@ -103,9 +103,11 @@ class HuggingfaceEngine(BaseEngine):
|
||||
messages = template.mm_plugin.process_messages(
|
||||
messages, mm_input_dict["images"], mm_input_dict["videos"], mm_input_dict["audios"], processor
|
||||
)
|
||||
paired_messages = messages + [{"role": "assistant", "content": ""}]
|
||||
# add thought words to avoid skipping thinking
|
||||
paired_messages = messages + [{"role": "assistant", "content": template.add_thought("")}]
|
||||
system = system or generating_args["default_system"]
|
||||
prompt_ids, _ = template.encode_oneturn(tokenizer, paired_messages, system, tools)
|
||||
enable_thinking = input_kwargs.pop("enable_thinking", True)
|
||||
prompt_ids, _ = template.encode_oneturn(tokenizer, paired_messages, system, tools, enable_thinking)
|
||||
prompt_ids, _ = template.mm_plugin.process_token_ids(
|
||||
prompt_ids,
|
||||
None,
|
||||
|
||||
Reference in New Issue
Block a user