Add Mistral Large 3 Eagle Support (#14466)
Co-authored-by: Linda-Stadter <57756729+Linda-Stadter@users.noreply.github.com>
This commit is contained in:
@@ -338,6 +338,7 @@ class ModelConfig:
|
||||
or "DotsVLMForCausalLM" in self.hf_config.architectures
|
||||
or "MistralLarge3ForCausalLM" in self.hf_config.architectures
|
||||
or "PixtralForConditionalGeneration" in self.hf_config.architectures
|
||||
or "MistralLarge3ForCausalLMEagle" in self.hf_config.architectures
|
||||
):
|
||||
self.head_dim = 256
|
||||
self.attention_arch = AttentionArch.MLA
|
||||
@@ -702,7 +703,16 @@ class ModelConfig:
|
||||
if self.quantization is None:
|
||||
self.quantization = quant_method
|
||||
elif self.quantization != quant_method:
|
||||
if (
|
||||
# Allow auto-detection of quantization from checkpoint for draft model
|
||||
# even if it differs from main model's quantization
|
||||
if self.is_draft_model:
|
||||
logger.info(
|
||||
f"Draft model quantization ({quant_method}) differs from "
|
||||
f"main model quantization ({self.quantization}). "
|
||||
f"Using draft model's detected quantization: {quant_method}"
|
||||
)
|
||||
self.quantization = quant_method
|
||||
elif (
|
||||
self.quantization not in compatible_quantization_methods
|
||||
or quant_method
|
||||
not in compatible_quantization_methods[self.quantization]
|
||||
|
||||
Reference in New Issue
Block a user