View a markdown version of this page

Personalização de modelos de peso aberto - SageMaker IA da Amazon

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Personalização de modelos de peso aberto

Esta seção mostra o processo para começar com a personalização do modelo de peso aberto.

Modelos compatíveis e tipos de personalização

A tabela a seguir mostra as receitas de ajuste fino suportadas para cada modelo, incluindo SFT, DPO, RLVR e RLAIF com ou ajuste fino completo (FFT). LoRA

Fornecedor Modelo ID do modelo SFT (1) LoRA MACIO (FFT) DPO () LoRA DPO (PÉS) RLVR (1) LoRA RLVR (PÉS) RAIF (1) LoRA PRAIF (PÉS)
AlibabaQwen3.6 27Bhuggingface-vlm-qwen3-6-27b
AlibabaQwen3.5 27Bhuggingface-vlm-qwen3-5-27b
AlibabaQwen3.5 9Bhuggingface-vlm-qwen3-5-9b
AlibabaQwen3.5 4Bhuggingface-vlm-qwen3-5-4b
AlibabaQwen 3 32Bhuggingface-reasoning-qwen3-32b
AlibabaQwen 3 14Bhuggingface-reasoning-qwen3-14b
AlibabaQwen 3 8Bhuggingface-reasoning-qwen3-8b
AlibabaQwen 3 4Bhuggingface-reasoning-qwen3-4b
AlibabaQwen3 1.7Bhuggingface-reasoning-qwen3-1-7b
AlibabaQwen3 0,6Bhuggingface-reasoning-qwen3-06b
AlibabaQwen2.5 Instrua 72Bhuggingface-llm-qwen2-5-72b-instruct
AlibabaQwen2.5 Instrua 32Bhuggingface-llm-qwen2-5-32b-instruct
AlibabaQwen2.5 Instrua 14Bhuggingface-llm-qwen2-5-14b-instruct
AlibabaQwen2.5 Instrua 7Bhuggingface-llm-qwen2-5-7b-instruct
DeepSeekDestilador E1 Qwen 32Bdeepseek-llm-r1-distill-qwen-32b
DeepSeekDestilador E1 Qwen 14Bdeepseek-llm-r1-distill-qwen-14b
DeepSeekDestilador E1 Qwen 7Bdeepseek-llm-r1-distill-qwen-7b
DeepSeekDestilador E1 Qwen 1.5Bdeepseek-llm-r1-distill-qwen-1-5b
DeepSeekR1 Destill Lhama 70Bdeepseek-llm-r1-distill-llama-70b
DeepSeekR1 Destill Lhama 8Bdeepseek-llm-r1-distill-llama-8b
GoogleGemma 4 31Bhuggingface-vlm-gemma-4-31b-it
GoogleGemma 4 26B A4Bhuggingface-vlm-gemma-4-26b-a4b-it
GoogleGemma 4 E4Bhuggingface-vlm-gemma-4-e4b-it
MetaLlama 3.3 Instruct 70Bmeta-textgeneration-llama-3-3-70b-instruct
MetaLlama 3.2 Instruct 3Bmeta-textgeneration-llama-3-2-3b-instruct
MetaLhama 3.2 Instrução 1Bmeta-textgeneration-llama-3-2-1b-instruct
MetaLlama 3.1 Instruct 8Bmeta-textgeneration-llama-3-1-8b-instruct
NVIDIANemotron 3 Super 120B (A12B)huggingface-llm-nvidia-nemotron-3-super-120b-a12b-bf16
NVIDIANemotron 3 Nano 30B (A3B)huggingface-reasoning-nvidia-nemotron-3-nano-30b-a3b-bf16
OpenAIPERDA DE GPT 120Gopenai-reasoning-gpt-oss-120b
OpenAIGPT LOSS 20Bopenai-reasoning-gpt-oss-20b