View a markdown version of this page

Personalizzazione del modello a peso aperto - Amazon SageMaker AI

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Personalizzazione del modello a peso aperto

Questa sezione illustra il processo per iniziare con la personalizzazione del modello a peso aperto.

Modelli e tipi di personalizzazione supportati

La tabella seguente mostra le ricette di ottimizzazione supportate per ciascun modello, tra cui SFT, DPO, RLVR e RLAIF con o regolazione completa (FFT). LoRA

Provider Modello ID modello SFT () LoRA SFT (FFT) DPO () LoRA DPO (FFT) RLVR () LoRA RLVR (FFT) RLAIF () LoRA RLAIF (FFT)
AlibabaQwen3.6 27Bhuggingface-vlm-qwen3-6-27b
AlibabaQwen3.5 27Bhuggingface-vlm-qwen3-5-27b
AlibabaQwen3.5 9Bhuggingface-vlm-qwen3-5-9b
AlibabaQwen3.5 4Bhuggingface-vlm-qwen3-5-4b
AlibabaQwen3 32Bhuggingface-reasoning-qwen3-32b
AlibabaQwen 3 14Bhuggingface-reasoning-qwen3-14b
AlibabaQwen 3 8Bhuggingface-reasoning-qwen3-8b
AlibabaQwen3 4Bhuggingface-reasoning-qwen3-4b
AlibabaQwen 3 1,7 Bhuggingface-reasoning-qwen3-1-7b
AlibabaQwen3 0,6 Bhuggingface-reasoning-qwen3-06b
AlibabaQwen2.5 Istruisci 72Bhuggingface-llm-qwen2-5-72b-instruct
AlibabaQwen2.5 Istruisci 32Bhuggingface-llm-qwen2-5-32b-instruct
AlibabaQwen2.5 Istruisci 14Bhuggingface-llm-qwen2-5-14b-instruct
AlibabaQwen2.5 Istruisci 7Bhuggingface-llm-qwen2-5-7b-instruct
DeepSeekDistillatore E1 Qwen 32Bdeepseek-llm-r1-distill-qwen-32b
DeepSeekDistillatore R1 Qwen 14Bdeepseek-llm-r1-distill-qwen-14b
DeepSeekDistillatore R1 Qwen 7Bdeepseek-llm-r1-distill-qwen-7b
DeepSeekDistillatore R1 Qwen 1.5Bdeepseek-llm-r1-distill-qwen-1-5b
DeepSeekDistillatore R1 Llama 70Bdeepseek-llm-r1-distill-llama-70b
DeepSeekDistillatore R1 Lama 8Bdeepseek-llm-r1-distill-llama-8b
GoogleGemma 4 31Bhuggingface-vlm-gemma-4-31b-it
GoogleGemma 4 26B A4Bhuggingface-vlm-gemma-4-26b-a4b-it
GoogleGemma 4 E4Bhuggingface-vlm-gemma-4-e4b-it
MetaLlama 3.3 Instruct 70Bmeta-textgeneration-llama-3-3-70b-instruct
MetaLlama 3.2 Istruisci 3Bmeta-textgeneration-llama-3-2-3b-instruct
MetaLlama 3.2 Istruisci 1Bmeta-textgeneration-llama-3-2-1b-instruct
MetaLlama 3.1 Istruisci 8Bmeta-textgeneration-llama-3-1-8b-instruct
NVIDIANemotron 3 Super 120B (A12B)huggingface-llm-nvidia-nemotron-3-super-120b-a12b-bf16
NVIDIANemotron 3 Nano 30B (A3B)huggingface-reasoning-nvidia-nemotron-3-nano-30b-a3b-bf16
OpenAIGPT OSS 120Bopenai-reasoning-gpt-oss-120b
OpenAIGPT OSS 20Bopenai-reasoning-gpt-oss-20b