View a markdown version of this page

Öffnen Sie die Option zur Anpassung des Gewichts - Amazon SageMaker KI

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Öffnen Sie die Option zur Anpassung des Gewichts

In diesem Abschnitt erfahren Sie, wie Sie mit der Anpassung von Modellen mit offenem Gewicht beginnen können.

Unterstützte Modelle und Anpassungsarten

Die folgende Tabelle zeigt die unterstützten Feinabstimmungsrezepte für jedes Modell, einschließlich SFT, DPO, RLVR und RLAIF mit LoRA oder vollständiger Feinabstimmung (FFT).

Anbieter Modell Modell-ID LoRASFT () WEICH (FFT) DPO () LoRA DPO (FT) RLVR () LoRA RLVR (FFT) RLF () LoRA RLAIF (FFT)
AlibabaQwen3.6 27 Bhuggingface-vlm-qwen3-6-27b
AlibabaQwen3.5 27 Bhuggingface-vlm-qwen3-5-27b
AlibabaQwen3.5 9 Bhuggingface-vlm-qwen3-5-9b
AlibabaQwen3.5 4Bhuggingface-vlm-qwen3-5-4b
AlibabaQwen 3 32 Bhuggingface-reasoning-qwen3-32b
AlibabaQwen 3 14 Bhuggingface-reasoning-qwen3-14b
AlibabaQwen 3 8 Bhuggingface-reasoning-qwen3-8b
AlibabaQwen 3 4Bhuggingface-reasoning-qwen3-4b
AlibabaQwen 3 1,7 Bhuggingface-reasoning-qwen3-1-7b
AlibabaQwen3 0,6 Bhuggingface-reasoning-qwen3-06b
AlibabaQwen2.5 Instruktiere 72Bhuggingface-llm-qwen2-5-72b-instruct
AlibabaQwen2.5 Instruktiere 32Bhuggingface-llm-qwen2-5-32b-instruct
AlibabaQwen2.5 Instruktiere 14Bhuggingface-llm-qwen2-5-14b-instruct
AlibabaQwen2.5 Instruktiere 7Bhuggingface-llm-qwen2-5-7b-instruct
DeepSeekR1 Qwen 32B destillierendeepseek-llm-r1-distill-qwen-32b
DeepSeekR1 Destillieren Sie Qwen 14Bdeepseek-llm-r1-distill-qwen-14b
DeepSeekR1 Destillieren Sie Qwen 7Bdeepseek-llm-r1-distill-qwen-7b
DeepSeekR1 Destillieren Sie Qwen 1,5 Bdeepseek-llm-r1-distill-qwen-1-5b
DeepSeekR1 Destillieren Sie Lama 70Bdeepseek-llm-r1-distill-llama-70b
DeepSeekR1 Destilliere Lama 8Bdeepseek-llm-r1-distill-llama-8b
GoogleGemma 4 31Bhuggingface-vlm-gemma-4-31b-it
GoogleGemma 4 26B A4Bhuggingface-vlm-gemma-4-26b-a4b-it
GoogleGemma 4 E4Bhuggingface-vlm-gemma-4-e4b-it
MetaLama 3.3 Instruktiere 70Bmeta-textgeneration-llama-3-3-70b-instruct
MetaLama 3.2 Instruktiere 3Bmeta-textgeneration-llama-3-2-3b-instruct
MetaLama 3.2 Instruktiere 1Bmeta-textgeneration-llama-3-2-1b-instruct
MetaLama 3.1 Instruktiere 8Bmeta-textgeneration-llama-3-1-8b-instruct
NVIDIANemotron 3 Super 120 B (A12B)huggingface-llm-nvidia-nemotron-3-super-120b-a12b-bf16
NVIDIANemotron 3 Nano 30 B (A3B)huggingface-reasoning-nvidia-nemotron-3-nano-30b-a3b-bf16
OpenAIICH HABE EINEN VERLUST VON 120Bopenai-reasoning-gpt-oss-120b
OpenAIGPT OSS 120Bopenai-reasoning-gpt-oss-20b