Zum Hauptinhalt

Instruct-Modell

Instruct-Modelle sind LLMs, die nach dem Vortraining zusätzlich darauf trainiert wurden, Anweisungen zu verstehen und hilfreiche Antworten zu geben — im Gegensatz zu reinen Base-Modellen.

AIFortgeschrittenllmfine-tuningtraining

Instruct-Modell

Ein Instruct-Modell ist ein Large Language Model, das nach dem Vortraining zusätzlich darauf optimiert wurde, menschliche Anweisungen zu befolgen.

Base vs. Instruct

AspektBase-ModellInstruct-Modell
TrainingNur Textvorhersage+ Instruction Tuning
OutputVervollständigt TextBeantwortet Fragen
NutzungFine-Tuning-BasisDirekt verwendbar
BeispielLlama 3Llama 3 Instruct

Wie entsteht ein Instruct-Modell?

  1. Supervised Fine-Tuning (SFT): Training mit Frage-Antwort-Paaren
  2. RLHF: Reinforcement Learning von menschlichem Feedback
  3. DPO: Direct Preference Optimization als Alternative zu RLHF

In der Praxis

Für Chat und Assistenten immer das Instruct-Modell wählen. Base-Modelle sind nur relevant für eigenes Fine-Tuning.

Inhouse statt Nachschlagewerk

Für den Transfer ins Unternehmen sind die Inhouse-Schulungen der passende nächste Schritt.