Fine-Tuning

KI-Glossar

Der Prozess, ein bereits vortrainiertes KI-Modell mit eigenen Daten oder Beispielen auf eine spezifische Aufgabe oder einen bestimmten Stil anzupassen.

Kurzdefinition

Fine-Tuning ist ein Trainingsverfahren, bei dem ein bereits auf großen Datenmengen vortrainiertes Modell (Foundation Model) mit einem kleineren, aufgabenspezifischen Datensatz weitertrainiert wird. Das Modell behält sein allgemeines Wissen, lernt aber die Besonderheiten der neuen Aufgabe.

Einfach erklärt

Stellen Sie sich ein Sprachmodell vor, das alles über Sprache im Allgemeinen gelernt hat. Fine-Tuning trainiert dieses Modell zusätzlich mit Beispielen aus einem bestimmten Bereich: zum Beispiel juristischen Texten, medizinischen Berichten oder dem Schreibstil einer bestimmten Marke. Das Modell lernt, in diesem Bereich besonders kompetent zu sein.

Fine-Tuning ist sinnvoll, wenn ein Modell auf konsistente Weise bestimmte Formate, Stile oder Fachbegriffe beherrschen soll, oder wenn generische Modelle trotz gutem Prompting nicht die gewünschte Qualität erreichen. Es erfordert einen Datensatz mit Beispielpaaren von Eingaben und gewünschten Ausgaben sowie technisches Know-how für das Training.

Beispiel aus dem Arbeitsalltag

Ein Versicherungsunternehmen hat Tausende interne Schadensbeschreibungen nach einem einheitlichen Schema formuliert. Es nutzt diese Daten, um ein Sprachmodell zu feintunen. Das angepasste Modell erzeugt neue Schadensbeschreibungen durchgängig im korrekten Format und mit der richtigen Fachterminologie, ohne dass bei jedem Prompt ausführliche Anweisungen nötig sind.

Warum ist der Begriff wichtig?

Fine-Tuning ermöglicht spezialisierte Modelle, die in einem definierten Bereich deutlich besser performen als allgemeine Modelle. Es ist aber keine Lösung für fehlende Datenqualität oder unklare Aufgabenstellung.

Für die meisten Unternehmensanwendungen sind Prompting und RAG einfachere erste Schritte. Fine-Tuning kommt in Frage, wenn diese Methoden nicht ausreichen und ausreichend Trainingsdaten verfügbar sind.

Chancen

  • Deutlich bessere Leistung für spezifische Aufgaben oder Stile
  • Konsistenz in Format und Tonalität über viele Ausgaben hinweg
  • Reduzierter Aufwand für Prompting bei wiederkehrenden Aufgaben
  • Geringerer Datenbedarf als beim Vortraining eines neuen Modells

Risiken und typische Fehler

  • Erfordert qualitativ hochwertigen, repräsentativen Trainingsdatensatz
  • Technischer Aufwand und Kosten sind nicht zu unterschätzen
  • Schlechte Trainingsdaten führen zu schlechten oder verzerrten Modellen
  • Angepasste Modelle können allgemeines Wissen verlieren (Katastrophales Vergessen)

Verwandte Begriffe

Passende Inhalte im KI College