<EbeneX/>
Grundlagen Mathematik · Updated 10. Juni 2026

Lernrate (Learning Rate)

Definition

Die Lernrate steuert, wie große Schritte ein Modell beim Training macht, um seine Parameter anzupassen – einer der wichtigsten und sensibelsten Hyperparameter im Machine Learning.

Fortgeschritten 2 Min. Lesezeit EN: Learning Rate

Einfach erklärt

Die Lernrate (englisch Learning Rate) ist einer der wichtigsten Hyperparameter beim Training von Machine-Learning-Modellen. Sie legt fest, wie groß die Schritte sind, mit denen das Modell seine Parameter bei jedem Trainingsschritt anpasst.

Beim Training berechnet das Modell über den Gradienten, in welche Richtung die Parameter geändert werden sollten, um den Fehler zu verringern. Die Lernrate bestimmt, wie weit das Modell in diese Richtung geht. Sie ist damit die Stellschraube zwischen „schnell, aber riskant” und „sicher, aber langsam”.

Technischer Deep Dive

Die Gratwanderung

LernrateEffekt
zu hochLoss springt oder explodiert, Training divergiert
zu niedrigTraining extrem langsam, bleibt evtl. in flachem Minimum stecken
passendzügige, stabile Konvergenz zu einer guten Lösung

Im Gradient-Descent-Update taucht sie als Faktor η auf:

w_neu = w_alt − η · ∂L/∂w

Ein größeres η bedeutet größere Schritte.

Learning Rate Schedules

Eine feste Lernrate ist selten optimal. Üblich ist, anfangs größere Schritte zu machen und sie mit der Zeit zu verkleinern:

  • Warm-up – sanfter Start mit ansteigender Lernrate
  • Step Decay – stufenweise Reduktion nach festen Epochen
  • Cosine Annealing – sanftes Auslaufen entlang einer Kosinuskurve

Adaptive Optimierer

Verfahren wie Adam passen die effektive Schrittweite pro Parameter automatisch an. Sie machen die Wahl der Lernrate robuster, ersetzen aber nicht ganz das Gefühl für eine sinnvolle Ausgangsgröße.

Die Lernrate ist wie die Schrittweite beim Abstieg von einem Berg im Nebel: Zu große Schritte und du springst über das Tal hinweg oder stürzt; zu kleine Schritte und du brauchst ewig, bis du unten ankommst. Die richtige Schrittweite bringt dich zügig und sicher ans Ziel.

Bestimmt, wie stark die Modellparameter bei jedem Trainingsschritt angepasst werden

Zu hoch: Training divergiert; zu niedrig: Training ist quälend langsam

Wird oft über einen Zeitplan (Learning Rate Schedule) während des Trainings angepasst

Modelltraining

Grundlegende Einstellung bei jedem Training mit Gradient Descent

Hyperparameter-Tuning

Meist der erste und wirkungsvollste Parameter, der optimiert wird

Fine-Tuning

Beim Nachtrainieren vortrainierter Modelle werden bewusst sehr kleine Lernraten gewählt

Was passiert bei einer zu hohen Lernrate?

Das Modell macht zu große Schritte und überspringt das Optimum immer wieder. Der Fehler (Loss) springt unkontrolliert oder wächst sogar – das Training divergiert und konvergiert nie zu einer guten Lösung.

Was ist ein Learning Rate Schedule?

Ein Zeitplan, der die Lernrate während des Trainings verändert – typischerweise startet man höher und reduziert sie schrittweise (Decay). Verbreitete Varianten sind Step Decay, Cosine Annealing und ein anfängliches Warm-up.

Wie findet man eine gute Lernrate?

Häufig per Learning-Rate-Range-Test: Man lässt die Lernrate testweise ansteigen und beobachtet, wo der Loss am schnellsten fällt, bevor er instabil wird. Alternativ helfen adaptive Optimierer wie Adam, die die effektive Schrittweite teilweise selbst regeln.

Dein persönliches Share-Bild für Instagram – 1080×1080px, bereit zum Posten.