<EbeneX/>
Grundlagen Daten · Updated 10. Juni 2026

Klassifikation (Classification)

Definition

Klassifikation ist eine Machine-Learning-Aufgabe, bei der ein Modell Eingaben einer von mehreren festen Kategorien zuordnet – etwa E-Mails als Spam oder Nicht-Spam, oder Bilder nach ihrem Inhalt.

Einsteiger 2 Min. Lesezeit EN: Classification

Einfach erklärt

Klassifikation ist eine der grundlegendsten Aufgaben im Machine Learning. Ein Modell lernt aus Beispielen, Eingaben einer von mehreren festen Kategorien (Klassen) zuzuordnen. Im Unterschied zur Regression, die einen Zahlenwert vorhersagt, ist das Ergebnis hier eine Kategorie.

Typische Beispiele: Ist diese E-Mail Spam? Zeigt dieses Bild eine Katze, einen Hund oder ein Auto? Wird dieser Kunde kündigen oder nicht? Das Modell wird mit vielen bereits korrekt zugeordneten Beispielen trainiert (überwachtes Lernen) und lernt dabei, welche Merkmale für welche Klasse sprechen.

Technischer Deep Dive

Arten der Klassifikation

  • Binär – zwei Klassen (Spam / Nicht-Spam)
  • Multiklassen – mehr als zwei sich ausschließende Klassen (Ziffer 0–9)
  • Multilabel – eine Eingabe kann mehreren Klassen zugleich angehören (Tags eines Artikels)

Gängige Algorithmen

AlgorithmusStärke
Logistische Regressioneinfach, gut interpretierbar
Naive Bayesschnell, robust bei Text
Entscheidungsbäume / Random Forestnichtlinear, wenig Vorverarbeitung nötig
Neuronale Netzekomplexe Muster, große Datenmengen

Bewertung

Die reine Trefferquote (Accuracy) täuscht bei unausgewogenen Daten. Aussagekräftiger sind:

  • Precision – wie viele der als positiv vorhergesagten Fälle stimmen?
  • Recall – wie viele der tatsächlich positiven Fälle wurden gefunden?
  • F1-Score – das harmonische Mittel aus beiden
  • ROC-Kurve / AUC – Verhalten über alle Schwellenwerte hinweg

Klassifikation ist wie das Sortieren der Post: Jeder Brief landet in genau einem Fach – Rechnung, Werbung oder Privat. Das Modell lernt aus vielen vorsortierten Beispielen, welche Merkmale für welches Fach sprechen.

Ordnet Eingaben einer von mehreren diskreten Klassen zu (im Gegensatz zur Regression)

Binär (zwei Klassen) oder multiklassen (mehrere Kategorien)

Bewertung über Metriken wie Accuracy, Precision, Recall und F1-Score

Spam-Erkennung

E-Mails automatisch in Spam und Nicht-Spam einteilen

Medizinische Diagnose

Auffälligkeiten in Bildern oder Laborwerten als gutartig oder bösartig einstufen

Sentiment-Analyse

Texte als positiv, neutral oder negativ klassifizieren

Bilderkennung

Objekte auf Fotos einer von vielen Kategorien zuordnen

Was ist der Unterschied zwischen Klassifikation und Regression?

Klassifikation sagt eine diskrete Kategorie voraus (z. B. Spam/Nicht-Spam), Regression einen kontinuierlichen Zahlenwert (z. B. einen Preis). Beide sind überwachte Lernaufgaben, unterscheiden sich aber in der Art der Zielgröße.

Warum ist Accuracy nicht immer die beste Metrik?

Bei unausgewogenen Datensätzen kann ein Modell hohe Accuracy erreichen, indem es einfach immer die häufigste Klasse vorhersagt. Metriken wie Precision, Recall und F1-Score zeigen dann besser, wie gut das Modell wirklich ist.

Was ist binäre versus multiklassen Klassifikation?

Bei binärer Klassifikation gibt es genau zwei mögliche Klassen (ja/nein). Bei multiklassen Klassifikation sind es drei oder mehr. Multilabel-Klassifikation erlaubt zudem, dass eine Eingabe gleichzeitig mehreren Klassen angehört.

Dein persönliches Share-Bild für Instagram – 1080×1080px, bereit zum Posten.