Zum Inhalt springen

Wissensaustausch2 Min. Lesezeit

Einfache Lösungen für einfache Probleme: Klassisches Machine Learning in der Bildverarbeitung

Nicht jedes Problem erfordert Deep Learning. Im Zeitalter moderner KI geraten klassische Verfahren der Bildverarbeitung leicht in Vergessenheit – dabei sind sie für viele Aufgaben nach wie vor äußerst effektiv. Warum sich der Blick auf diese „alten Hasen“ auch heute noch lohnt.

Zusammenfassen mit
oder

Mit dem Siegeszug tiefer neuronaler Netze sind viele klassische Verfahren der Bildverarbeitung und des Computer Vision in den Hintergrund gerückt. Dabei eignen sich diese Methoden nach wie vor hervorragend für zahlreiche praktische Anwendungsfälle.
Klassische Ansätze sind keine Museumsstücke, sondern eher bewährte Werkzeuge: zuverlässig, effizient und für viele Aufgaben bestens geeignet – vorausgesetzt, man weiß, wann und wie man sie einsetzt.

Kantenerkennung
Bei der Kantenerkennung werden abrupte Änderungen der Helligkeit bzw. Intensität eines Bildes identifiziert. So lassen sich beispielsweise die Konturen von Kartons hervorheben, um Verformungen oder Beschädigungen leichter zu erkennen. Einer der bekanntesten Algorithmen hierfür ist der Canny-Kantendetektor.

Eckpunkterkennung und Merkmalszuordnung
Die Eckpunkterkennung basiert auf einem ähnlichen Prinzip wie die Kantenerkennung, sucht jedoch nach Intensitätsänderungen in mehreren Richtungen. Die erkannten Merkmale bilden die Grundlage für das sogenannte Feature Matching, bei dem entsprechende Punkte zwischen verschiedenen Bildern gefunden werden. Dieses Verfahren wird unter anderem für die Objektverfolgung in Videos eingesetzt.

Bildsegmentierung
Ziel der Segmentierung ist es, zusammengehörende Bildbereiche voneinander zu trennen. Ein typisches Anwendungsbeispiel ist das Herauslösen von Buchstaben oder Zahlen aus einem Bild zur weiteren Verarbeitung.

Bildklassifikation
Klassische Machine-Learning-Verfahren wie k-Nearest Neighbors (k-NN), logistische Regression oder Support Vector Machines (SVM) können auf kleinen Datensätzen gute Ergebnisse erzielen. Bei komplexeren Bildklassifikationsaufgaben bleiben sie jedoch deutlich hinter Convolutional Neural Networks (CNNs) zurück.

Objekterkennung
Nicht jede Objekterkennungsaufgabe erfordert ein neuronales Netz. In vielen Fällen liefert eine gut abgestimmte Pipeline aus Histogram of Oriented Gradients (HOG), SVM, Sliding Window und Non-Maximum Suppression (NMS) bereits sehr gute Ergebnisse.

Warum ist das wichtig?
Die Veteranen der Bildverarbeitung sollten nicht in Vergessenheit geraten. Für viele Aufgaben oder Teilaufgaben bieten klassische Verfahren eine Lösung, die einfacher, nachvollziehbarer, schneller und ressourcenschonender ist als moderne Deep-Learning-Modelle. Deshalb bleiben sie auch heute ein wichtiger Bestandteil des Werkzeugkastens für Computer Vision.