/fileadmin/images/sarganserlaenderlogo.png
Alle Neuigkeiten auf einen Blick.
E-Paper

E-Paper

Die digitale Ausgabe des Sarganserländers.

Zeitungsarchiv

Zeitungsarchiv

Alle Ausgaben seit dem Jahr 2003.

Abo

Abo

Sarganserländer von Montag bis Freitag online oder in Print lesen.

Siga-Podcast

Siga-Podcast

Ä Ohr voll Heimat – der Siga-Podcast vom «Sarganserländer»

Grossauflage

Grossauflage

Lesen Sie hier die aktuelle Grossauflage kostenlos

Inserieren

Inserieren

Ihre Werbung am richtigen Ort.

Buchshop

Buchshop

Hier finden Sie die von der SL Druck + Media AG herausgegebenen Bücher.

Immobilien

Immobilien

Die Immobilienbörse der Region

Unternehmen

Unternehmen

Die SL Druck + Medien AG

Traueranzeigen

Traueranzeigen

Todesanzeigen / Danksagungen aufgeben

Eventbus

Eventbus

Mit Brunner Ferienreisen AG und Sarganserländer ans Konzert

Rubriken

Ausland
Keystone-SDA | Sonntag, 20. September 2026

KI hat gravierende Schwächen beim Erkennen von Formen

Ob eine Katze oder ein Auto: Menschen erkennen Gegenstände und Lebewesen selbst dann noch zuverlässig, wenn sie nur als grober Schattenriss zu sehen sind. Für Künstliche Intelligenz (KI) ist genau das dagegen eine oft unlösbare Hürde, wie eine Studie zeigt.

Moderne Bilderkennungsprogramme schneiden beim Erfassen übergeordneter Formen und Silhouetten deutlich schlechter ab als menschliche Betrachter, wie ein Forschungsteam um Biyu He von der New York University Grossman School of Medicine im Fachjournal "iScience" berichtet.

Ursache für die Schwäche ist die grundlegend andere Funktionsweise der Algorithmen: Während das menschliche Gehirn die Gesamtgestalt priorisiert, klammern sich selbst moderne tiefe neuronale Netze vorrangig an lokale Details, Oberflächenmuster und Texturen. Schon geringfügige Bildverzerrungen oder das Fehlen typischer Details bringen die Systeme schnell aus dem Konzept.

Mehr als 200 Modelle im Test

Für die Untersuchung verglich das Team um Erstautor Mugihiko Kato und Studienleiterin He die Sehleistung von Testpersonen mit der von mehr als 200 tiefen neuronalen Netzen unterschiedlichster Bauart und Trainingsweise. Die Forschenden manipulierten dafür 240 Abbildungen aus 48 Alltagskategorien systematisch. Gezeigt wurden unter anderem reine schwarze Silhouetten ohne jede Innenstruktur und isolierte Muster wie Felltexturen ohne erkennbare Kontur. Weiterhin wurden Darstellungen verwendet, bei denen viele kleine Objekte bildfüllend aneinandergereiht waren, sodass zwar Binnendetails erhalten blieben, der typische Umriss jedoch zerstört war.

Keines der über 200 KI-Modelle konnte das menschliche Erkennungsmuster über alle Bedingungen hinweg vollständig nachbilden. Sobald die Identifikation allein an der Erfassung der Gesamtsilhouette hing, lagen die Computeralgorithmen durchweg hinter den menschlichen Probanden.

Kreuzchen statt Katze

Besonders drastisch zeigte sich diese Diskrepanz in einem Folgeexperiment, bei dem die Gesamtform von lokalen Details entkoppelt wurde: Die Forschenden füllten die Umrisse von Gegenständen und Tieren mit vielen kleinen Kreuzchen. Während Menschen das Motiv weiterhin problemlos anhand der äusseren Kontur benennen konnten, versagten die meisten KI-Modelle völlig. Sie deuteten Katzen- oder Schmetterlingssilhouetten plötzlich reihenweise als "Kreuzworträtsel", "Fenstergitter", "Kettenhemd" oder "Fadenwurm", weil die kleinen Kreuzmuster die Auswertung der Algorithmen vollständig dominierten.

Heutige Bilderkennungsmodelle seien keineswegs so menschenähnlich, wie oft angenommen werde - obwohl sie mit gigantischen Mengen an Fotos trainiert wurden, die Menschen aufgenommen haben, betonte He. Zwar erzielten moderne Systeme, die gleichzeitig mit Bildern und begleitenden Texten geschult wurden, insgesamt deutlich menschenähnlichere Trefferquoten als herkömmliche Bilderkennungsnetze. Doch auch sie verloren ihren Vorteil, sobald die Gesamtgestalt gestört oder isoliert bewertet wurde.

Bedeutung für autonomes Fahren

Die Ergebnisse sind für praktische Anwendungen von zentraler Bedeutung: Sollen KI-Systeme in der Robotik, beim autonomen Fahren oder in Sehprothesen und Gehirn-Computer-Schnittstellen für sehbehinderte Menschen zuverlässig arbeiten, müssen sie auch bei Nebel, Dämmerung oder Verdeckungen verlässliche Urteile fällen. In solchen Situationen greift der Mensch instinktiv auf die grobe Silhouette zurück. Die Studie liefere wertvolle Hinweise, wie Algorithmen künftig trainiert werden müssen, um ein ganzheitlicheres und damit robusteres Sehvermögen zu entwickeln, schreibt das Team.

Zurück

Kommentare (0)

    Schreibe einen Kommentar
    ×

    Name ist erforderlich!

    Geben Sie einen gültigen Namen ein

    Gültige E-Mail ist erforderlich!

    Gib eine gültige E-Mail Adresse ein

    Kommentar ist erforderlich!

    * Diese Felder sind erforderlich.