Vision Language Modelle versagen bei einfachen Bildtests

Auch die größten Vision-Language-Models von OpenAI, Google und Meta können laut einer Studie ganz simple Aufgaben nicht lösen.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

*
*