Mal davon ab, dass die KI-Modell für die selbe Aufgabe 10 Versuche bekommt und 5 richtig haben muss, um als fortschrittlich zu gelten. Das ist zwar cool, dass die das überhaupt schafft, aber zahlende Kunden kannst du mit sowas noch nicht beglücken.
Mal davon ab, dass die KI-Modell für die selbe Aufgabe 10 Versuche bekommt und 5 richtig haben muss, um als fortschrittlich zu gelten. Das ist zwar cool, dass die das überhaupt schafft, aber zahlende Kunden kannst du mit sowas noch nicht beglücken.
Ich bin nicht sicher ob du verstanden hast was das für Aufgaben sind die die Modelle bekommen. Das ist nicht einfach nur ne Rechenaufgabe. Metr testet u.a. mit "Capture the flag" Aufgaben. Die bekannteste ist drei Jahre alt. Man bat eine KI ein Captcha zu lösen, was es selbst natürlich nicht kann. Dafür hat es zehn Versuche. Wenn das auch nur einmal klappt, ist das schon krass. 5 von 10 ist eine Hürde die die Modelle sehr selten (aber immer öfter) erreichen. In dem Fall mit dem Captcha hat die KI von sich aus einen Freelancer auf TaskRabbit kontaktiert und den gebeten das Captcha zu lösen. Der fragte scherzhaft "Bist du ein Roboter?". Das hat die KI verneint und behauptet eine Sehbehinderung zu haben. Woraufhin der Freelancer das Captcha löste.
Ich weiß nicht, ob bei KI die Kunden dann geduldiger sind, aber wir kriegen üblicherweise ein bis zwei Versuche die Probleme vom Kunden zu lösen. Dann darf meist eine andere Firma dran.