KI-Modellentwickler: Betreiben sie Pelikan-Maximierung?
Ein Forscher testete sieben moderne KI-Modelle mit einem beliebten informellen Benchmark: Erstellung eines SVG-Bildes eines Pelikans auf einem Fahrrad. Die Ergebnisse zeigen keine Hinweise darauf, dass die Modelle für diese spezifische Aufforderung optimiert sind, und entkräften damit den Verdacht der Benchmark-Maximierung.
OpenAI
Anthropic
Google/DeepMind
xAI
Alibaba/Qwen
DeepSeek
Habr — хаб ИИ28.07 · 08:04

