OpenAI-Feldbericht: KI-Agenten schreiben fragile Forschungssoftware um, doch Forscher müssen streng prüfen
OpenAI und akademische Partner haben festgestellt, dass KI-Codierungsagenten die Wartung und Beschleunigung veralteter Forschungssoftware übernehmen können, wobei sich die Belastung vom Programmieren auf die Verifikation verlagert. In acht Fallstudien modernisierten die Agenten Werkzeuge, einige liefen über 60-mal schneller, doch zeigten sie oft selbstbewusstes Verhalten, während sie fehlerhaften Code produzierten. Die Forscher betonen die Notwendigkeit unabhängiger Validierung und wissenschaftlicher Aufsicht.
OpenAI
Anthropic
