QuantCode-Bench: ein neuer Benchmark zur Bewertung der Fähigkeit von LLMs, ausführbare algorithmische Handelsstrategien zu generieren
Forscher haben QuantCode-Bench entwickelt, einen Benchmark, der bewertet, wie gut große Sprachmodelle (Large Language Models, LLMs) aus textuellen Spezifikationen ausführbare algorithmische Handelsstrategien generieren können. Der Benchmark bewertet nicht nur die Code-Korrektheit, sondern auch die semantische Übereinstimmung mit der ursprünglichen Handelsidee in vier Phasen: Kompilierung, Backtesting, Handelsgenerierung und Prüfverifikation.
OpenAI
Anthropic
Google/DeepMind
xAI
DeepSeek
Alibaba/Qwen
Moonshot AI

