Kategorien des Inference-Time Scalings zur Verbesserung des LLM-Reasonings
Inference-Time Scaling verbessert die Antwortqualität von Large Language Models (LLMs), indem während der Inferenz mehr Rechenleistung eingesetzt wird. Dieser Artikel kategorisiert die Ansätze und bespricht aktuelle Arbeiten, die zeigen, dass große LLM-Anbieter auf solche Techniken setzen.
OpenAI

