Forschung RSS

Forschung 🇺🇸

Self-Distilled Reasoning für das Feintuning von Amazon Nova

Amazon untersucht Self-Distilled Reasoning (SDR), um Chain-of-Thought-Spuren für das überwachte Feintuning (Supervised Fine-Tuning, SFT) zu generieren, wenn solche Spuren fehlen. SDR nutzt die eigene Argumentation des zugrunde liegenden Amazon Nova 2 Lite-Modells, mildert katastrophales Vergessen und verbessert die Zielleistung ohne menschliche Annotation.

Amazon Web ServicesAmazon Web Services
AWS ML blog24.07 · 05:06
Forschung 🇺🇸

Quantencomputer, der aus eigenen Fehlern lernt

Google Research hat ein Reinforcement-Learning-(RL)-Framework demonstriert, das es einem Quantencomputer ermöglicht, sich während der Berechnung kontinuierlich an Drift anzupassen, ohne anzuhalten. Der RL-Agent lernt aus Erkennungsereignissen der Quantenfehlerkorrektur, um Steuerparameter dynamisch anzupassen, wodurch die logische Stabilität um den Faktor 3,5 verbessert und die logischen Fehlerraten auf Rekordtiefs gesenkt werden.

Google/DeepMindGoogle/DeepMind
Google Research24.07 · 03:03
Aktuelle Nachrichten