МоделиИсследования 🇷🇺 03.08.2026 23:02

Claude Fable 5 обходит GPT-5.6 в переписывании кода с нуля. Вот почему

Anthropic OpenAI
Бенчмарк MirrorCode от Epoch AI показывает, что Claude Fable 5 решает 64% задач, в то время как GPT-5.6 Sol — только 20%. Разрыв обусловлен надёжностью, а не сырыми возможностями: Sol часто решает задачи частично, тогда как Fable последовательно доводит их до конца. Сильная производительность Fable в Ada, языке с ограниченными обучающими данными, указывает на навык, а не на запоминание.
Epoch AI обновила лидербор MirrorCode, показав, что Claude Fable 5 от Anthropic решил 64% задач, в то время как GPT-5.6 Sol от OpenAI справился лишь с 20%. Такое трехкратное различие выглядит аномальным, учитывая сопоставимые результаты моделей на других тестах, но Epoch AI и Anthropic не дали официальных объяснений. MirrorCode, разработанный совместно с METR, требует от моделей переписывать
Показать ещё ↓
Источник: Habr — хаб ИИ — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости