Импорт ИИ 461: «Выравнивание не на правильном пути»; FrontierCode; и синтетические научные стажёры

CognitionCognition Alibaba/QwenAlibaba/Qwen AnthropicAnthropic OpenAIOpenAI
Исследователи из UK AISI и Timaeus основали некоммерческую организацию Sequent для разработки методов выравнивания, обеспечивающих безопасность сверхразумных систем. Компания Cognition выпустила бенчмарк FrontierCode для оценки качества кода, где лучшая модель Claude Opus 4.8 набрала лишь 13.4% на сложнейшем уровне. Также представлены датасет ChinaHeritaQA для оценки культурных знаний VLM о китайских объектах ЮНЕСКО и модель Xiaomi MiMo-V2.5-Pro-UltraSpeed со скоростью генерации 1000 токенов/с.
Бывшие сотрудники отдела выравнивания UK AI Security Institute и стартапа Timaeus объединились для создания некоммерческой организации Sequent, которая займётся разработкой техник выравнивания, дающих высокую уверенность в безопасности сверхразумного ИИ. Sequent планирует привлечь $100–150 млн начального финансирования и нанять 40–80 сотрудников, делая ставку на портфель исследовательских
Показать ещё ↓
Сокращения
AISI = AI Security Institute — Институт безопасности ИИ
VLM = Vision-Language Model — визуально-языковая модель
Источник: Import AI — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости