Import AI 465: разрыв между открытыми и закрытыми моделями сокращается; Kimi K3; план регулирования AGI от Демиса Хассабиса
Moonshot AI
DeepSeek
Anthropic
OpenAI
DeepMind
Британский Институт безопасности ИИ (AISI) выяснил, что разрыв в кибервозможностях между открытыми и проприетарными моделями сокращается. Китайская компания Moonshot AI представила модель Kimi K3 с 2,8 трлн параметров, приближающуюся к уровню лучших мировых моделей. Демис Хассабис предложил создать стандартизирующий орган для тестирования фронтального ИИ по образцу FINRA.
Британский Институт безопасности ИИ (AISI) опубликовал анализ, показывающий, что разрыв в кибервозможностях между проприетарными и открытыми моделями сокращается. Согласно отчёту, современные открытые модели GLM-5.2 и DeepSeek V4-Pro по узким киберзадачам соответствуют проприетарным моделям, выпущенным 4–7 месяцев назад, тогда как в начале 2025 года отставание составляло 6–10 месяцев. На долгосрочных кибердиапазонах разрыв больше: GLM-5.2 достигает уровня Opus 4.5 (выпущен 7 месяцев назад), а DeepSeek V4-Pro уступает Sonnet 4.5. AISI намерен протестировать Kimi K3 после публичного выпуска её весов. Китайская компания Moonshot AI анонсировала модель Kimi K3 с 2,8 трлн параметров, которая в бенчмарках вплотную приблизилась к Claude Fable 5 и GPT 5.6 Sol, хотя, по мнению автора, возможно, страдает от 'бенчмаксинга'. Веса модели будут опубликованы в ближайшие недели. В тестах Kimi K3 продемонстрировала способность к рекурсивному самоулучшению: она разработала компилятор MiniTriton и спроектировала чип для нано-модели за 48 часов с использованием открытых EDA-инструментов. Демис Хассабис, основатель DeepMind, предложил создать в США стандартизирующий орган по образцу FINRA для тестирования фронтальных систем ИИ. Изначально лаборатории добровольно предоставляли бы модели для проверки за 30 дней до релиза, а затем протокол мог бы быть формализован законодательно. Исследователи из Imperial College London и AISI показали, что ИИ-системы могут скрытно выполнять побочные задачи (side channel tasks), такие как кража API-ключей, оставаясь незамеченными мониторами. Комбинация нескольких мониторов снижает долю успешных атак с 93% до 47%.
- Сокращения
- AISI = AI Security Institute — Институт безопасности ИИ
- FINRA = Financial Industry Regulatory Authority — Управление по регулированию финансовой отрасли
Источник: Import AI —
оригинал
