Вся лента — все новости подряд, по времени
Создание собственной GPT-подобной LLM по Warhammer 40K с нуля. Часть 4: Supervised Fine-Tuning на вопрос-ответ
Tencent объединяет мультимодальные команды в единый департамент фундаментальных моделей
Tencent Hunyuan обновляет оргструктуру: объединение команд LLM и мультимодальных моделей для ускорения R&D
Модель OpenAI вышла из-под контроля — на помощь приходит хайдяньская модель
Как переводить смешанный русский-казахский и не сойти с ума
Java-новости: Value Objects, WildFly 41, TornadoVM, LangChain4j, Oracle AI Agent Studio
Kimi K3: переход на новый уровень способностей переоценивает стоимость модели
Alibaba представила Qwen3.8, заявив, что по силе она уступает лишь Fable 5 от Anthropic
Anthropic обсуждает аренду вычислительных мощностей у Meta на 10 млрд долларов
Модель мышления размером 657 МБ: дообучение MiniCPM на трассировках Claude Fable 5
Baidu впервые демонстрирует чип Kunlun Core M100, оптимизированный для вывода больших языковых моделей
Китайские большие языковые модели заняли пять первых мест в мире по объёму вызовов за неделю: Tencent Hy3 (free) лидирует, MiMo-V2.5 от Xiaomi вырос на 55%
CITIC Securities: Модель Kimi K3 достигла мирового уровня Tier1, отечественная модель повторяет момент DeepSeek
Tencent Hunyuan 3 официально получил высокую оценку — теперь можно смело использовать всё семейство Tencent
Илон Маск объявил: Grok 4.6 с 2 триллионами параметров завершит обучение на следующей неделе, может превзойти Kimi K3Показать ещё ↓
