Leiter des multimodalen Verständnisses von Tencent Hunyuan verlässt das Unternehmen
Tencent
OpenAI
Hu Han, Leiter des multimodalen Verständnisses bei Tencent Hunyuan, hat das Unternehmen verlassen, um ein eigenes Startup zu gründen. Sein Team wird sich voraussichtlich auf die Forschung an Weltmodellen konzentrieren, während die visuell-sprachlichen Modelle (VLM) nun von Tian Yonglong, einem ehemaligen OpenAI-Forscher, geleitet werden.
По информации издания «智能涌现», Ху Хань, ранее отвечавший за мультимодальное понимание в команде Tencent Hunyuan, ушёл из компании. До перехода в Tencent в начале 2025 года он был главным исследователем в группе компьютерного зрения Microsoft Research Asia. В Tencent он присоединился к группе Frontier в подразделении больших языковых моделей, занимаясь мультимодальным пониманием и исследованиями world model. Руководитель отдела больших языковых моделей Tencent Яо Шуньюй реструктурирует команды, и группа, где работал Ху Хань, скорее всего, сосредоточится на передовых исследованиях world model. На момент публикации Tencent не прокомментировал эту информацию. Тянь Юнлун (бывший исследователь OpenAI, PhD MIT) заменит Ху Ханя в направлении VLM и будет отчитываться перед Яо Шуньюем. Яо Шуньюй, пришедший в Tencent в середине 2026 года, активно перераспределяет ресурсы, направляя таланты и вычислительные мощности на разработку базовых моделей. Например, после закрытия AI Lab ключевые исследователи перешли в отдел больших языковых моделей. На конференции Tencent Cloud AI 5 июня 2026 года топ-менеджер Тан Даошэн задал Яо Шуньюю вопрос об отставании Tencent в AI, на что инсайдеры отметили, что сам Яо Шуньюй «более нетерпелив, чем высшее руководство» и неоднократно добивался дополнительных вычислительных ресурсов для Hunyuan. Сообщается, что мультимодальное понимание (распознавание текста, изображений, видео с точностью выше 85%) уже приносит ограниченную отдачу, и пользователи не готовы за него платить — востребованы офисные сценарии (документы, презентации, отчёты), требующие рассуждения, кодинга и агентных способностей. Tencent имеет ограниченные вычислительные ресурсы (капитальные затраты 79,2 млрд юаней в 2025 году) по сравнению с Alibaba (126 млрд) и ByteDance (до 70 млрд долларов в 2026 году), поэтому компания временно приостанавливает исследования мультимодального понимания в пользу более перспективных направлений. 6 июля 2026 года Яо Шуньюй представил модель Hy3, которая среди моделей среднего размера сравнима с GLM-5.2.
Quelle: 36Kr —
Original
