Chefe de Compreensão Multimodal da Tencent Hunyuan Deixa a Empresa
Tencent
OpenAI
Hu Han, chefe de compreensão multimodal da Tencent Hunyuan, deixou a empresa para fundar sua própria startup. Sua equipe provavelmente mudará o foco para pesquisa de modelos mundiais, enquanto os modelos de linguagem visual (VLM) serão liderados por Tian Yonglong, ex-pesquisador da OpenAI.
По информации издания «智能涌现», Ху Хань, ранее отвечавший за мультимодальное понимание в команде Tencent Hunyuan, ушёл из компании. До перехода в Tencent в начале 2025 года он был главным исследователем в группе компьютерного зрения Microsoft Research Asia. В Tencent он присоединился к группе Frontier в подразделении больших языковых моделей, занимаясь мультимодальным пониманием и исследованиями world model. Руководитель отдела больших языковых моделей Tencent Яо Шуньюй реструктурирует команды, и группа, где работал Ху Хань, скорее всего, сосредоточится на передовых исследованиях world model. На момент публикации Tencent не прокомментировал эту информацию. Тянь Юнлун (бывший исследователь OpenAI, PhD MIT) заменит Ху Ханя в направлении VLM и будет отчитываться перед Яо Шуньюем. Яо Шуньюй, пришедший в Tencent в середине 2026 года, активно перераспределяет ресурсы, направляя таланты и вычислительные мощности на разработку базовых моделей. Например, после закрытия AI Lab ключевые исследователи перешли в отдел больших языковых моделей. На конференции Tencent Cloud AI 5 июня 2026 года топ-менеджер Тан Даошэн задал Яо Шуньюю вопрос об отставании Tencent в AI, на что инсайдеры отметили, что сам Яо Шуньюй «более нетерпелив, чем высшее руководство» и неоднократно добивался дополнительных вычислительных ресурсов для Hunyuan. Сообщается, что мультимодальное понимание (распознавание текста, изображений, видео с точностью выше 85%) уже приносит ограниченную отдачу, и пользователи не готовы за него платить — востребованы офисные сценарии (документы, презентации, отчёты), требующие рассуждения, кодинга и агентных способностей. Tencent имеет ограниченные вычислительные ресурсы (капитальные затраты 79,2 млрд юаней в 2025 году) по сравнению с Alibaba (126 млрд) и ByteDance (до 70 млрд долларов в 2026 году), поэтому компания временно приостанавливает исследования мультимодального понимания в пользу более перспективных направлений. 6 июля 2026 года Яо Шуньюй представил модель Hy3, которая среди моделей среднего размера сравнима с GLM-5.2.
Fonte: 36Kr —
original
