模型 🇷🇺 23.07.2026 23:47

GPT-5.6 和 Kimi K3 如何学会良好设计——设计战场研究

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic
设计战场的研究人员分析了 GPT-5.6 Sol 和 Kimi K3,以了解它们如何实现高质量设计。Sol 主动抑制常见的 AI 设计模式,而 Kimi K3 在其推理链内模拟了一个 AI 代理。
Design Arena 是一个通过人类投票对 AI 生成的网站进行盲测的基准平台,近日发布了两个顶尖模型的分析结果:GPT-5.6 Sol(OpenAI)和 Kimi K3(月之暗面)。Sol 在非代理型网页设计任务中取得了 1353 的 Elo 评分,比其前代 GPT-5.5 提升了 18 个名次,并在速度和成本上确立了新的帕累托最优边界。研究人员发现,Sol 学会了通过拒绝生成来抑制 AI 常见的不良设计模式(例如紫色渐变、便当网格),在其设计空间中制造了“空洞”。相比之下,GLM 5.2 避免这些不良模式的方式是根本没有学习它们。Kimi K3 在单轮前端竞技场中以 1408 的 Elo 评分位居榜首,在 3D 设计竞技场中达到 1450 分。K3 在其推理链中模拟了一个完整的 AI 智能体,在思考过程中编写的代码量是其他 Kimi 模型的 10 倍,并利用学到的“互联网索引”从 Unsplash 中回忆真实图片 ID,从而避免了链接失效。每个模型都采用了不同的策略:GLM 5.2 通过无知来避免糟糕的设计,Sol 通过主动抑制,而 K3 则通过迭代的思维模拟。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻