模型 RSS

研究 🇺🇸

Import AI 458:解读未来与奇点场景

本期 Import AI 收录了在牛津大学 HAI 实验室的演讲和一个关于积极奇点的虚构故事。演讲探讨了AI的快速进步如何让社会面临选择:探索未来或逃避现实。作者描述了其与AI的交互,从拼写检查到深度个人建议,再到基于自身内容创建可重复技能。

AnthropicAnthropic
Import AI27.07 · 21:04
研究 🇺🇸

管理大型语言模型中的推理级别

文章解释了像 DeepSeek-R1 和 GPT-5.6 这样的推理模型如何通过可验证奖励的强化学习(RLVR)来学习生成推理轨迹。它详细介绍了训练过程、推理扩展、思考标记以及如何通过监督微调和分词器切换来实现推理努力模式(低/中/高)。

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
最新新闻