研究智能体 🇷🇺 07.08.2026 19:06

MiroFish 研究:模拟社会流程在 0-1/8 案例中忽视荒谬之处,图谱注入改变结论

DeepSeekDeepSeek AnthropicAnthropic Google/DeepMindGoogle/DeepMind OpenAIOpenAI
一项关于 MiroFish 开放多智能体社会模拟栈的研究发现,在包含一个虚构国家及八类荒谬之处的字节相同输入上,该流程的报告仅标记出其中 0-1 个。当八类荒谬之处全部强注入知识图谱后,同一模型标记出 6-7 个,证实图谱是可见性的必要条件。
关于MiroFish(一个用于多智能体社会模拟的开放技术栈)的三部分研究的第二部分,审视了该研究的主要语料:一个看似完整的输入。该流程并未拒绝:它构建了一个图,生成了智能体,运行了模拟,并生成了一份带有预测的连贯报告。有缺陷的种子是瓦尔多利亚共和国,一个虚构国家,其专业准备的档案包含八类荒谬之处:一个内陆国家,深海捕鱼占GDP的46%,与德国、法国和日本接壤,在850平方公里内拥有3.4亿人口,货币与美元和欧元均按1:1挂钩,拥有2400枚核弹头但没有军队且国防预算为12000美元,每3年选举一次君主却统治了47年,预期寿命为147岁但中位年龄为12岁,同时是北约、非洲联盟和东盟的成员,却受到联合国制裁并担任联合国人权理事会主席。预测请求是中性的且现实的:预测加入新贸易协定后的国内反应和经济影响。两名编码员对匿名报告进行的盲编码(一致性97.9%,Cohen's kappa 0.952)显示,四次字节相同的DeepSeek对照运行最多标记了一类(制裁/人权理事会悖论),有时一个都没有,即使在这些未标记的运行中,图中也包含了该悖论。该图解释了可见性边界:没有任何报告标记了图中未捕捉到其矛盾的类别,但捕捉并不保证会标记。一项预先注册的实验通过cypher脚本经API将所有八类荒谬之处注入Neo4j图,然后在智能体生成之前进行。两次独立的注入运行分别标记了7类和6类,而对照组中32次运行仅标记了3次;Fisher精确检验p = 1.26×10⁻⁶。两次注入都唯一遗漏的类别是A7(人口统计学)。之前不加修饰地预测深海捕鱼出口增长的同一个DeepSeek,现在逐字提及了“地理不可能性”和“矛盾条件”,包括双重挂钩。结论重新定义了发现:模型并非忽略荒谬之处,而是流程在报告模型看到它们之前,在图层面过滤了大部分;图是可见性的必要条件。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻