俄罗斯联邦储蓄银行开放SIRIN库,用于检测人工智能模型响应中的错误
Сбер
俄罗斯联邦储蓄银行(Sber)已将其SIRIN库开源,该库用于检测人工智能模型输出中的幻觉和不一致性。这个库结合了多种验证方法,使开发者能够检查整个响应或片段,并且还能判断人工智能代理是否有足够的信息来回答问题。它现已在GitVerse、GitHub和Hugging Face上可用。
Sberbank实用人工智能中心的科学家团队已将SIRIN(语义不一致识别与检查关联)库开源。SIRIN通过识别捏造的事实或源数据不支持的事实,帮助提高AI代理和语言模型的可靠性。该库融合了多种响应验证方法,使开发者能够比较、组合并选择最适合其任务的方法。它可以检查整个响应或单个文本片段,并指出模型可能出错的地方。此外,SIRIN还可以初步评估AI代理是否有足够的信息来回答,从而通过请求更多数据或拒绝回答来帮助防止错误。该库基于Sber在幻觉检测方面的研究,特别是元模型,仅使用250个训练示例就能将错误检测准确率提高近30%。Sberbank高级常务董事兼人工智能转型总监谢尔盖·里亚博夫指出,该方法在内部已被证明有效,现在向所有公司开放,以促进市场发展。开发者可以在几分钟内将SIRIN集成到他们的助手中,它对实施大型语言模型的企业以及AI助手、RAG系统和AI代理的开发者都很有用。该库可在GitVerse、GitHub上获取,并在Hugging Face上提供网络演示。
来源: CNews —
原文
