研究 🇷🇺 13.08.2026 19:07

因诺波利斯大学获得三项人工智能专利,涉及文本与视觉注意力技术

因诺波利斯大学已获得三项专利,涉及文本处理与视线追踪领域的人工智能研发成果。这些发明能够预测阅读13种语言文本时的眼球运动,评估用于生成医生视线轨迹的模型,并加速语言模型的训练。
因诺波利斯大学人工智能研究中心的研究人员获得了三项与文本和视觉注意力相关的AI解决方案专利。第一项专利涵盖了一种在阅读过程中预测人类注视的系统,该系统可以利用统一的神经网络架构,针对英语、韩语、德语及其他十种语言的文本预测眼球运动。它结合了多语言语言模型和用于预测注视点固定的Transformer模型,并在不同母语者的眼动追踪记录上进行训练。该系统能生成合成的注视固定序列,并通过单词跳过概率和首次阅读期间的注视次数进行评估。第二项专利涉及阅读过程中注视生成的评估,解决了在比较由生成模型产生的文本上连续注视固定时缺乏统一协议的问题。所提出的方法通过空间和时间特征比较注视轨迹,并在整个文本、单个单词和句子级别评估不同的眼动特征。第三项专利是一种利用合成注视轨迹训练语言模型的方法,将视觉注意力数据整合到基于人类反馈的强化学习中。该发明包括生成合成注视固定序列和视觉注意力特征,并实现一个基于人类反馈的强化学习算法,该算法考虑了人类的注意力模式。据该大学称,这项技术将AI训练速度提高了1.5到2倍,降低了计算成本,以高达93%的准确率复现人类注意力模式,并且即使在数据量少的语言上也能正常工作。
来源: CNews — 原文
我们之前关于此话题的帖子 ↓
最新新闻