应用 🇷🇺 04.08.2026 16:02

TrueConf AI秘书学会在复杂声学条件下区分说话人声音

TrueConf发布了其企业AI秘书的新版本,能够在混合音频中分离不同说话人的声音,以实现准确的会议纪要。该功能适用于任何音频和视频录制,包括来自第三方系统的录制。1.1版本还增加了转录文本的交叉搜索和可自定义的提示词。
俄罗斯IT公司TrueConf发布了其企业AI秘书的新版本,该秘书即使在处理混合音频时,也能在最终摘要中区分视频会议参与者的声音。这项新技术使得从任何音频和视频录制中生成此类报告成为可能,包括在其他通信解决方案中进行的录制。此前,TrueConf已将智能功能集成到PC和智能手机应用中:主动降噪、虚拟背景、发言人叠加和人脸聚焦。2024年10月,该公司推出了TrueConf AI Server,这是一款本地部署的AI秘书,用于大规模转录和会议摘要,它在本地运行,不会将数据传输给第三方服务器。视频会议转录的一个主要挑战是每位参与者都需要独立的音频流;如果参与者位于开放空间或共用麦克风,算法会将语音混合成一个块。现在,AI秘书学会了分离声音,并在摘要中分配相应的发言;用户只需为检测到的发言人命名。需求来自石油和天然气行业的客户、国有企业以及举行大型会议的执行委员会。开发耗时约四个月。该功能支持任何音频和视频文件,包括来自第三方系统的文件,使TrueConf AI Server成为一种通用的转录和摘要工具。1.1版本还增加了对转录文本的全文搜索,以及可自定义的提示,以便灵活准备摘要,如关键决策、任务、截止日期和结构化报告。TrueConf AI Server确保转录由本地模型在客户封闭回路内生成,公司员工或管理员无法访问。
来源: CNews — 原文
我们之前关于此话题的帖子 ↓
最新新闻