微信扫码
与创始人交个朋友
我要投稿
提问:5个人一起开会,随时打断、快速切换、边走边说,会议记录怎么对齐?
虽说有AI记录,但在复杂的会议场景中,到底怎样实现高精准的语音识别和说话人分离?
这个问题,现在已经可以解决了。
近日,科大讯飞再获CHiME大赛冠军,在“会议室场景远场多人语音识别”任务中,突破了人数估计、语音重叠、远场混响、人员移动及对话风格随意等难关。
把技术评测搬到会议室
CHiME(Computational Hearing in Multisource Environments)大赛组委会当地时间9月6日宣布:
科大讯飞与中科大语音及语言信息处理国家工程研究中心(NERCSLIP)、国家智能语音创新中心联合团队,在参与的全新Task 2——“会议室场景远场多人语音识别”(NOTSOFAR)任务中获得全部两个赛道的第一名,连续五届获得冠军。
53AI,企业落地应用大模型首选服务商
产品:大模型应用平台+智能体定制开发+落地咨询服务
承诺:先做场景POC验证,看到效果再签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2024-09-18
阿里8B模型拿下多页文档理解新SOTA,324个视觉token表示一页,缩减80%
2024-09-16
Mac上运行微软最新Phi-3.5-mini大模型+开发Agent
2024-09-12
GPT-4 和 GPT-4o的主要区别
2024-09-10
使用 Dify 和 AI 大模型理解视频内容:Qwen 2 VL 72B
2024-09-09
独家丨科大讯飞多模态:都说端到端好,看谁有本事先做出来
2024-09-08
国内首个多模型AI搜索引擎,专门为AI设计的搜索引擎
2024-09-07
语音驱动嘴型与面部动画生成算法大盘点
2024-09-05
如何利用视觉AI做自动化测试?--Applitools
2024-06-17
2024-07-11
2024-06-17
2024-04-21
2024-08-06
2024-08-30
2024-06-26
2024-07-11
2024-07-15
2024-06-16
2024-09-01
2024-07-31
2024-07-25
2024-07-19
2024-07-15
2024-07-15
2024-07-14
2024-07-14