活动与赛事

做为人类的生物特征之一“声纹”,在刑侦、安防等场景有着广泛应用。每一个人的生理发音器官都有差异,任何人的声纹特征都是独一无二的。声纹识别技术通常用于解决“谁在说话?”的问题,但是仍然面对一些例如发音人个体的生物特征变化、环境噪音等问题的挑战。“文本相关”和“文本无关”是说话人识别的两个系统分类,通过声纹特征准确判断说话人的信息已经在声学以及语音分析技术中被使用,在多人对话场景中对说话人语音内容的准确识别也起到很重要的应用。声纹识别的技术已经应用到人们日常生活的各个角落。

我们看到在AI大规模落地的场景中,一方面,边缘智能占有大多数比例。将边缘端的数据进行本地处理不仅更高效也更有利于智能化的快速实现。另一方面,云端则支持更大规模的数据处理,进行更复杂的AI运算。语音和图像识别是AI最重要的两大应用,在AI云边端的支持下,它通过MCU、SoC、FPGA、ASIC等芯片以及与之相应的算法、平台得以实现广泛应用。为了能够帮助广大工程师了解目前针对这两大应用推出的众多新的技术方案,更快地导入产品应用当中。电子发烧友网主办“AI+语音/图像”智能技术论坛,将邀请优秀的芯片企业和方案公司共同分享最新的技术与市场趋势。

一步加快智能语音及人工智能研发及产业化,促进智能语音及人工智能领域创新创业者的交流,加快建设中国声谷,进一步以赛促研,以赛促产,以赛促引,以赛促合,决定举办第四届国际智能语音及人工智能产品创新大赛。

说话人日志(Speaker Diarization)技术的主要目的是,给定一段多人交流的长音频(通常为单通道口语对话语音,有较多的多人混叠片段),计算机能够自动地识别音频中有几个说话人,并检测出音频中每个说话人发言的起止时间戳,解决“谁在什么时候说话”(Who Spoke When)的问题,从而方便人们快速地检索和定位特定说话人的语音片段,是后续语音识别和声纹识别等模块的基础,被广泛用于会议场景的语音转写和索引等应用。

权威证书、230W+大奖、绿色就业通道、讯飞offer、专业教培……来iFLYTEK A.I.开发者大赛,开始成为职业开发者的第一步,让你的未来多一种可能。

The purpose of Oriental COCOSDA is to exchange ideas, share information and discusses regional matters on creation, utilization, dissemination of spoken language corpora of oriental languages and also on the assessment methods of speech recognition/synthesis systems as well as to promote speech research on oriental languages

2021年5月21日第五届世界智能大会,举办赛事在线发布会,比赛正式启动,开始初赛报名、赛事训练数据发布,本届比赛分为初赛、复赛、决赛三大阶段。

针对本次会议,由腾讯科技 ASR&OCR oteam联合发起围绕时下在工业界最为关注的三类媒体形式---长视频、短视频、直播场景进行比赛。

INTERSPEECH 2021远场多通道语音增强挑战赛已经开启,瞄准真实会议场景远场多通道语音增强。此次挑战赛由腾讯天籁实验室,西工大,CMU/JHU, Aalborg Univ, AISHELL联合举办,欢迎大家报名参加。

全国人机语音通讯会议是国内语音领域广大专家、学者和科研工作者交流最新研究成果,促进该领域研究和开发工作不断进步的重要舞台。

中国开发者生态峰会 Dev-Eco Summit China 是由 SegmentFault 思否发起的,面向 to D Marketing、开发者运营、开发者关系从业者的交流活动。

本次大会将邀请中科院声学所、南京大学、西北工业大学、重庆大学、华为、3M等高校、科研机构和企业参会,并带来最新前沿技术和产品主题演讲,分享数字音频产业生态创新与产品技术创新。

5月16日,由江苏师范大学、清华大学和海天瑞声联合举办的阿尔茨海默综合症(Alzheimer’s disease,简称AD)识别竞赛正式启动,欢迎学术界和产业界的同仁们报名参加!

本次开发者社区小型算法赛活动继续延续数据湖算法赛的理念,旨在挑选出更为优秀的人工智能算法,以及遴选出杰出的算法达⼈。同时,本次活动中涌现的优秀团队及个人将获得进入北京易华录信息技术股份有限公司实习的机会。

「AI Drive」是由 PaperWeekly 和 biendata 共同发起的学术直播间,旨在帮助更多的青年学者宣传其最新科研成果。

提供面向真实应用场景的数据集和富有挑战性的任务设定

爱奇艺联合北京希尔贝壳科技有限公司、西北工业大学音频语音与语言处理研究组、清华大学深圳国际研究生院、新加坡国立大学、起源智能在ICASSP2021举办多说话人多风格音色克隆大赛-M2VoC,M2VoC挑战赛旨在提供一个通用的数据集以及一个公平的测试平台,对语音克隆任务进行研究。

此次比赛聚焦在自动个性定制化语音唤醒能力探索,通过接近真实的语音唤醒多语言数据集,为个性定制化语音唤醒任务提供自动化的技术方案。

2021年1月30日周六上午9点到11点30在线上举行

The Third DIHARD Speech Diarization Challenge研讨会将于2021年1月23号周六晚上8点通过Zoom Webinar方式举办。

2020 Personalized Voice Trigger Challenge (PVTC 2020)研讨会将于2021年1月24日以线上的形式开启。此次会议是由昆山杜克大学、联想研究院和北京邮电大学、ISCSLP 2021共同举办。

