活动与赛事

活动banner
活动视频 ↗
赛事 | EMNLP2022 半监督和强化对话系统挑战赛邀你来战!
语音赛事2022-04-25
赛事 | EMNLP2022 半监督和强化对话系统挑战赛邀你来战!

EMNLP是由国际语言学会(ACL)主办的自然语言处理领域的顶级国际会议。特定主题的研讨会(Workshop)是 EMNLP 大会议程的精彩部分,每年从全球学者的提案(Proposal)中遴选。EMNLP 2022 Workshop Proposal 竞争激烈,在 EMNLP 官方公布的 2022 Workshop Proposal 收录结果中,由清华大学和中国移动联合承办的 SereTOD Workshop “Towards Semi-Supervised and Reinforced Task-Oriented Dialog Systems” 及相关挑战赛 SereTOD Challenge 名列其中。

了解详情 → 👥 已结束
Interspeech 2022丨FFSVC 2022 远场说话人识别比赛
语音赛事2022-04-20
Interspeech 2022丨FFSVC 2022 远场说话人识别比赛

近日,FFSVC 2022 远场说话人识别比赛已开放注册系统、提交系统和 Leaderboard,新的训练集/开发集/测试集已经发布。

了解详情 → 👥 已结束
The VoicePrivacy 2022 Challenge
语音赛事2022-03-01
The VoicePrivacy 2022 Challenge

由法国Avignon大学,Lorraine 大学,Le Mans大学,EURECOM和日本NII 联合举办的The VoicePrivacy 2022 Challenge 已经开放注册,任务主要关注语音中的隐私保护。

了解详情 → 👥 已结束
DCASE2022 Challenge
语音赛事2022-03-15
DCASE2022 Challenge

Sounds carry a large amount of information about our everyday environment and physical events that take place in it. We can perceive the sound scene we are within (busy street, office, etc.), and recognize individual sound sources (car passing by, footsteps, etc.). Developing signal processing methods to automatically extract this information has huge potential in several applications, for example searching for multimedia based on its audio content, making context-aware mobile devices, robots, cars etc., and intelligent monitoring systems to recognize activities in their environments using acoustic information. However, a significant amount of research is still needed to reliably recognize sound scenes and individual sound sources in realistic soundscapes, where multiple sounds are present, often simultaneously, and distorted by the environment.

了解详情 → 👥 已结束
ICPR 2022 多模态字幕识别竞赛正式开启!
语音赛事2022-03-07
ICPR 2022 多模态字幕识别竞赛正式开启!

视频内容理解一直是学术界和工业界的热门研究课题。视频通过视觉和音频等多模态传递丰富的信息,融合多模态信息识别视频中的内容是其中一项极具挑战和应用价值的研究课题。本次竞赛专注于视频字幕提取这一任务,字幕是视频数据中最重要的文本信息之一,其文字来源于访谈节目或电视剧等类的视频。因为字幕包含人们交谈内容的信息。字幕识别广泛用于推荐、检索和视频理解系统。为了更好促进字幕识别的发展,我们在ICPR 2022上举办多模态字幕识别竞赛,欢迎大家报名参赛。

了解详情 → 👥 已结束
明星声纹总动员:CNSRC 2022 说话人识别竞赛 Leaderboard 开放
语音赛事2022-03-15
明星声纹总动员:CNSRC 2022 说话人识别竞赛 Leaderboard 开放

CNSRC 2022 (CN-Celeb Speaker Recognition Challenge 2022) 是由 Odyssey 2022组委会发起,由清华大学、厦门大学、希尔贝壳公司联合承办的说话人识别竞赛。本次竞赛的核心目的是验证当前说话人识别 (或称声纹识别) 技术在实际复杂场景下的真实可用性。自竞赛发布之日起,现已有90余支来自世界各地的队伍注册参赛。目前,竞赛注册通道依然开放,欢迎研究团队以机构或个人名义注册参赛,并可在所有环节选择匿名。

了解详情 → 👥 已结束
OLR2021 | 第六届“东方语种识别竞赛”研讨会即将召开
语音赛事2022-01-14
OLR2021 | 第六届“东方语种识别竞赛”研讨会即将召开

2022年1月14日,由厦门大学、清华大学、海天瑞声、西北工业大学及昆山杜克大学联合主办,中国计算机学会语音对话与听觉专委会、中文信息学会协办的第六届“东方语种识别竞赛”(OLR2021)研讨会在线上成功召开。研讨会全程英文交流,由清华大学王东老师主持。在研讨会上,获奖队伍分享了各自竞赛系统的设计和改进经验,参会人员针对语种和语音识别的技术难点进行了一场酣畅淋漓的交流!

了解详情 → 👥 已结束
Acoustic Echo Cancellation Challenge – ICASSP 2022
语音赛事2021-12-09
Acoustic Echo Cancellation Challenge – ICASSP 2022

The ICASSP 2022 Acoustic Echo Cancellation Challenge is intended to stimulate research in the area of acoustic echo cancellation (AEC), which is an important part of speech enhancement and still a top issue in audio communication and conferencing systems. This is the third AEC challenge and it is enhanced by including mobile scenarios, adding speech recognition rate in the challenge goal metrics, and making the default sample rate 48 kHz. In this challenge, we open-source two large datasets to train AEC models under both single talk and double talk scenarios. These datasets consist of recordings from more than 7,500 real audio devices and human speakers in real environments, as well as a synthetic dataset. We also open source an online subjective test framework and provide an online objective metric service for researchers to quickly test their results. The winners of this challenge are selected based on the average Mean Opinion Score achieved across all different single talk and double talk scenarios, and the speech recognition rate.

了解详情 → 👥 已结束
2022  ICASSP Grand Challenge |Machine Learning for 3D Audio Signal Processing
语音赛事2021-11-24
2022 ICASSP Grand Challenge |Machine Learning for 3D Audio Signal Processing

3D audio is gaining increasing interest in the machine learning community in recent years. The range of applications is incredibly wide, extending from virtual and real conferencing to autonomous driving, surveillance and many more. In these contexts, a fundamental procedure is to properly identify the nature of events present in a soundscape, their spatial position and eventually remove unwanted noises that can interfere with the useful signal. To this end, L3DAS22 Challenge presents two tasks: 3D Speech Enhancement and 3D Sound Event Localization and Detection, both relying on first-order Ambisonics recordings in reverberant office environments.

了解详情 → 👥 已结束
ICASSP 2022 Grand Challenge | 首届语音深度合成鉴别挑战赛(ADD 2022)成功举办!
语音赛事2021-11-16
ICASSP 2022 Grand Challenge | 首届语音深度合成鉴别挑战赛(ADD 2022)成功举办!

ICASSP 2022 Grand Challenge--首届语音深度合成鉴别挑战赛(ADD 2022)正式开启!

了解详情 → 👥 已结束
ICASSP 2022 多通道多方会议转录挑战项目(M2MeT)成功举办
语音赛事2021-11-11
ICASSP 2022 多通道多方会议转录挑战项目(M2MeT)成功举办

近日,ICASSP 2022 多通道多方会议转录挑战(M2MeT)完成了测试集评测及结果公布。本次挑战由阿里巴巴达摩院语音实验室和希尔贝壳联合举办,多位国际知名行业专家包括达摩院语音实验室负责人鄢志杰、研究员马斌,希尔贝壳CEO卜辉,希尔贝壳基金会谢磊教授,美国俄亥俄州立大学汪德亮教授,丹麦奥尔堡大学谭政华教授,上海交通大学钱彦旻教授,新加坡A*STAR资讯通信研究院高级科学家Kong Aik Lee等参与大会组织和评审。

了解详情 → 👥 已结束
Multimodal Information Based Speech Processing Challenge 2021
语音赛事2021-10-20
Multimodal Information Based Speech Processing Challenge 2021

由中国科学技术大学杜俊教授,佐治亚理工学院的李锦辉教授、西北工业大学的陈景东教授、卡内基梅隆大学的Shinji Watanabe教授、西西里中部自由大学的Siniscalchi Sabato Marco教授以及代尔夫特理工大学的Odette Scharenborg教授联合举办的基于多模态信息的语音处理(MISP)国际挑战赛已经开放注册,今年关注的是家居电视场景下的多人中文聊天场景,包括音视频唤醒和音视频语音识别两个任务。MISP评测也已被接收为ICASSP 2022 Signal Processing Grand Challenge,参加两个任务排名前列的团队有机会将自己的技术方案写成论文被ICASSP 2022会议接收。欢迎大家报名参加!

了解详情 → 👥 已结束
天马杯全球高校科技创新大赛
语音赛事2021-09-28
天马杯全球高校科技创新大赛

“天马杯全球高校科技创新大赛”(以下简称大赛),是由马上消费金融股份有限公司主办的高校级别的科技主题杯赛。在新时代国家信息化发展“数字中国”大战略背景下,2021届大赛主题为“敢为所AI,无惧未来”,围绕人工智能核心技术助力实体经济建设的宗旨,依托马上消费强大的科技实力与丰富的行业数据,吸引高校人才共同发现、创造具体落地场景的技术方案。以赛引才、以赛促研、以赛兴业,通过大赛的举办为优秀的高校人才提供企业就业机会,为广大高校学子的创业、创新提供观点与思路的交流,引导更多青年人才在乡村振兴赋能、数字中国建设等方面进行有价值的探索。

了解详情 → 👥 已结束
同花顺算法挑战赛开放报名,奖金丰厚,等你来战!
语音赛事2021-09-01
同花顺算法挑战赛开放报名,奖金丰厚,等你来战!

为进一步促进AI在金融科技行业的整体发展,9月1日,由浙江核新同花顺网络信息股份有限公司主办,浙江大学人工智能研究所指导的同花顺“9-10双月算法挑战赛”(以下简称9-10双月赛)报名活动正式开启!

了解详情 → 👥 已结束
对话式AI语音识别及说话人识别(ASR&SD)挑战赛
语音赛事2021-07-19
对话式AI语音识别及说话人识别(ASR&SD)挑战赛

如今,对话式AI成为人工智能热门方向,它在商业上的应用规模不断增长,也是人工智能研究者重要研究领域。IDC数据显示,中国对话式AI市场规模预计在2023年达到约18.6亿美元,2019-2023年的年均复合增长率(CAGR)为34.0%。 对话式AI是指能够进行人类对话,捕捉对话语境并做出智能化响应的智能语音助手。对话式AI是基于模型认知,突破聊天机器人单一的问答方式,可破译复杂场景,理解人类情感。它能够基于NLP功能与人进行个性化对话,根据对人类情感的理解采取相应行动。 对话式AI要想精准领会意图,做出瞬间响应,做到和人自然对话,离不开大量结构化训练数据的支撑。挑战赛主办方将联合企业、机构和高校等,共同探索对话式AI创新发展。

了解详情 → 👥 已结束
长短视频多语种多模态识别挑战赛
语音赛事2021-06-07
长短视频多语种多模态识别挑战赛

近年来,随着短视频、直播等应用的迅速崛起,带来了长短视频、直播音视频等新兴互联网媒介的百花齐放。各类创作模式层出不穷、创作门槛日趋平民化,导致各类长短音视频、直播流中声学场景更加复杂多变,多语种、多方言问题日益突出。围绕各类长短音视频的语音识别和内容理解任务一直以来都备受工业界关注,如何对各类视频内容进行准确转写和内容理解,成为了字幕内容创作、兴趣内容推荐、数字媒介归档等下游应用中不可或缺的利器。 因此,由腾讯科技、数据堂、清华大学、西北工业大学、中国计算机学会联合主办长短视频多语种多模态识别挑战赛,围绕时下在工业界最为关注的三类媒体形式——长视频、短视频、直播场景进行。

了解详情 → 👥 已结束
2021第六届“东方语种识别竞赛”
语音赛事2021-07-23
2021第六届“东方语种识别竞赛”

本届竞赛新增以真实场景音频作为测试集的任务赛道和混合13种语言的“多语种语音识别”任务赛道。 在语种识别的开放赛道,测试集由17种语言覆盖视频会议、日常对话等10余个场景的真实环境音频和开源数据集两部分组成,这意味着本届OLR胜出队伍的模型将更贴近真实使用场景,环境鲁棒性更强,提前为模型吹响了实战的号角,以加速其适应真实世界交互的过程。 此次的多语种语音识别任务赛道突破了历届OLR仅识别语种的任务限制,参赛队伍的模型需要识别出多语种混合测试集的语音内容。这样的设置不仅出于实际应用需求的考虑,也为低资源数据识别训练提供了新的解题思路。据悉,工业级语音识别系统通常需要上万甚至十万小时以上规模的标注数据,才能在特定场景达到90%以上的识别率,而诸如小语种等低资源数据获取难、标注难、评估难,已经成为了世界性难题。多语种语音识别,可通过对大语种模型的迁移学习或多语种共享特征学习弥补对低资源数据的依赖。

了解详情 → 👥 已结束
第四届国际智能语音及人工智能产品创新大赛
语音赛事2021-04-29
第四届国际智能语音及人工智能产品创新大赛

一步加快智能语音及人工智能研发及产业化,促进智能语音及人工智能领域创新创业者的交流,加快建设中国声谷,进一步以赛促研,以赛促产,以赛促引,以赛促合,决定举办第四届国际智能语音及人工智能产品创新大赛。

了解详情 → 👥 已结束
第四届iFLYTEK A.I.开发者大赛
语音赛事2021-05-20
第四届iFLYTEK A.I.开发者大赛

权威证书、230W+大奖、绿色就业通道、讯飞offer、专业教培……来iFLYTEK A.I.开发者大赛,开始成为职业开发者的第一步,让你的未来多一种可能。

了解详情 → 👥 已结束
2021中国华录杯·数据湖算法大赛—语音识别赛道
语音赛事2021-05-18
2021中国华录杯·数据湖算法大赛—语音识别赛道

2021年5月21日第五届世界智能大会,举办赛事在线发布会,比赛正式启动,开始初赛报名、赛事训练数据发布,本届比赛分为初赛、复赛、决赛三大阶段。

了解详情 → 👥 已结束
NCMMSC 2021丨长短视频多语种多模态识别挑战赛正式开赛
语音赛事2021-09-04
NCMMSC 2021丨长短视频多语种多模态识别挑战赛正式开赛

针对本次会议,由腾讯科技 ASR&OCR oteam联合发起围绕时下在工业界最为关注的三类媒体形式---长视频、短视频、直播场景进行比赛。

了解详情 → 👥 已结束