日前,地平线语音组开源了基于全球最大多领域中文语音识别数据集 WenetSpeech的流式模型。依托于地平线强大的艾迪开发平台,该模型拥有夯实的云端训练赋能,识别效果更优,使用效果更鲁棒,并可以同时支持流式和非流式语音识别场景和任务。 模型…
声浪
迪文科技 北京迪文科技有限公司是以提供客户高品质人机交互产品和相关系统集成服务为主的高新技术企业。公司总部位于北京中关村核心区,在上海、广州、武汉设立有区域营销和应用支持中心,制造和服务基地位于湖南省桃源县。深耕国内市场的同时,迪文也积极参…
深擎科技 深擎科技成立于2018年,是一家聚焦企业财经内容个性化服务的科技创业公司,为金融机构提供从内容生产、加工、分发到触达运营全流程的解决方案。通过AI技术赋能券商和银行,促进金融行业交易转化。 深擎科技在自然语言处理、机器学习、知识图…
cs.SD语音,共计7篇,eess.AS音频处理,共计11篇 1.cs.SD语音: 【1】 Minimising Biasing Word Errors for Contextual ASR with the Tree-Constraine…
海飞科 海飞科(Hexaflake)是一家高科技初创公司,致力于AI高性能处理器芯片和软硬件全栈系统解决方案的研发,是能够在该领域与国际巨头并驾齐驱的头部AI通用型处理器公司。主要创始人及核心团队汇聚中美各地多位国际顶级资深专家;专长涵盖并…
cs.SD语音,共计6篇,eess.AS音频处理,共计6篇 1.cs.SD语音: 【1】 Dynamic Recognition of Speakers for Consent Management by Contrastive Embed…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音13篇,eess.AS音频处理15篇。 本文经arXiv每日学术速递(微信公众号:arXiv_Daily)授权转载 cs.SD语音 【1】 Transferability of Adver…
仙豆智能 仙豆智能成立于2019年3月,是一家面向万物互联时代专注于出行场景的科技公司,助力汽车行业的数字化升级,从汽车制造商变革为用户服务商。 仙豆智能构建的基于双智融合(智能驾驶和智能座舱)的整车产品智能化、智能营销多端整体解决方案及各…
本文由清华大学与香港中文大学、字节跳动公司合作,提出了一种新的双向注意力机制(bidirectional attention mechanism)以及基于该机制的神经网络强制对齐(forced alignment)模型NeuFA。该模型基于…
奇梦者 奇梦者是一家人机交互技术服务提供商,专注于基础语音和声学技术的研究,致力于通过人工智能技术让机器听得见、听得清、听得远、听得懂,更好地感知世界。 奇梦者是一家全链路声学感知和语音技术的高科技公司,一直从事麦克风阵列技术、语音信号处理…
