来源丨阿里语音AI 阿里团队的最新研究STAR-VAE已被机器学习顶级会议ICML 2026接收。这项工作聚焦音频生成中一个长期被忽视、却决定效果上限的底层环节——音频 VAE(连续 tokenizer),并提出了一种通用且即插即用的正则化…
声浪
科达,引领视讯与安防 苏州科达科技股份有限公司(以下简称“科达”)是领先的视讯与安防产品及解决方案提供商。 公司成立于1995年,2016年12月1日在上海证券交易所主板挂牌上市(股票简称:苏州科达,股票代码603660)。目前,公司拥有3…
新一代 Kaldi 团队近日开源了一个自研音频生成模型(声码器)Flow2GAN,质量高、速度快、好训练,是 BigVGAN 一个不错的替代方案,欢迎体验。 论文:Flow2GAN: Hybrid Flow Matching and GAN…
音频超分辨率(Audio Super-Resolution, Audio SR),即从低采样率音频恢复出高采样率版本,是提升语音清晰度、音乐细节与沉浸式音频体验的关键技术。无论是在老旧录音修复、语音通信增强,还是音乐制作与多模态生成中,高分…
归芯科技 归芯科技成立于2021年,是一家以5G/4G及下一代移动通信技术和大型SoC芯片自主设计开发为核心竞争力的高科技公司,公司重点面向超万亿产值规模的蜂窝物联网、泛智能终端、智能网联汽车、卫星互联网等行业领域提供具有竞争力的端到端平台…
海能达通信股份有限公司(股票代码:002583.SZ)是总部位于中国深圳的全球化民营上市公司,1993年成立,是全球领先的专用通信及解决方案提供商,致力于为公共安全、应急、能源、交通、工商业等行业客户,在日常工作与关键时刻,提供更快、更安全…
21dB声学人 近年来,工程师们开发了一系列越来越复杂的传感器,用于机器人、便携式、可穿戴甚至植入式监测。然后,可以使用最先进的机器学习来分析这些传感器收集的数据,使设备能够识别音频中的特定声音、图像中的对象或其他信息。 加州大学洛杉矶分校…
阶跃星辰 阶跃星辰,以阶跃之力,赴星辰大海。官网:https://www.stepfun.com/。从官网中我们可以看到,星辰自称: 汇聚顶尖人才算法专家、系统专家、亿级用户产品负责人,我们聚集了多位业界顶尖人才。 2. 自研通用大模型我们…
人工智能技术飞速发展,从20210年初深度学习的问世,人工智能已经走向以多模态技术、预训练大模型为科技基础的生成式人工智能(AIGC)时代,AIGC(Artificial Intelligence Generated Content)是指通…
