来源丨新智元 OpenAI真的要开源了!奥特曼官宣,即将开源自GPT-2以来的首款推理模型,可在消费级硬件上运行。同时,OpenAI又拿到了最高400亿单轮融资,估值直冲3000亿。 OpenAI终于要Open AI了! 一大早,奥特曼郑重…
声浪
近年来,大模型(LLMs)如 GPT 系列、Claude 等展现出的惊人多语言能力,常常让人惊叹。它们不仅能理解和生成多种语言的文本,甚至能在不同语言之间无缝切换,完成翻译、问答、写作等复杂任务。这不禁引人发问:这种强大的多语言能力究竟从何…
来源丨机器之心 3 月 27 日凌晨,阿里通义千问团队发布 Qwen2.5-Omni。 这是 Qwen 系列中全新的旗舰级多模态大模型,专为全面的多模式感知设计,可以无缝处理包括文本、图像、音频和视频的各种输入,同时支持流式的文本生成和自然…
来源丨机器之心 长文本任务是当下大模型研究的重点之一。在实际场景和应用中,普遍存在大量长序列(文本、语音、视频等),有些甚至长达百万级 tokens。扩充模型的长文本能力不仅意味着可以在上下文窗口中装入更长的文本,更是能够更好地建模文本段落…
在大数据与人工智能紧密交织的当下,文本转SQL技术是实现自然语言与数据库顺畅交互的关键。近期,中国人民大学团队推出OmniSQL及创新数据合成框架SynSQL-2.5M。 开源地址:https://github.com/RUCKBReaso…
ManusAI是由中国初创公司蝴蝶效应(Butterfly Effect)旗下Monica团队研发的全球首款通用型AI智能体,于2025年3月6日正式发布,凭借其“自主执行任务”的能力迅速引发科技界和资本市场的关注。 昨天,X平台上的一位博…
今天凌晨 3 点,阿里开源发布了新推理模型 QwQ-32B,其参数量为 320 亿,但性能足以比肩 6710 亿参数的 DeepSeek-R1 满血版。 开源地址: https://modelscope.cn/models/Qwen/QwQ…
近日,DeepSeek的横空出世,在全球科技领域激起千层浪,引发了从学界到业界的广泛热议与深度思考。《科技导报》2025年第3期刊发李国杰院士的《DeepSeek引发的AI发展路径思考》一文,深入剖析了DeepSeek背后所蕴含的AI发展路…
来源丨新智元、机器之心、赛博禅心 DeepSeek 的开源周已经进行到了第四天。今天这家公司一口气发布了两个工具和一个数据集:DualPipe、EPLB 以及来自训练和推理框架的分析数据。 DeepSe此次本次开源的三个项目: DualPi…
量子位 | 公众号 QbitAI 清华NLP孙茂松团队、北京交通大学、华中科大联合提出了多模态视觉定位新范式——Migician,作为第一个支持任意形式多图定位(Multi-image Grounding,MIG)的多模态模型,为此还设计了…
