两周前 OpenAI 上线GPT-Live,社交媒体上的形容词高度趋同:"像人"、"有温度"、"跟朋友聊天一样"。往前推两个月,Thinking Machines Lab 放出第一批 Interaction Models;同期 xAI 的g…
声浪
通义千问团队今日正式发布 Qwen 3.8-Max,参数规模达 2.4 万亿(活跃参数 95B),成为 Qwen 家族迄今最强的模型,模型权重将于下周开源。这是 Qwen 首次对 Max 级别模型开放权重。 千问AI平台:https://w…
来源丨通义实验室 刚刚,通义发布了 Qwen3.7-Max ——面向智能体时代的新一代旗舰模型,即将通过 API 提供服务。Qwen3.7-Max 致力于成为全能的智能体基座——无论是编写和调试代码、自动化办公流程,还是在跨越数百乃至数千步…
以下文章来源于SV4Good AI Lab 引言 Sora、Kling 等文生音视频模型,能画出逼真画面、配上同步声音,但真的懂声学物理吗?吹空瓶子 vs 吹装水瓶子、敲木头 vs 敲金属,模型能生成符合物理规律的声音吗? 本文介绍由香港科…
通义实验室这次带来的是Mobile-Agent-v3.5以及最新的原生 GUI Agent 模型家族GUI-Owl-1.5:面向桌面 / 移动 / 浏览器等多端统一的基础模型与训练范式,并已全面开源。 模型链接: GUI-Owl-1.5-2…
来自小红书超级智能团队的FireRed-OCR,以仅 20 亿参数的轻量模型,在权威文档解析基准 OmniDocBench v1.5 上拿下端到端方案第一,综合得分 92.94%,超越 Gemini 3.0 Pro、DeepSeek-OCR…
来源丨机器之心 在全球具身智能领域的顶级权威评测 WorldArena 榜单中,清华陈建宇(星动纪元创始人)团队联合斯坦福 Chelsea Finn(PI 创始人) 团队研发的 Ctrl-World 世界模型交出优异答卷: 具身任务能力斩获…
大年三十,当全国人民都在忙着包饺子、看春晚、抢红包的时候,阿里通义实验室却悄无声息地在 GitHub 上丢下了一枚“核弹”。 没有预热,没有发布会,Qwen3.5就这样在除夕夜正式发布了。 当我们还在讨论 DeepSeek 的性价比、GPT…
今天,豆包大模型正式进入2.0阶段。 随着Agent时代到来,大模型将在现实世界发挥更大作用。豆包2.0(Doubao-Seed-2.0)围绕大规模生产环境下的使用需求做了系统性优化,依托高效推理、多模态理解与复杂指令执行能力,更好地完成真…
来源丨量子位 火星撞地球,新模型大战! Claude Opus 4.6发布仅仅15分钟,OpenAI也甩出了自己最新最强编程模型—— GPT-5.3-Codex。 最直观的感受是,这个新模型终于有点美学品味了。 官方展示了两个Demo:一个…
