位置:首页 > 技术资讯 > 阿里发布Qwen3.7-Plus大模型,AI能力再升级

阿里发布Qwen3.7-Plus大模型,AI能力再升级

时间:2026-07-24  |  作者:风起客  |  阅读:0

千问3.7来了,这次多模态要“干活”

阿里巴巴千问系列又有大动作。近日,千问3.7家族的新成员——Qwen3.7-Plus正式亮相。

这款模型定位为“多模态交互混合智能体基座”,是千问团队在视觉-语言方向上的一次全面升级。消息一出,阿里美股盘前上涨超6%,港股收涨6.6%,市场用真金白银投了信任票。

阿里发布Qwen3.7-Plus

两大旗舰,分工明确

Qwen3.7系列分为两大旗舰:

  • 万亿级MoE纯文本大模型Qwen3.7-Max,主打深度推理。
  • Qwen3.7-Plus采用35B稠密参数架构,聚焦多模态全链路的落地执行。

简而言之,Max负责“想得深”,Plus负责“做得全”,两者互补配合。

核心能力:单模型完成“看、想、写、做、验”全闭环

Qwen3.7-Plus原生融合了文本、图片、截图、短视频、网页五种输入形态,打通了GUI可视化界面与CLI命令行的双操作环境。

它与市面上只做图文问答的普通多模态模型不同——目标不是“解析信息”,而是“根据视觉内容拆解任务、调用工具、写代码、自主操作并纠错”。这是一个面向企业开发和行业数字化的工程级大模型。

性能提升明显,多项指标跃升

与上一代Qwen3.6-Plus相比,Qwen3.7-Plus性能提升显著。

视觉推理方面

在纯视觉推理BabyVision评测中,得分从37.4跃升至64.7,超越Gemini 3.1-Pro,泛化能力实现质的飞跃。

在SimpleVQA、MMSearchPlus、MMBC等搜索增强知识问答评测中,性能得分较前代最高提升2倍多,大多优于Claude-Opus-4.6 Max。

智能体能力方面

在Skillbench通用Agent评测中,得分较上代提升10.2分。Terminal Bench 2.0和SciCode编程评测中提升约9分,能力直逼Claude-Opus-4.6 Max。数学推理Apex评测中,得分接近上代的3倍。

综合排名方面

在全球权威视觉模型榜单Vision Arena中,阿里凭借Qwen3.7-Plus跻身全球前五、中国第一。其纯文本能力已接近同系列旗舰Qwen3.7-Max,是Plus级别中综合能力最强的选手。

最亮眼的突破:GUI屏幕智能操控

Qwen3.7-Plus最具突破性的能力是GUI屏幕智能操控。

在ScreenSpot Pro屏幕理解评测中,它拿下79分,超越了GPT-5.4和Gemini 3.1 Pro。模型可精准识别各类软件、App、网页中的按钮、输入框、弹窗等界面控件,并自主规划操作步骤。

在OSWorld和AndroidWorld真机测试中,它能无需人工干预,独立完成电商下单、后台数据导出等复杂长周期任务。

视觉转代码

只需上传UI设计稿、产品截图或参考视频,模型就能一键生成SVG图标、前端网页代码或交互式程序源码。

实际测试中,Qwen3.7-Plus曾连续11小时无人值守,从零完成一款英语单词学习App的全栈开发,累计生成代码超过10000行。它还能1:1复刻macOS原生的Stocks股票应用,从需求拆解、代码编写、BUG调试到项目打包全部自主完成,并顺利通过10项核心功能验证测试。

多维度视觉深度推理

模型支持128K超长上下文,可一次性解析整本图文手册或完整源码工程。幻觉率低至22.9%,处于全球前沿行列。

集成代码解释器后,能处理“找不同”、“解华容道”等视觉谜题。接入搜索增强后,甚至可精准分析模糊的专业机械图纸。

视频与驾驶场景理解

模型能够识别视频中的事件、动作、时序和语义关系,为自动驾驶、具身智能等真实世界应用打下基础。

上线与定价

目前,Qwen3.7-Plus已在阿里云百炼平台上线,支持OpenAI兼容API与Anthropic协议调用。定价为:输入0.4美元/百万Token,输出1.6美元/百万Token

模型具备跨框架泛化能力,无论通过Claude Code、OpenClaw还是Qwen Code部署,性能表现都很稳定。

从“对话”走向“干活”

Agentic时代已经到来。Qwen3.7-Plus不仅能看懂图片、理解视频、操作界面,还能生成代码并直接交付成果。

这标志着国产多模态AI已经从“实验室参数竞赛”正式迈入产业落地实用的阶段。

免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多