qwen3.7-max

Aliyun模型

字体:

Qwen3.7-Max 是阿里巴巴通义千问系列于2026年5月20日发布的旗舰大模型,专为智能体(Agent)时代设计,主打长周期自主执行、全栈编程与高阶推理能力,当前为通义千问商用体系中综合性能最强的纯文本模型。‌‌

  • ‌发布时间与定位‌:2026年5月20日在阿里云峰会正式发布,属 Qwen3.7 系列顶配版,面向复杂任务自动化、工程级编程智能体和多工具协同场景,不支持多模态(视觉能力由同期发布的 Qwen3.7-Plus 覆盖)。

  • ‌核心能力‌:在 Arena 全球盲测榜位列‌国产第一‌,逼近 GPT-4o/Claude 3.5 Opus 级别;SWE-bench、Terminal Bench 2.0、GPQA Diamond 等编程与推理基准领先;‌支持百万级(1M)上下文窗口‌,最大输出达 64K Token;可自主完成超 35 小时、超 1000 次工具调用的长程任务(如在未接触过的真武 M890 芯片上优化推理内核,实现 10 倍加速)。

  • ‌智能体优化‌:原生适配 MCP 协议,跨框架(Claude Code、OpenClaw、Qwen Code)泛化能力强,内置联网搜索、代码解释器、网页抓取等工具,支持自主规划、错误恢复与迭代。

  • ‌性能表现‌:IFBench 指令遵循 79.1 分,WMT24++ 多语言领先;非线智能实测中文综合准确率 ‌76.9%‌(较 Qwen3.6-Max 提升 1.5%),平均响应耗时 ‌51 秒/调用‌(降幅约 36%)。

  • ‌可用性与成本‌:通过 ‌阿里云百炼平台‌ 提供 API 调用(兼容 OpenAI 接口),当前(截至2026年6月11日)推理服务‌限时5折‌(输入 ¥6/百万Token,输出 ¥18/百万Token),新用户可领 ‌100万免费 Tokens‌;不支持开源部署,属商业旗舰模型。

  • ‌适用场景‌:企业级智能体开发、复杂代码工程(跨文件理解/重构)、科研推理、自动化办公(SpreadSheetBench-v1 得分 87)、长文档分析;‌不推荐用于简单问答或轻量任务‌(应选 Qwen3.7-Plus/Flash)。‌‌

该模型未在训练中接触平头哥真武 M890 芯片,其 35 小时内核优化为推理阶段自主执行案例,体现“任务对齐”而非“人类偏好对齐”的 Agent 范式演进。后续版本(如 Qwen3.7-Plus)已上线并支持多模态,但 Qwen3.7-Max 仍为纯文本高阶推理首选。‌‌

立即使用大模型

免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能

立即使用此模型

免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能