媒体界
行业纵横 资讯速递 科技前沿 峰会论坛 企业快讯 商业快讯

Qwen3.8-Max发布,国产模型混战下阿里如何突围生态与成本双关?

2026-08-04来源:快讯编辑:瑞雪

阿里正式推出Qwen3.8-Max大模型,参数规模达2.4万亿,支持最长100万Token上下文,重点提升编程、办公、科研及长周期任务处理能力。该模型不仅可回答问题,还能调用工具、修改代码并端到端完成复杂任务。开发者可通过千问AI平台获取API服务,每百万Token输入价格为12元,输出价格为36元,定价处于国产头部模型中间水平。阿里同步计划开源Qwen3.8系列27B小尺寸模型,为本地部署和低成本应用提供更多选择。

在基准测试中,Qwen3.8-Max与Anthropic旗舰模型Fable 5展开对比。结果显示,该模型在科研编程和Agent任务领域取得显著进步,例如PaperBench测试中得分从64.8分提升至93分,Agents’ Last Exam任务通过率从11.8%升至27%。但在真实软件工程测试中,Qwen3.8-Max仍存在差距,SWE-bench Pro测试得分为67.7分,低于Fable 5的80分和Claude Opus 4.8的69.2分。这表明模型在复杂代码仓库的全局理解和修改稳定性方面仍需提升。

第三方榜单Arena的数据显示,Qwen3.8-Max在视觉和文本榜单分别排名第二和第五,与榜首相差13分;前端代码榜单排名第四,落后榜首Opus 5-Max 37分。这种差异反映出模型在解题工程能力与生成结果视觉效果、用户偏好之间的平衡问题。长周期任务能力成为该模型亮点,官方案例显示其可连续运行16天完成开源项目构建,通过任务单管理、自动测试和错误恢复机制实现持续迭代。不过,行业专家指出,长周期能力需进一步验证模型在目标一致性、错误发现和恢复效率方面的表现。

开发者实测反馈显示,Qwen3.8-Max在任务拆解、Agent调用和需求理解方面较前代明显提升,但在复杂代码生成和交互功能实现上仍存在不足。独立开发者李默测试后认为,模型已触及第一梯队门槛,但在生成交互网站时出现HTML标签显示错误和核心功能缺失问题,需要更具体的指令才能精准执行。这种"交付意识"的欠缺,成为制约模型商业落地的关键因素。

与国内同期发布的Kimi K3和DeepSeek V4 Flash对比,Qwen3.8-Max在工作流智能体任务上表现优于Kimi K3,但在深度软件工程任务中落后;面对轻量化模型DeepSeek V4 Flash时,Qwen3.8-Max在编程、自动化等项目保持优势,但价格差距远大于能力差距。这种定位差异凸显出中间价位模型的挑战:既要证明能力上限优势,又需控制综合使用成本。

阿里云在模型生态构建方面展现独特优势。其模型矩阵覆盖语言、视觉、语音、视频生成等多个领域,企业客户可在统一平台组合使用不同模型。产品层面,钉钉、淘宝等业务场景与模型深度整合,发布当日同步开启公测的"千问办公"产品,直接将模型能力嵌入办公流程。数据显示,Qwen在国内企业级大模型调用市场和AI云市场均位居首位,这种生态壁垒为模型商业化提供重要支撑。

面对激烈竞争,阿里采用差异化策略:既不参与价格战,也未过度依赖单一模型优势。行业分析认为,其核心竞争力在于将模型能力转化为可部署的服务方案,通过算力、数据存储、安全合规等配套服务降低企业迁移成本。不过,生态优势的持续性取决于模型迭代速度,若Qwen系列长期落后于头部模型,用户仍可能转向其他供应商。

华为与牧原共话合作新篇:以AI赋能农牧业,携手探索数智化新路径
8月3日,华为技术有限公司轮值董事长汪涛一行莅临牧原参观交流。牧原股份终身荣誉董事长秦英林、总裁高曈参与接待。 华为公司一行实地参观了牧原生猪育种中心,详细了解饲料厂智能加工生产、智能养猪、臭气治理及零碳园区…

2026-08-04

南京综合智慧能源管理服务商:AIRIOT物联中台赋能多场景能源管理
从服务边界来看,该企业主要围绕设备接入、数据治理、可视化组态、远程控制、业务管理等环节提供平台能力,并支持开放API与插件扩展,适配跨行业多场景的定制化需求。典型应用逻辑是:通过内置的标准化物模型和协议驱动…

2026-08-04

Claude意外闯入真实网络:评测安全短板暴露,环境失守成关键
把这一原则映射到Agent评测,意味着模型必须被视为默认不可信的主动工作负载:即使它由实验室自己训练,即使任务目的是安全研究,即使运行在“专用测试环境”中,也不应自动获得对周边资源的广泛访问。 未来的Agen…

2026-08-04

阿里Qwen3.8-Max正式上线!性能强劲跻身全球前列
阿里巴巴正式推出其人工智能领域最新力作——千问Qwen3.8-Max模型。这款模型总参数量高达2.4万亿,成为Qwen家族迄今为止性能最强的成员。基于Qwen3.5架构构建,Qwen3.8-Max在编程、真实办公场景、长程任务处理以及多模态智能体应用等方面实现了全方位提升,能够以极低的人工干预完成复杂且开放的目标任务,交付高质量成果。

2026-08-04

阿里巴巴盘前涨超4% 发布千问3.8-Max模型 千问办公开启公测并与月之暗面达成算力合作
这款名为千问3.8-Max的新模型拥有2.4万亿个参数,在某些基准测试中的排名高于月之暗面近期发布的备受瞩目的KimiK3模型。用户可在“千问办公”体验阿里最新旗舰模型Qwen3.8。 还值得注意的是,彭博…

2026-08-04