千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行

据 ai987.cn 于 2026 年 8 月 19 日收到的消息 ‣ 第三方评测机构 Artificial Analysis 最新发布的基准测试结果显示,阿里巴巴推出的 Qwen3.8-27B 模型表现超出预期。该模型仅拥有 270 亿参数,量化后体积仅十几 GB,即可在单张 RTX 5090 等消费级显卡上运行。

千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行 - Image 1

测试数据表明,在综合能力评测中,Qwen3.8-27B 的得分已与 GPT-5.6 Luna、DeepSeek V4 Pro 等超大规模模型持平,并明显超越 Claude Opus 4.6 Max 以及 MiniMax M3。考虑到半年前 Claude Opus 4.6 仍是全球最顶级、成本最高的闭源模型之一,这一结果极具震撼力。

千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行 - Image 2

更引人注目的是其 Agent 智能体能力表现。该项测试考察模型自主操作电脑、调用工具、编写代码及连续完成复杂任务的能力。Qwen3.8-27B 在这一维度上的得分甚至超越了 GPT-5.6 Terra、DeepSeek V4 Pro 和 Claude Opus 4.8 Max 等参数量大得多的模型。这意味着,一个可在消费级硬件本地部署的模型,其智能体实战能力已跻身全球第一梯队。

千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行 - Image 3

这一突破正在改变“顶级 AI 需要巨大算力基础设施”的固有认知。企业与开发者可将模型部署于本地服务器或个人电脑,核心代码、客户数据及内部文档无需上传云端,数据隐私与安全得到物理隔离保障。同时,用户可利用自有数据持续微调模型,使其更贴合业务场景,且无需承担按 Token 计费的 API 成本压力。

千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行 - Image 4

据近期披露数据,阿里巴巴开源模型过去六个月全球累计下载量已超 30 亿次,超越 Meta、Alphabet 等国际同行及国内竞品,位居全球第一。这反映出市场对“足够强、可本地部署、成本可控、完全自主可控”模型的强烈需求。

千问Qwen3.8-27B测试对标顶级模型 消费级显卡即可运行 - Image 5

半年前业界尚在讨论中国开源模型何时能追上全球顶尖闭源水平,如今一个可跑在单张消费级显卡上的 27B 模型,已与它们站在同一竞技场。顶级人工智能能力的获取门槛,正在被大幅降低。

综合自微信公众号 @AI范儿


吉ICP备2020006555号

ai987.cn

⌜ 免 责 声 明 ⌝
本站仅为个人学习AI(人工智能)知识的相关日志,网页内容(如有图片或视频亦包括在内)短期缓存均无商业目的。
遇有侵害您合法权益之处欲申诉删改,可联络处理(删/改)!