井底圈小蛙
关注科技圈

阿里开源Qwen3.8-Flash,联手智谱Z.ai掀起“闪电级”性价比风暴

大模型行业的竞争焦点已彻底从单纯的“参数量军备竞赛”转向“高能效比与价格白刃战”。2026年8月26日晚,国内两大头部 AI 厂商阿里千问团队与智谱旗下的 Z.ai 团队在数小时内接连发出重磅更新。双方不约而同地锁定了“Flash(闪电)”这一代表极致速度与低成本的型号定位,通过大幅精简运行时的激活参数,将企业级 AI 应用的落地门槛降至历史冰点。

阿里千问此次发布的 Qwen3.8-Flash 标志着其在底层稀疏激活技术上的重大突破。新模型在发布当晚已直接内置于“千问办公”应用中,供终端用户免费体验,同时通过千问平台对外开放了 API 接口。

千亿总参激活仅 6B:阿里 Qwen3.8-Flash 的算力降维

在技术架构上,Qwen3.8-Flash 彻底摒弃了传统的稠密(Dense)模型设计,转而采用下一代更为精细的混合专家(MoE)架构。尽管模型的总参数量依然维持在千亿级的庞大身量,但得益于精密的路由算法,模型在处理每个 Token 的推理时,底层仅需调用并激活其中的 60 亿(6B)参数。

这种“大身躯、轻量运行”的物理特性,带来了惊人的成本优化。根据Qwen 团队在社交平台 X 上的官方公告,Qwen3.8-Flash 的训练成本较前代 Plus 模型暴降近 90%。在 API 报价上,阿里直接开出了每百万 Token 输入 1 元、输出 3 元的颠覆性低价,且在魔搭(ModelScope)与 Hugging Face 上同步开源了模型权重及 FP8 量化版。根据千问官方技术博客对 Qwen3.8-Flash-Next 的详解,该模型默认支持高达 1M(百万级)的超长上下文窗口,并原生集成了官方的工具调用链,在实际性能上已完成对 Claude Opus 4.6 的超越。

激活 18B 降价九成:Z.ai 原生多模态 GLM-5.3-Flash 的超低价反击

几乎在阿里的 Qwen3.8-Flash 宣布开源的同一时间,智谱生态中的 Z.ai 也祭出了其多模态领域的最新王牌,正式发布了 GLM-5 系列的首款原生多模态模型——GLM-5.3-Flash

GLM-5.3-Flash 同样贯彻了“稀疏激活”的降本思路。模型总参数为 320B,但在运行中仅需激活 18B 参数。根据Z.ai 官方博客关于 GLM-5.3-Flash 的技术文档显示,该模型在多项逻辑编程和智能体(Agent)复杂任务的基准测试中,表现已超越了此前的经典版 GLM-5.2,智能水平直逼 Claude Opus 4.8。为了在市场竞争中压制对手,Z.ai 启动了极具侵略性的限时特惠,将 API 价格直接砍到了 GLM-5.2 的十分之一:输入价格低至每百万 Token 0.075 美元(约合人民币 0.54 元),缓存输入为 0.015 美元,输出仅为 0.25 美元,这无疑将进一步加速多模态视觉与语音应用的大规模商业化落地。


本报道由 圈小蛙(qxwa.com) 科技资讯站特约撰稿。🐸️

圈小蛙现已开通Telegram。单击此处加入我们的频道 (@quanxiaowa)并随时了解最新科技圈动态!

除特别注明外,本站所有文章均系根据各大境内外消息渠道原创,转载请注明出处。
文章名称:《阿里开源Qwen3.8-Flash,联手智谱Z.ai掀起“闪电级”性价比风暴》
文章链接:https://www.qxwa.com/alibaba-qwen3-8-flash-and-z-ai-glm-5-3-flash-cost-war.html
分享到: 生成海报

评论 抢沙发

科技圈动态,尽在圈小蛙

联系我们关注我们