资讯动态

  • 首页 千问智谱连夜开源,都比DeepSeek便宜,国产大模型价格猛卷

千问智谱连夜开源,都比DeepSeek便宜,国产大模型价格猛卷

2026-08-28

智东西 编译 程茜 编辑 云鹏 智东西8月27日报道,昨晚,阿里千问大模型团队 开源多模态MoE模型Qwen3.8-Flash-Next ,该模型是基于下一代Qwen4架构构建的先导预览版。 Qwen3.8-Flash-Next主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数,原生支持262144 token上下文,并可通过YaRN扩展至 1百万token 。 相比于Qwen3.7-Plus,Qwen3.8-Flash-Next降低了训练与推理成本,训练开销仅约为前者的 1/9 ,但在编程和办公任务上性能更强,且该模型在千问团队放出的基准测试中绝大多数都 超过DeepSeek-V4-Flash正式版 。 在价格方面,Qwen3.8-Flash即将上线千问AI平台,对外提供API服务,每百万Tokens输入 1元 ,输出 3元 ,相比空闲时段的DeepSeek-V4-Flash输入价格低 33.33% ,输出价格低 33.33% 。 昨晚,智谱也开源了GLM-5系列首个原生多模态模型GLM-5.3-Flash(320B-A18B),这也是此前在网上爆火的匿名模型Ox-Alpha(“牛来”模型),同样将价格打了下来。其新模型总参数320B,在智谱自研Z.ai Code Bench体感评估中编程表现与Claude Opus 4.8相当,价格更是降到了GLM-5.3的1/10,限时折扣内为GLM-5.3的1/20,为Opus 4.8的1/40。 ▲Qwen3.8-Flash-Next与DeepSeek-V4系列模型价格对比(智东西制图) Qwen3.8-Flash将首发上线“千问办公”,API即将上线。 在千问AI平台上,该模型以qwen3.8-flash的名称提供服务,千问AI平台支持行业标准协议,包括兼容OpenAI的Chat Completions和Responses API,以及兼容Anthropic的接口,同时Qwen API支持Anthropic API、OpenAI Responses协议,可直接配合Claude Code、Codex使用。 其博客提到,千问提前释出结构上的改动,是为了在发布Qwen4完整模型家族之前,先让社区对其进行检验。 在千问的推特评论区下方,不少海外开发者已经迫不及待想要体验下千问的新模型了,还有网友只是一味夸赞称“这太强了”、“我们不需要OpenAI”、“Qwen未来有可能超越Opus”。 目前,Qwen3.8-Flash-Next的模型权重在Hugging Face与ModelScope发布,默认1百万上下文并内置官方工具的生产版本。 Hugging Face开源地址:https://huggingface.co/Qwen/Qwen3.8-Flash-Next 一、十余项测试超过DeepSeek‑V4‑Flash、Claude‑Opus‑4.6 Qwen3.8-Flash-Next围绕Attention、Residual、Embedding 和 Optimization四个方面对模型进行了系统升级,在提升模型能力的同时,进一步优化了计算效率、模型容量和训练稳定性。 ▲Qwen3.8-Flash-Next模型架构 千问大模型团队放出的基准测试结果显示,Qwen3.8-Flash-Next在智能体、编程、通用能力以及多模态等方面绝大多数都超越了Qwen3.8‑27B、Qwen3.7‑Plus、DeepSeek‑V4‑Flash‑0731、Claude‑Opus‑4.6(Max),拿下第一。 具体来看在纯文本能力方面,Qwen3.8-Flash-Next在 10项任务拿下第一, 超过Qwen3.8‑27B、Qwen3.7‑Plus、DeepSeek‑V4‑Flash‑0731、Claude‑Opus‑4.6(Max)。 其中编程能力上,Qwen3.8-Flash-Next在智能体编程DeepSWE1.1、SWE‑bench Pro多语言软件工程上拿下第一,仅在仓库级代码生成Repo‑level code generation测试中略逊于DeepSeek。 智能体上,千问新模型在长周期办公任务、专业工作任务、前沿智能体任务的加权部分得分、真实工具调用测试机中均拿下第一,在前沿智能体任务的一次性完全通关率上得分低于DeepSeek‑V4‑Flash。 通用能力上,Qwen3.8-Flash-Next在指令遵循、科学推理、竞赛代码上拿下第一,仅在多学科综合推理能力上略弱于Claude‑Opus‑4.6。 多模态能力方面,该模型 13项任务 均超过其他三个模型拿下第一。 多模态智能体能力中,主要考验模型是否能看懂截图,操作手机、电脑,复现APP、网页开发、多

about image