炸了!阿里开源2.4万亿大模型

2026-08-13 8 0

Qwen3.8 / DeepSeek V4 Pro / 国产大模型

8月13日国产AI双响炮:阿里首次开源Max级旗舰Qwen3.8-2.4T(2.4万亿参数),性能比肩Fable 5;DeepSeek V4 Pro 0813上线,百万上下文、384K输出。国产大模型从价格战转向性能+生态双杀。

目录

  1. 01 今天发生了什么 — 双响炮
  2. 02 为什么是拐点 — 路线互补
  3. 03 普通人怎么办 — 落地红利
  4. 04 我的三个判断 — 独立观点

8月13日凌晨,国产AI圈同时扔下两颗炸弹:阿里首次开源Max级旗舰模型 Qwen3.8-2.4T-A95B,直接把2.4万亿参数的顶级权重放到 Hugging Face;DeepSeek V4 Pro 0813 正式版上线,百万上下文、384K输出、兼容 OpenAI/Anthropic 接口。

这不是普通更新。一个把「天花板模型」开源,一个把「白菜价 API」升级成「能干活的生产工具」。国产大模型正在发生质变——从追赶到定义规则。**

今天到底发生了什么:国产AI「双响炮」

两件事同一天落地,时间点非常微妙。先快速过一遍核心事实:

阿里:首次开源 Max 级旗舰 Qwen3.8-2.4T-A95B。总参数2.4万亿,每Token激活950亿,原生支持26.2万Token上下文,可扩展至约101万。MoE架构,512个专家,默认必须开启思考模式。开源许可改为 Qwen 自定义许可,普通用户可下载修改,部分大规模商用需另行授权。

DeepSeek:正式版 DeepSeek-V4-Pro-0813 上线 API。支持思考/非思考双模式,上下文1M,最大输出384K,新增 Responses API 与 Anthropic API 兼容。定价维持预览版水平:缓存未命中输入3元/百万Token、输出6元。但官方已预告近期将「大幅上调」API价格。

Qwen3.8-2.4T-A95B 已上架 Hugging Face

Qwen3.8-2.4T-A95B 已上架 Hugging Face

一个把「最高端模型」的底层权重交出去,一个把「最好用 API」的正式版推上线。路线完全互补,不是同质化内卷。

为什么说这是国产大模型的「拐点」

过去两年,国产大模型给人的印象主要是两件事:一是价格低,二是追性能。但今天的组合拳,标志着第三件事开始发生——生态话语权

信号一 :顶级权重不再闭源锁死。Qwen3.8-2.4T-A95B 是阿里 Max 级别的旗舰,过去这类万亿参数 MoE 模型只会以 API 形式提供。现在权重开放,意味着政企、中小企业、研究机构可以基于顶尖底座做私有化部署和二次开发,不再被云厂商绑定。

信号二 :云端服务也能打硬仗。DeepSeek V4 Pro 正式版在编程 Agent、长上下文、复杂任务上的能力逼近 Claude Fable 5/Opus 5,但价格只有海外顶尖模型的几分之一。它证明了国产模型不仅能便宜,还能在高端场景里真正可用

DeepSeek V4 Pro 正式版在 Agent 相关评测上的表现

DeepSeek V4 Pro 正式版在 Agent 相关评测上的表现

信号三 :价格战正在让位于价值战。DeepSeek 官方预告 API 将「大幅上调」定价,说明头部厂商已经意识到:一味压价换市场不可持续,企业最终愿意为「能稳定完成复杂任务」的能力付费。这不是退步,是行业成熟的标志。

海外巨头普遍走闭源路线,极少开放旗舰权重;而国内一边有云厂商打磨 API 服务,一边有大厂释放顶级模型底座。两条赛道同步成熟,抗风险能力和创新空间都大不一样。

对普通人/开发者意味着什么

如果你不是大模型研究者,这两条新闻对你也有直接影响。我拆成三类人群来说:

开发者:Qwen3.8 开源后,你可以本地部署一个接近全球最顶尖的基座模型。Unsloth 已经把原始 4.9TB 的权重通过动态1-bit量化压缩到 397GB,内存+显存 410GB 以上即可运行。虽然门槛仍高,但已经从「不可能」变成「很贵但可行」。

API用户:DeepSeek V4 Pro 正式版更稳定、接口更全,适合接入生产环境。但要注意官方预告涨价,建议趁价格调整前锁定用量、评估成本,别等账单变贵再被动应对。

创业者:顶级开源权重+低价高质 API 的组合,意味着做行业专属模型、私有化部署项目的成本会显著下降。教育、医疗、金融、法律等需要数据不出域的场景,会迎来一波落地机会。

Qwen 3.8 Max 与海外旗舰模型的多维度评测对比

Qwen 3.8 Max 与海外旗舰模型的多维度评测对比

简单说:模型能力变成了可以「带走」的资产,不再只能「租用」。这个变化对商业模式的冲击,比参数增长本身更深远。

我的三个独立判断

判断一 :国产大模型进入「双轨竞争」时代。一条赛道是像 DeepSeek 这样,把 API 服务做到极致;另一条是像 Qwen 这样,用开放权重建立生态。两条路都不容易,但都比单纯堆参数更有护城河。

判断二 :高端模型本地部署会从「炫技」变成「刚需」。政务、金融、医疗等对数据主权敏感的行业,会越来越倾向于本地部署开源顶级模型。谁能把部署成本再降一个数量级,谁就可能是下一个关键点。

判断三 :接下来的竞争焦点是 Agent 能力和长上下文。Qwen3.8 默认开启思考模式、DeepSeek V4 Pro 强推 Responses API,都在指向同一个方向——模型不再只是「回答问题」,而是要「独立完成任务」。谁能把复杂任务的闭环成功率做上去,谁就能拿到企业级市场的门票。

阿里开源2.4万亿参数模型,DeepSeek V4 Pro 正式版上线,表面看是两则产品更新,深层看是国产大模型正在重构全球 AI 的产业逻辑。

过去我们习惯说「国产模型在追赶」,但今天发生的事更像是在「换赛道」。海外闭源模型靠封闭生态守住利润,国产模型则用开放权重+高性价比 API 撕开缺口。这不是说国产已经全面领先,而是说竞争规则开始由我们参与书写

对普通人来说,最实际的影响是:接下来一年,你能用更低成本、更高自主权,接触到今天世界上最顶尖的大模型能力。而企业需要思考的,不再是「要不要用 AI」,而是「用开源本地部署,还是走云端 API」。

国产大模型的时代,可能真的从8月13日这天,正式开始。**

关注深夜搞机,我会继续跟踪国产大模型的 API 价格变动、本地部署实测,以及 Agent 能力的真实落地进展。不吹不黑,只看门道。

相关文章

炸了!字节视频模型直出30秒
断网也能用!Meta开源30B小钢炮
年产100万台!特斯拉造机器人比造车狠
炸了!国产AI视频0.8元一秒
每天下班还在瞎忙?这3个AI工具,帮你省出2小时
你妈接到的”你”,可能不是你:AI诈骗正在围猎普通家庭

发布评论