TL;DR:
7月31日,国产大模型圈像约好了一样,MiniMax、字节、DeepSeek同时交作业。MiniMax H3做到全模态还开源,价格砍到三分之一;Seedance 2.5单次生成30秒视频,还要当你的AI导演;DeepSeek V4-Flash没换脑子但送去强化培训,Agent能力猛涨。一句话:视频模型在卷商业落地,代码模型在卷手上功夫。
说出来你可能不信,7月31日这个看似平平无奇的日子,国产大模型圈直接过年了。MiniMax、字节跳动、DeepSeek三家同一天亮出新品,把科技媒体的F5键都按冒烟了。从开源视频模型到叙事级视频创作工具,再到专攻Agent的代码模型,三款产品几乎覆盖了AI应用的主流战场。这不是巧合,这是国产大模型在集体“交作业”。123
MiniMax H3:全能型视频选手,价格还打骨折
先看MiniMax。H3是一款多模态生成模型,支持文本、图片、音频、视频输入,能输出2K分辨率、最长15秒的带音频视频。但重点不是“输入prompt生成视频”,而是它把视频生成、编辑、理解、动作迁移全塞进一个框架。以前用户需要分别用文生视频、图生视频、视频编辑等多个模型,现在一个H3搞定。4
它在指令遵循、文字和品牌信息呈现方面特别突出,显然瞄准了广告和电商场景。你输入商品图、品牌字体、参考视频、背景音乐,它能直接生成一条完整的广告片,人物、场景、产品展示全齐。对于品牌方来说,这简直是降本增效的利器。
更让人惊喜的是价格:2K视频每秒0.8元,是主流旗舰模型的三分之一。怎么做到的?MiniMax用高压缩Tokenizer减少Token消耗,在异构训练和GPU利用上做优化。说白了,技术和效率双管齐下。
而且,MiniMax宣布H3将在近期开源,成为其首款开源多模态生成模型。企业可以本地部署,芯片厂商也能跟着搞软硬件协同优化。这一步棋,让开源生态的价值进一步放大。5
在Artificial Analysis带音频的视频编辑榜单上,H3排名第一,文生视频和图生视频也处于前列。但它真正的杀手锏是瞄准了商业视频生产这个巨大市场。用一位观察者的话说:以前AI视频喜欢展示巨龙、战争,很炫酷但买单的人不多;H3聚焦广告、电商素材、产品介绍,这些才是每天被大量生产并有人愿意付钱的视频。2
Seedance 2.5:30秒叙事,不再让AI视频一段一段往外蹦
字节跳动旗下的Seedance 2.5在同一天更新,目标是把AI视频从“素材生成器”升级为“创作工具箱”。最直观的变化:单次视频生成长度从15秒翻倍到30秒。但这不只是拉长时间,而是让模型在30秒内组织多个有逻辑关系的画面,实现叙事结构——铺垫、推进、转折、收尾。用户还可以在已有视频后面继续生成,模型会尽量保持人物、场景、风格、声音和叙事节奏一致,最终形成数分钟连贯的内容。
这意味着什么?以前做一条1分钟视频,创作者需要在多个模型间抽卡、拼接、调色、加转场,现在一段30秒直接成型,还能续写,前后一致性更好。这极大地压缩了手动后期的工作量。
另外,Seedance 2.5显著提升了画质。它努力摆脱AI视频那种“油腻感”——人物皮肤不再像打了蜡,眼神、材质、光影、饱和度更接近实拍。同时,模型不再自作主张添加字幕和背景音乐,把控制权还给用户。
更让人兴奋的是参考能力升级。一次最多可以输入30张图片、10段视频、10段音频,让模型参考人物、声音、构图、场景、道具和镜头运动。以前是给AI一张参考图,现在可以把人物小传、场景图、动作样片和背景音乐全扔给它。加上时间戳编辑和局部修改功能,你可以精确控制每一秒的剧情和运镜。比如保留演员动作只换背景,或者重新设计某段的镜头运动。
从这些特性看,Seedance 2.5正在从一个“听指令生成素材的工具”,转向一个拥有导演、摄影和剪辑能力的创作平台。2
DeepSeek V4-Flash:模型没变,但后训练把它“重新教育”了一遍
同一天,DeepSeek也放出了大招:V4-Flash正式版API开启公测。和很多人预想的不同,这次更新没有改变模型架构和尺寸,而是重新进行了后训练。直白点说:脑子没换,但让这个脑子去上了个强化培训班,重点补习工具调用、任务规划、代码开发和Agent执行能力。6
效果立竿见影。在Terminal Bench 2.1上得分82.7,NL2Repo、DeepSWE、Toolathlon等Agent测试成绩明显提升。虽然部分内部测试集需要外部验证,但方向很清晰:当预训练模型越来越趋近饱和,后训练成为提升模型实际能力的关键手段。
正式版还原生支持Responses API,并适配了Codex等Agent开发环境。开发者可以让模型执行代码阅读、任务拆解、文件修改、工具调用、结果检查等一系列动作,而不仅仅是回答编程题。DeepSeek用于Agent任务的Harness框架也将在后续发布。
有意思的是,这次升级的只是Flash版本,V4-Pro和App、网页端尚未同步。这说明通过后训练,轻量模型与旗舰模型之间的能力差距正在被压缩。对于开发者来说,这意味着花更少的钱获得接近旗舰的能力。DeepSeek似乎在告诉我们:参数不是唯一,调教也很重要。
竞争启示录:国产大模型开始务实了
一天之内三款模型,两款抓视频,一款抓代码。表面上是模型竞赛,实际上是应用落地的竞赛。MiniMax H3和Seedance 2.5虽然都是视频模型,但路线不同。H3主打全能、便宜、开源,更适合商业广告、电商等场景;Seedance 2.5则死磕叙事和镜头控制,更像一个AI导演。两者不是谁替代谁,而是工作流中的不同角色。2
DeepSeek V4-Flash的后训练升级,则反映了另一种趋势:当基座模型能力到达瓶颈,如何通过数据和任务场景把模型“调教”得更聪明,成为新的竞争主线。这比单纯的参数竞赛更务实。
你发现没有?国产大模型不再执着于“超越GPT-4”这类口号,而是把精力花在产品场景、成本控制、开源生态和实际能力上。这或许才是AI行业走向成熟的正道。所以,如果哪天有人问你AI有什么新进展,你可以告诉他:7月31日,国产大模型集体交了一份还不错的作业。
引用
-
MiniMax H3 炸场!视频大模型拼“真实生产”时代到来·腾讯新闻·美港探案(2026/7/31)·检索日期2026/8/3·https://view.inews.qq.com/a/20260731A06KTO00 ↩︎
-
MiniMax H3与Seedance 2.5同台竞争,视频模型胜负标准变了·聚超值(2026/8/1)·检索日期2026/8/3·https://best.pconline.com.cn/yuanchuang/31115753.html ↩︎ ↩︎ ↩︎ ↩︎
-
MiniMax H3来了!视频模型从“生成视频”走向“商业级生产”·东方财富网·上观新闻(2026/7/31)·检索日期2026/8/3·https://wap.eastmoney.com/a/202607313828029154.html ↩︎
-
MiniMax H3发布,视频模型从“生成视频”走向“商业级生产”·新浪财经·滚动播报(2026/8/1)·检索日期2026/8/3·https://finance.sina.com.cn/jjxw/2026-08-01/doc-inikvani0602753.shtml ↩︎
-
MiniMax发布全模态生成模型H3:支持15秒2K视频,价格不到主流1/3·凤凰网(2026/7/31)·检索日期2026/8/3·https://tech.ifeng.com/c/8vCiShKUus9 ↩︎
-
DeepSeek V4-Flash正式版API开启公测·DeepSeek官方公告(2026/7/31)·检索日期2026/8/3·https://api-docs.deepseek.com ↩︎