HelloKitty • 2026-08-05 14:50
50
本文由 猎云精选 撰写/授权提供,转载请注明原出处。
以下文章来源于:猎云精选
作者:王非
2025 年春天,AI 行业迎来了“DeepSeek 时刻”。到了 2026 年夏天,“时刻”正在变成“节奏”——7 月 31 日,国产大模型一场罕见地集体亮相,注定被人铭记。
稍早前的 7 月 16 日,月之暗面发布了 Kimi K3,并于 7 月 27 日放出完整权重。Kimi K3 完整权重开放后的第四天,也就是 7 月 31 日,其他几家厂商的新产品集中登场:
上午 09:04,MiniMax 正式发布新款通用全模态生成模型 H3;中午 13:43,字节跳动发布新一代视频创作模型 Seedance 2.5;下午 14:56,DeepSeek 正式上线 DeepSeek-V4-Flash-0731 API 公测;与此同时,智谱的 GLM Coding Plan 也在 7 月 31 日当天,恢复订阅并推出团队版。
这不是一次计划好的“联合发布”。四条不同的 AI 战线——开放权重、视频生成、Agent 能力与订阅商业化——在算力受限的现实里同时向前推进。它们从不同的时间节点出发,在 7 月 31 日这一天站到了一起。
而这也标志着,国产大模型的竞争已经越过单点跑分阶段,模型、应用、渠道、价格和开放生态开始以产品矩阵的方式协同出击,一场“交付竞赛”的大幕正在开启。
MiniMax、字节同日上新,快手还会远吗
“去年是 DS(DeepSeek),今年是 SD(Seedance 2.0)……”这是对于 2025 年、2026 年春节前夕,两款国产人工智能大模型火爆的形象概括。
随着 Seedance 2.0 突然爆火,其竞品快手可灵 3.0 也借势出圈,两者共同掀起了一场关于“AI 导演革命”的全民创作浪潮。AI 视频竞争已从“单帧画质”升级为“工作流整合”,掌握多模态调度能力者将定义下一代创作标准。
从 2025 年 5 月的 1.0 版本,到 2025 年 12 月的 1.5 Pro 版本、2026 年 2 月的 2.0 版本,字节跳动旗下 Seedance 的更新时间均不超过半年。
如今,距离 Seedance 2.0 在春节爆火恰好小半年。于是在 2026 年 7 月 31 日,Seedance 2.5 正式发布:可单次生成 30 秒视频片段,并支持多轮延长;支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材;支持精准的时间戳控制,可定向编辑视频内容。

来源:即梦 AI 官网
当前,Seedance 2.5 正在陆续上线即梦 AI、豆包专业版等平台,API 服务也将在近期上线火山方舟。官方同步宣布,徐工集团、小鹏汽车、智元机器人、灵初智能、微分智飞、穹彻智能、Xspark AI(无界智航)等多家企业已与火山引擎达成合作意向,将率先接入 Seedance 2.5。
与春节期间,字节跳动 Seedance 2.0 与快手可灵 3.0 同台较量不同的地方在于,这一次 Seedance2.5 的发布,正好撞上了 MiniMax H3。
同样拥有视频生成能力的两款新模型,少不得被拿来作为对比。
据介绍,MiniMax H3,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。
当前,MiniMax H3 已登陆海螺 AI、API 及 Runway、fal、OpenRouter 等全球渠道。
MiniMax、字节跳动同日上新,快手还会远吗?
早在 2024 年 6 月,快手便推出了视频生成模型可灵“可灵”。随后在 2025 年 4 月,快手高级副总裁、主站业务与社区科学线负责人盖坤,用极高的评价为快手在视频生成领域的成绩定调:“‘可灵’吹响了整个视频生成赛道的挑战哨。”“在我们之后,各个厂商都开始发视频生成模型。”
截至 2026 年 2 月可灵 3.0 上线,快手在 20 个月内陆续更新了 8 个大小不一的模型版本。按照平均速度来看,快手可灵新版本,应该已经上线了。外界为何会有“快手还没动静”的错觉?首先,快手近期的重心在于内部融合与商业变现(如广告生成式推荐、短剧素材自动化);其次,7 月初,可灵业务顺利落地近30亿美元首轮融资,投后估值达 180 亿美元。
当前,市场对于可灵的关注点,仍集中在融资。新模型的微调发布,或许不会太远了。
集体上新背后:三个共同趋势
7 月 31 日,MiniMax、字节跳动、DeepSeek 集体上新之前,智谱 GLM-5.2、Kimi K3 已相继亮相。其中,Kimi K3 更是一举成为全球最大的开源模型,在全球科技界引发广泛关注与讨论。
就在 8 月 3 日,阿里巴巴刚刚发布新一代旗舰大模型 Qwen3.8-Max:模型总参数量 2.4 万亿,Qwen3.8-Max 在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。
而这,无疑再次加重了“2026 年夏季成为国产大模型迭代最集中窗口期”的分量。
和以往单纯比拼参数规模不同,这一轮集体上新背后,是国产大模型行业从技术验证走向商业落地的关键转折,各家厂商不再挤在同一条赛道上内卷,而是基于自身禀赋走出了差异化的发展路径。
尽管各家模型的技术路线和应用场景各有侧重,但这轮集体上新仍展现出几条清晰的共同趋势。
第一,开源成为标配。
Kimi K3 在发布后即宣布开源完整模型权重,成为全球首个落地的 3 万亿参数级开源大模型;MiniMax H3 也宣布于8月3日开源,成为 MiniMax 推出的首款开源多模态生成模型;DeepSeek V4-Flash 则以 MIT 许可证开源。开放权重正在成为厂商生态路线的重要分化方向,黄仁勋联合微软、Meta 等机构公开支持开放权重路线,OpenAI 随后也签署了相关公开信。

来源:MiniMax 官网
第二,多模态能力全面升级。
无论是语言模型还是视频模型,多模态都是本轮更新的关键词:Kimi K3 原生支持视觉理解;MiniMax H3 是一个通用型全模态生成系统,可统一理解文本、图像、视频和音频组成的多模态上下文;Seedance 2.5 延续了统一的多模态音视频联合生成架构。
第三,性价比成为核心竞争力。
当前,各家都在用更低的价格提供更强的能力:DeepSeek V4-Flash 输入价格仅 1 元/百万 token,输出 2 元/百万 token;MiniMax H3 的 2K 视频生成价格为 0.8 元/秒,仅为业内同类旗舰模型的三分之一;Kimi K3 也推出了缓存命中后低至 2 元/百万 token 的输入定价。
需要注意的是,字节跳动则依仗强大能力“涨价”。7 月 31 日,Seedance 2.5 上线当天,字节跳动公布的 API 价格显示:包含视频输入 42 元/百万 tokens;不含视频输入 70 元/百万 tokens。
作为对比,上一代 Seedance 2.0(输出分辨率 720P)包含视频输入 28 元/百万 tokens;不含视频输入 46 元/百万 tokens,新版本涨幅分别达 50%、52%。
四条差异化技术路线,更是四条商业化路径
在相同的趋势下,各大厂商自然也选择了更适合自身、不同的突围路径。其中,Kimi 堆参数、DeepSeek 抠效率、MiniMax 打通模态、字节跳动深耕场景,成为典型代表。
一直以来,月之暗面走的都是“大就是强”的路线。其最新发布的 Kimi K3 总参数达到 2.8 万亿,拥有 100 万 token 上下文窗口,是目前全球参数最大的开源模型。在 Frontend Code Arena 全球 AI 大模型榜单中,Kimi K3 以 1679 分超越 Claude Fable 5 位居第一,实现了开源模型首次超越头部闭源模型登顶。
与 Kimi 形成鲜明对比的是,DeepSeek“少即是多”的路线。V4-Flash 总参数 2840 亿、激活参数仅 130 亿,仅用 Pro 预览版六分之一的总参数和不到四分之一的激活参数,便在九项智能体与代码基准上全面超越 Pro 预览版。稍早前在业内流传的内部交流录音中,梁文锋也对于当下热门赛道“视频生成、3D、世界模型”不为所动,他认为,“这些跟智能的上限没关系。我们不做。”
作为 MiniMax 的关键词之一,其最新发布的 MiniMax H3,打破任务边界,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。在 Artificial Analysis 有声视频编辑榜单中,H3 以 1130 分的 Elo 成绩位列全球第一。该版本的发布也被视为“开源领域终于有了一个真正意义上的‘全模态’统一模型”。
Seedance 2.5 则侧重“长叙事,从创意走向生产力”——其单次可生成 30 秒高质量视频片段,相比上一代的 15 秒翻了一倍。用户一次最多可输入30张图片、10 段视频和 10 段音频作为参考素材。模型还支持精准的时间戳控制,可定向编辑视频内容。Seedance 2.5 正在从“生成内容”走向“理解世界”,从“辅助创意”走向“提升生产力”。
技术路线的不尽相同,自然也决定了各大模型厂商,差异化的商业化路径。模型集体上新背后,正是一场关于如何把技术转化为收入的竞赛。
在定价上,Kimi K3 走高端路线,输出定价 100 元/百万 token,远超 DeepSeek V4-Pro 等竞品,其 License 模式也在探索开源模型的商业空间。值得一提的是,Kimi K3 发布后,该公司融资节奏进一步加速——完成超 35 亿美元 F 轮融资,投后估值达 350 亿美元,原定 8 月开始的新一轮融资已提前启动,投前估值升至 500 亿美元。据传,其最快可能在未来 6 个月内登陆港股市场。

来源:天眼查
DeepSeek 依靠极致性价比,同步加速推进全球化布局。V4-Flash 的极致低价正在推动欧美公司将其嵌入工作流处理普通任务,仅在最复杂任务中调用高端模型。同时,DeepSeek 率先引入了峰谷定价机制,高峰时段价格为平时的 2 倍。这种精细化的定价策略,既优化了资源利用效率,也为商业化提供了更多弹性。稍早前在业内流传的内部交流录音中,梁文锋也曾提到公司的定价原则:按 10 个月收回设备成本定价(约6倍利润),不追求需求弹性下的高价。
MiniMax 的商业化则有两条腿:一是海外 C 端市场。其旗下 AI 陪伴应用 Talkie 已是全球领先的应用之一,截至 2025 年 9 月,累计用户达 1.47 亿,月活跃用户达 2760 万,付费用户数在 2025 年前 9 个月达 177.16 万。二是视频生成的成本优势,H3 在 768p 分辨率下的价格约为同业一半,2K 分辨率下仅为同业三分之一。该版本发布后,港股 MINIMAX-W 次日涨超 10%。
稍早前,MiniMax 曾在 5 月 28 日披露,过去两个月,公司年化经常性收入(ARR)实现超过 100% 的增长。按今年 2 月 ARR 超 1.5 亿美元计算,其最新 ARR 已超 3 亿美元。公司的收入结构也从 2025 年 C、B 端起三分,转为各占一半。
在所有国产视频模型中,字节跳动的商业化进展最为瞩目,Seedance 也被誉为最赚钱的视频模型,在 AI 短剧、漫剧工具赛道中占据超过 80% 的市场份额。某分析师曾透露 Seedance 的 6 月份流水在 18-21 亿元(此前业界传闻其单月收入超过 10 亿元,火山引擎总裁谭待公开辟谣称外界传闻都是错误的,比实际收入偏高)。2026 年,火山引擎已将 MaaS 业务全年营收目标提升至 150 亿元,是 2025 年实际营收的十倍。
作为对比,2026 年第一季度,快手可灵 AI 产生的收入超过 6.5 亿元,同比增长超过 300%。2026 年 3 月,可灵 AI 的年化收入运行率(ARR)近 5 亿美元。
值得关注的一条暗线在于:字节跳动的组织架构调整——飞书产品团队与豆包产品团队整合,成立新的豆包产品团队;飞书 GTM 团队与火山引擎团队整合,成立新的 ToB GTM 组织“创造力服务平台”。这一调整意味着,字节跳动正在将AI能力深度嵌入生产力场景,试图打通从模型到应用再到商业化的闭环。
不难看出,2026 年夏天,正在成为 AI 应用产业的关键转折点。
当前,国产大模型的能力正在接近全球主流模型第一梯队,而商业化的竞争才刚刚进入深水区。谁能在技术、成本、生态和场景之间找到最优解,谁就能在这场长跑中率先撞线。
注:部分内容由 AI 总结。


扫码关注公众号
获取更多技术资讯