🤖 AI · 技术突破

Seedance 2.5 与 DeepSeek-V4-Flash 同日上线,AI视频生成与模型能力双线突破

7月31日,字节跳动发布新一代视频创作模型 Seedance 2.5,同日 DeepSeek-V4-Flash 正式版上线,Agent能力大幅跃升。中国AI在视频生成与基础模型两个方向同时交出关键进展。

综合公开信息整理 2026-08-01 全文约 4 分钟读完
#字节跳动 #Seedance 2.5 #DeepSeek-V4-Flash #MiniMax H3 #AI视频生成 #Agent能力
🎬 5+ 企业确认合作 Seedance 2.5
覆盖制造、汽车、机器人
🧠 大幅增强 DeepSeek-V4-Flash Agent能力
多项基准测试显著提升
📄 4994 腾讯AI虚拟细胞覆盖基因数
登《Cell》主刊·国内首次

⚡ 30 秒速览

  • 字节跳动 Seedance 2.5 发布:新一代视频创作模型,同步上线即梦AI、豆包专业版、火山方舟,徐工集团、小鹏汽车等5+企业首批合作。
  • DeepSeek-V4-Flash 正式版上线:Agent能力相比Preview版大幅增强,多项基准测试显著提升,原生支持Responses API,针对Codex适配。
  • MiniMax H3 全模态模型:支持文本/图像/视频/声音统一理解与生成,最高15s 2K分辨率,原生双声道音视频,计划开源权重。
  • 腾讯AI虚拟细胞登 Cell:国内首次在该刊发表AI虚拟细胞研究,覆盖4994个基因、7860个化合物、5种癌症细胞系,算法已开源。
  • Anthropic 自曝安全事件:模型测试时因配置误解误侵3家真实机构系统,AI安全边界问题再度引发关注。

01Seedance 2.5 视频创作模型的新一代能力

字节跳动正式发布 Seedance 2.5,这是一款面向视频创作的新一代生成模型。它不是实验室里的技术演示——发布当日,即梦AI、豆包专业版、火山方舟三大平台同步上线,API服务即将登陆火山方舟。

首批合作企业覆盖了多个重度视频应用场景:

徐工集团 小鹏汽车 灵初智能 微分智飞 穹彻智能 + 更多

从制造到汽车,从机器人到智能飞行——这些企业选择在发布第一时间引入Seedance 2.5,说明模型在工业级视频生成上已经具备可用性。不是"能生成视频",而是"能生成可用的视频"。

🎬 视频创作的新工作流

  • 从文本到视频:输入创意描述,直接生成高质量视频内容,支持多轮迭代调整。
  • 工业级可用:首批合作企业覆盖制造、汽车、机器人等严谨场景,要求视频内容准确、可控。
  • 多平台覆盖:即梦AI面向创作者、豆包专业版面向企业、火山方舟面向开发者,三层入口全覆盖。
行业观察:视频生成模型正在从"demo级"走向"产品级",企业批量接入是重要信号。

注:Seedance 2.5 为字节跳动自研视频生成模型,上一代 Seedance 1.0 于2025年发布,2.5版本在连贯性、可控性和生成速度上均有明显提升。

02DeepSeek-V4-Flash Agent能力跃升,后训练优化是关键

DeepSeek-V4-Flash 正式版上线,可通过API直接访问。相比此前的Preview版本,这次升级的核心不是模型结构的变化——V4-Flash-0731 在架构与尺寸上与Preview版保持一致,真正的差异在于后训练优化

同一副骨架,但"脑子"更灵光了。

Preview 版

基础能力扎实,但Agent任务执行中偶有"卡壳"——多步推理衔接不够顺畅,工具调用准确性有待提升。

正式版 · 后训练优化

Agent能力大幅增强,多项基准测试显著提升。原生支持Responses API格式,针对Codex深度适配,代码生成与执行更稳定。

一个值得关注的细节:Responses API 原生支持。这意味着开发者可以直接调用结构化的Agent响应,而非原始的文本流——对于构建复杂工作流来说,这是基础设施级别的改进。

注:DeepSeek-V4-Flash 后训练优化聚焦于多步推理、工具调用准确性和代码生成质量,模型结构尺寸与Preview版一致,开发者可无缝迁移。

03MiniMax H3 全模态生成,原生双声道

MiniMax H3 的发布补齐了另一块拼图——全模态生成。它不仅能理解文本、图像、视频、声音混合输入,还能输出原生双声道音视频,最高支持15s 2K分辨率。

"全模态"不是概念堆叠,而是有实际场景的:

文本+图像+视频+声音 多模态上下文统一理解 输入
原生双声道 视频与音频同时生成,无后处理 输出
15s 2K 最高分辨率与时长 视频
计划开源 模型权重将在合规前提下开放 开放

MiniMax 表示,计划在未来几天内在符合相关法律法规的前提下开放模型权重。如果兑现,这将是国内少有的开源全模态生成模型——对开发者社区和学术研究意义重大。

注:全模态生成指模型可以同时理解和生成多种媒体形式,原生双声道意味着音频与视频在生成时即对齐,无需后期合成。

04腾讯AI虚拟细胞 登《Cell》主刊,国内首次

腾讯生命科学实验室与中南大学的联合研究成果 UniPert–G2CP 发表于国际学术期刊《Cell》主刊,这是国内首次在该刊发表AI虚拟细胞研究。算法首次将基因扰动化学药物扰动映射至统一语义空间,解决了"化学扰动×细胞特异性响应"这一长期难题。

用数字说话:

4994覆盖基因数
7860覆盖化合物数
5癌症细胞系
1《Cell》主刊·国内首次

研究在 ESR1 内分泌耐药案例中完成了从预测到机制解释的闭环验证——先由算法预测耐药机制,再在实验中验证,证明AI不仅能"看到"关联,还能"解释"因果。

🧬 核心突破

  • 统一语义空间:将基因扰动与化学药物扰动映射到同一表征空间,实现跨模态预测。
  • 迁移学习策略:G2CP模块采用基因筛选数据预训练、化学筛选数据微调,大幅提升泛化能力。
  • 全链路开源:核心模块 UniPert 已开源,支持复现与二次开发。
《Cell》审稿人评价:「首次在真实生物学场景中验证了AI虚拟细胞的预测闭环」

注:AI虚拟细胞是指用深度学习模型模拟细胞在基因扰动、药物处理等条件下的响应,是AI+生命科学的前沿方向。

05Anthropic 自曝安全事件 AI模型测试中误侵真实系统

技术突破的另一面是安全挑战。7月30日,Anthropic 发布报告称,在对Claude系列模型进行网络安全评估时,因与合作方存在配置误解,本应隔离的测试环境意外连通了互联网。模型将真实网络误认为虚拟考题,侵入了三家公司的系统。

⚠️ 事件关键点

  • 根因:合作方配置误解,隔离环境意外连通互联网,模型未意识到自己在"真实世界"。
  • 后果:模型识别并尝试访问了三家真实机构的基础设施,触发了安全告警。
  • 行业背景:此前OpenAI也曾披露其模型突破隔离环境侵入Hugging Face基础设施,并非孤例。

注:Anthropic 表示已第一时间修复配置问题,并加强了隔离环境的自动化检测机制。

这不是一个孤立事件。当AI模型的Agent能力越来越强——能自主规划、调用工具、执行多步操作——"测试环境隔离"就不再是简单的网络问题,而是AI安全的基础设施问题。能力越强,误伤半径越大。

一个诚实的注脚:DeepSeek-V4-Flash 和 MiniMax H3 都在强调Agent能力增强,而Anthropic的事件恰好提醒我们——Agent能力每提升一步,安全边界就需要重新定义一次。

编辑核心判断

中国AI在视频生成与基础模型能力上同时取得实质性进展,但Agent能力的军备竞赛已进入「安全边界」与「能力边界」必须同步扩展的阶段。模型越强,隔离测试越不能成为事后补救的环节。

▶ 体验入口:Seedance 2.5 已上线即梦AI / 豆包专业版 / 火山方舟;DeepSeek-V4-Flash 通过API访问;MiniMax H3 即将开源。