Seedance 2.5 与 DeepSeek-V4-Flash 同日上线,AI视频生成与模型能力双线突破
7月31日,字节跳动发布新一代视频创作模型 Seedance 2.5,同日 DeepSeek-V4-Flash 正式版上线,Agent能力大幅跃升。中国AI在视频生成与基础模型两个方向同时交出关键进展。
覆盖制造、汽车、机器人
多项基准测试显著提升
登《Cell》主刊·国内首次
7月31日,字节跳动发布新一代视频创作模型 Seedance 2.5,同日 DeepSeek-V4-Flash 正式版上线,Agent能力大幅跃升。中国AI在视频生成与基础模型两个方向同时交出关键进展。
字节跳动正式发布 Seedance 2.5,这是一款面向视频创作的新一代生成模型。它不是实验室里的技术演示——发布当日,即梦AI、豆包专业版、火山方舟三大平台同步上线,API服务即将登陆火山方舟。
首批合作企业覆盖了多个重度视频应用场景:
从制造到汽车,从机器人到智能飞行——这些企业选择在发布第一时间引入Seedance 2.5,说明模型在工业级视频生成上已经具备可用性。不是"能生成视频",而是"能生成可用的视频"。
注:Seedance 2.5 为字节跳动自研视频生成模型,上一代 Seedance 1.0 于2025年发布,2.5版本在连贯性、可控性和生成速度上均有明显提升。
DeepSeek-V4-Flash 正式版上线,可通过API直接访问。相比此前的Preview版本,这次升级的核心不是模型结构的变化——V4-Flash-0731 在架构与尺寸上与Preview版保持一致,真正的差异在于后训练优化。
同一副骨架,但"脑子"更灵光了。
基础能力扎实,但Agent任务执行中偶有"卡壳"——多步推理衔接不够顺畅,工具调用准确性有待提升。
Agent能力大幅增强,多项基准测试显著提升。原生支持Responses API格式,针对Codex深度适配,代码生成与执行更稳定。
一个值得关注的细节:Responses API 原生支持。这意味着开发者可以直接调用结构化的Agent响应,而非原始的文本流——对于构建复杂工作流来说,这是基础设施级别的改进。
注:DeepSeek-V4-Flash 后训练优化聚焦于多步推理、工具调用准确性和代码生成质量,模型结构尺寸与Preview版一致,开发者可无缝迁移。
MiniMax H3 的发布补齐了另一块拼图——全模态生成。它不仅能理解文本、图像、视频、声音混合输入,还能输出原生双声道音视频,最高支持15s 2K分辨率。
"全模态"不是概念堆叠,而是有实际场景的:
MiniMax 表示,计划在未来几天内在符合相关法律法规的前提下开放模型权重。如果兑现,这将是国内少有的开源全模态生成模型——对开发者社区和学术研究意义重大。
注:全模态生成指模型可以同时理解和生成多种媒体形式,原生双声道意味着音频与视频在生成时即对齐,无需后期合成。
腾讯生命科学实验室与中南大学的联合研究成果 UniPert–G2CP 发表于国际学术期刊《Cell》主刊,这是国内首次在该刊发表AI虚拟细胞研究。算法首次将基因扰动与化学药物扰动映射至统一语义空间,解决了"化学扰动×细胞特异性响应"这一长期难题。
用数字说话:
研究在 ESR1 内分泌耐药案例中完成了从预测到机制解释的闭环验证——先由算法预测耐药机制,再在实验中验证,证明AI不仅能"看到"关联,还能"解释"因果。
注:AI虚拟细胞是指用深度学习模型模拟细胞在基因扰动、药物处理等条件下的响应,是AI+生命科学的前沿方向。
技术突破的另一面是安全挑战。7月30日,Anthropic 发布报告称,在对Claude系列模型进行网络安全评估时,因与合作方存在配置误解,本应隔离的测试环境意外连通了互联网。模型将真实网络误认为虚拟考题,侵入了三家公司的系统。
注:Anthropic 表示已第一时间修复配置问题,并加强了隔离环境的自动化检测机制。
这不是一个孤立事件。当AI模型的Agent能力越来越强——能自主规划、调用工具、执行多步操作——"测试环境隔离"就不再是简单的网络问题,而是AI安全的基础设施问题。能力越强,误伤半径越大。
一个诚实的注脚:DeepSeek-V4-Flash 和 MiniMax H3 都在强调Agent能力增强,而Anthropic的事件恰好提醒我们——Agent能力每提升一步,安全边界就需要重新定义一次。
中国AI在视频生成与基础模型能力上同时取得实质性进展,但Agent能力的军备竞赛已进入「安全边界」与「能力边界」必须同步扩展的阶段。模型越强,隔离测试越不能成为事后补救的环节。