🔥 AI 周报 · 商业与资本

字节拟建 5 万亿参数模型,张一鸣反对蒸馏;宇树打新或造 90 后千万富豪

本周 AI 圈暗流涌动:字节跳动讨论训练超 5 万亿参数大模型,创始人张一鸣明确表态「反对蒸馏」;宇树科技正式申购,发行市值约 610 亿元,超百名员工参与战略配售;DeepSeek 拟大幅上调 API 定价,同时重启500 亿元第二轮融资。

综合公开信息整理 2025-08-10 全文约 5 分钟读完
#字节跳动 #宇树科技 #DeepSeek #人形机器人 #大模型
5万亿 字节拟训练模型参数规模 · 国内已知最大
610亿 宇树科技发行市值 · 高于此前预估 400 亿
500亿 DeepSeek 第二轮融资计划 · 8 月下旬签约

⚡ 30 秒速览

  • 字节造超大模型:Seed 团队拟训练超 5 万亿参数模型,项亮与沈科主导;张一鸣全员会明确「反对蒸馏」,认为只能逼近 Claude 无法超越。
  • 宇树打新盛宴:发行价 150.80 元/股,王兴兴身家约 203.5 亿元,超百名员工参与资管计划,90 后核心技术人员或成千万富豪。
  • DeepSeek 双线操作:拟大幅上调 API 定价,同时重启 500 亿元 B 轮融资,投前估值约 5000 亿元。
  • DeepMind 独立终结:Hassabis 或一年内离职,CEO 岗位取消,管辖权收归谷歌总部;Jeff Dean 创办 Discovery Loop。
  • AI 演员报价超真人:虚拟角色方桃子 60 秒以上视频报价 25.8 万元,已接拍美瞳品牌广告。

01参数军备赛 5 万亿意味着什么

字节跳动正在讨论训练一个参数规模超 5 万亿的模型。若最终落地,它将超过阿里 Qwen3.8-Max(2.4 万亿)和月之暗面 K3(2.8 万亿),成为国内已知参数规模最大的模型。该计划由 Seed Foundation 负责人项亮与预训练数据负责人沈科主导,目前仍处于早期阶段。

字节新模型(拟)Seed Foundation
5.0万亿
K3月之暗面
2.8万亿
Qwen3.8-Max阿里
2.4万亿

注:柱形按参数规模等比缩放,非零起点仅为视觉参照;字节新模型仍处讨论阶段,最终不一定发布。

接近 Seed 人士透露,团队逻辑很直接:与其在现有尺寸上追赶,不如把参数一次推到同行数倍,争取领先位置。但真正值得注意的,是张一鸣在全员会上的罕见发声。

他给团队浇了一盆冷水,也指了一条路。

张一鸣反对的:蒸馏

短期内能改善模型表现,但本质是复制 Claude 已有能力,最多不断逼近对方,很难真正超越。

张一鸣支持的:追智能上限

可接受一段时间落后于行业,以编程为关键方向,目标跻身世界第一梯队,不追求短期对齐。

这是一次少见的公开立场表态:在「蒸馏捷径」已成行业潜规则的大环境下,字节创始人选择了一条更慢但更自主的路。

02宇树打新盛宴 90 后千万富豪或将批量诞生

8 月 10 日,「人形机器人第一股」宇树科技正式开启申购。发行价 150.80 元/股,发行后总股本 4.045 亿股,上市市值约 609.99 亿元,高于此前市场预估的 400 亿元。发行市盈率高达 219.23 倍,远超所属行业静态市盈率 38.56 倍。

150.80发行价(元/股)
610上市市值(亿元)
219.23发行市盈率(倍)
20%战略配售比例

注:行业静态市盈率为 38.56 倍,宇树发行市盈率约为行业均值的 5.7 倍,反映市场对人形机器人赛道的高溢价预期。

创始人王兴兴直接与间接合计持股 33.36%,对应身家约 203.5 亿元。但更值得关注的是股权激励平台上海宇翼——持有公司 10.94% 股份,核心技术人员杨知雨、张阳光间接持股比例分别为 0.49% 和 0.15%。

按当前发行市值,他们的财富有望跃升至千万元级别。他们都是 90 后。

此外,159 名高管与核心员工参与员工资管计划,认购金额百万元起;DeepSeek、腾讯旗下启善投资等入围战略配售。王兴兴透露,宇树与 DeepSeek 将在通用人工智能、通用机器人、AI 大模型三方面开展重点合作,2025 年度人形机器人出货量已超 5,500 台

03DeepSeek 双线操作 涨价与融资同步推进

DeepSeek 计划近期整体上调 API 服务定价,预计涨幅较大。目前采用峰谷定价:工作日高峰时段全部价格直接翻倍,凌晨及周末执行平峰原价。公司建议用户合理安排使用,具体方案以正式通知为准。

几乎同步,多名交易人士透露 DeepSeek 已重启第二轮融资,计划募资 500 亿元,投前估值约 5000 亿元,拟 8 月下旬完成签约。今年 4 月其首轮融资 500 亿元、估值超 3500 亿元,为中国 AI 大模型史上首轮融资规模最大。

💰 估值跃升轨迹半年翻 1.4 倍

  • 2025 年 6 月:首轮融资完成交割,金额 500 亿元,估值超 3500 亿元
  • 2025 年 7 月中旬:第二轮融资开启,月底突然暂停,部分候补投资人被告知签约暂缓。
  • 2025 年 8 月:融资重启,投前估值约 5000 亿元,拟 8 月下旬完成签约。
一个细节:创始人梁文锋早年微博账号被网友扒出,2011 年一条「被困无人区一周、菲亚特永远留在了高山草原」的旧帖,如今评论区已成打卡圣地。

04DeepMind 独立时代落幕 两大核心人物相继离职

在 Jeff Dean 确定离职创业之际,Demis Hassabis 同步递交离职意向。谷歌管理层评估认为两大核心同步离职将引发资本市场剧烈震荡——仅官宣半份人事消息后,股价已下跌 5%。为避免雪崩,谷歌紧急授予 Hassabis DeepMind 董事长 + Alphabet 首席科学家双重头衔,暂缓离职。

但缓冲期最长不超过一年,Hassabis 终将体面离开。

H

Demis Hassabis DeepMind 联合创始人

临时获授董事长 + 首席科学家双头衔,预计一年内离职。8 月 5 日架构调整后,DeepMind 不再设置独立 CEO 岗位,管辖权全面收归谷歌总部。

J

Jeff Dean 效力谷歌 27 年

被誉为「程序员中的程序员」,将与长期合作伙伴共同创立 Discovery Loop,聚焦机器学习、科学与工程前沿的公益性公司。Google 将作为创始投资方和云计算合作伙伴继续合作。

注:原 DeepMind CTO Koray Kavukcuoglu 晋升高级副总裁,全盘接管实验室日常运营与 Gemini 模型研发,直接向 Alphabet CEO 皮查伊汇报。

05本周行业速览 产品 · 组织 · 司法 · 商业

🤖 AI 虚拟演员报价超真人

AI 短剧女主角方桃子抖音粉丝 41.2 万,60 秒以上视频报价 25.8 万元,已超大批真人百万粉网红,正式接拍美瞳品牌广告。

🍎 苹果删除千问接入手册

苹果中国官网删除《在 Mac 上配合 Apple 智能使用千问》支持文档,原链接已无法访问。此前该文档明确 Apple 智能可配合阿里千问模型工作。

🤖 智元发年中奖,离职员工也有份

因上半年业绩超额达成,向全体正式员工发放 1 个月固定月薪年中特别绩效奖,离职员工按在职天数折算。公司约 1500 人。

🏭 大众裁数百管理层,猎头拒接

大众汽车裁减数百个管理职位,曾联系猎头为 400-500 名经理人找下家,对方回复「没这么多岗位」。保时捷同步裁员 5000 人。

⚖️ 北京首例破坏 AI 模型刑案

90 后算法工程师王某输入「删库」指令删除公司文生 3D 模型及训练数据,被判有期徒刑 五年十个月,赔偿 20.4 万余元。

📱 上班看手机被开除,法院判赔 11 万

南京技术工程师因离座 9 分钟、看手机等被开除,法院认定违法解除,判决公司赔偿 11.19 万元。法官强调「人不是机器」。

🤝 Anthropic 首任全球事务官

任命前加州最高法院法官、卡内基国际和平基金会主席库埃拉尔为首任全球事务主管,直接向总裁丹妮拉·阿莫迪汇报。

🍎 苹果申请禁令阻止 OpenAI 用机密

苹果向法院申请初步禁令,要求禁止两名前员工及 OpenAI 获取涉嫌属于苹果的机密信息。OpenAI 回应称「既没有也不希望拥有」苹果机密。

06本周模型与产品 重磅发布一览

📦 阿里 Qwen3.8 + Wan3.0基座 + 视频

  • Qwen3.8:总参数量 2.4 万亿,编程与专业办公能力大幅提升,三方榜单 Arena 中仅次于 Anthropic Claude 系列。Qwen3.8-Max 预计下周开源,同时开源 Qwen3.8-27B。
  • Wan3.0:单次可生成 30 秒视频,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称「万物皆可生视频」。
已接入阿里同步推出的 Agent 产品「千问办公」,API 上线千问 AI 平台。

📦 字节 SeedRealtime + MiniMax H3音视频 + 全模态

  • SeedRealtime:原生音视频全双工大模型,已在豆包 App 全量上线,支持「边看、边听、边说」实时交互,采用统一端到端架构。
  • MiniMax H3:开源全模态生成系统,视频编辑能力 Artificial Analysis 榜单全球第一,可生成 2K 分辨率、15 秒、原生立体声音频视频。16 家芯片厂商与开源社区 Day 0 适配

📦 腾讯 Hy ASR 3.0 + 面壁 ForgeStencil语音 + 优化

  • 腾讯混元 Hy ASR 3.0 preview:融合高精度语音识别与深度语义理解,在上下文感知、多场景鲁棒性及方言覆盖等维度全面提升。
  • 面壁智能 ForgeStencil:全球首个 Stencil 优化 AI 系统开源,通用 CAE 求解器加速 3.86 倍,核反应堆中子学计算加速最高 5.78 倍

07编辑核心判断

本周三条主线值得放在一起看:字节要建 5 万亿参数模型、张一鸣反对蒸馏;DeepSeek 一边涨价一边融 500 亿;宇树以 219 倍市盈率上市。

三者看似无关,实则指向同一个趋势:中国 AI 正从「追赶期」进入「押注期」。不再满足于对齐已有模型,而是押注参数规模、押注算力基础设施、押注人形机器人商业化。代价是更高的估值、更高的 API 成本、更高的市盈率。

但一个诚实的注脚:5 万亿参数模型仍处讨论阶段,不一定发布;宇树 219 倍市盈率意味着市场已将未来数年的增长预期打入当前股价;DeepSeek 5000 亿投前估值需要与之匹配的商业闭环来消化。押注期的高光,也意味着容错空间在收窄。

编辑核心判断

当「反对蒸馏」成为创始人的公开立场,当 API 涨价与 500 亿融资同步推进,当 219 倍市盈率仍能吸引打新——中国 AI 正在用资本密度换取技术密度,赌的是一个由自主模型、算力基建与具身智能构成的完整产业闭环。