神秘模型「Kivine」引爆 LMArena:百万上下文能力震惊社区,被疑为 Kimi K3 提前亮相
7 月 15 日,一款名为 Kivine 的匿名模型突然出现在 LMArena 竞技场,上线数小时内即引发全球 AI 社区关注。用户测试显示其具备 百万 token 上下文 与接近顶级模型的生成质量,大量线索指向月之暗面尚未发布的下一代旗舰——Kimi K3。
7 月 15 日,一款名为 Kivine 的匿名模型突然出现在 LMArena 竞技场,上线数小时内即引发全球 AI 社区关注。用户测试显示其具备 百万 token 上下文 与接近顶级模型的生成质量,大量线索指向月之暗面尚未发布的下一代旗舰——Kimi K3。
7 月 15 日凌晨,X 用户 @lentils80 在浏览 LMArena 时发现一个从未出现过的新模型,名称是 Kivine。他随后发布了一条推文:"Kimi K3 is already on LMArena under the stealth name Kivine." 这句话在 AI 圈迅速传播。
但真正让社区确信的,不是名字,而是能力。
Kivine 在 LMArena 中展现出的长上下文优势,与 Kimi 系列一贯的技术路线高度吻合。多名测试用户确认,它拥有 1M context,在长程任务中表现明显优于同期匿名模型。
更关键的是生成质量。用户 @synthwavedd 测试后表示,Kivine 的输出已接近 "Fable level"——社区普遍认为 Fable 对应 Anthropic 旗下顶级模型水平。这意味着,Kivine 不是普通的聊天模型,而是面向复杂任务执行的强推理系统。
据社区流传的测试结果,Kivine 在部分任务中超过 Claude Opus 4.7、GPT-5.5 以及 GPT-5.6 Terra,展现出与全球第一梯队正面竞争的实力。
但与 GPT-5.6 Sol 和 Fable 5 相比,Kivine 仍存在可感知的差距。这一定位也暗示了 Kimi K3 的「次旗舰」策略——并非盲目追求参数第一,而是在关键维度实现突破。
月之暗面至今未公开确认 Kivine 与 Kimi K3 的关系,也未发布任何技术资料。但从已曝光的信息来看,一条完整的证据链正在形成。
社区测试中,Kivine 展现出的能力远超简单问答,而是指向需要连续规划和创造性工作的复杂任务。
技术规格传闻:这些数字如果属实,K3 将重新定义国产模型天花板。
注:以上技术规格均来自社区传闻,未经月之暗面官方确认。其中 1M 上下文为用户实测验证,可信度较高。
答案不复杂:月之暗面从第一天起就在做「长文本」这件事。Kimi 最早被用户熟知,就是因为长文本阅读领域的差异化优势。当其他聊天模型仍受限于上下文窗口时,Kimi 用更长的输入能力建立了认知壁垒。
随后推出的 K2 系列,将能力从「阅读」延伸到「推理」。
如果 Kimi K3 真正具备百万 token 上下文与接近 Fable 级别的生成质量,那么它实际上是在延续一条非常清晰的路线:让 AI 从回答问题,变成能够长期参与复杂工作的智能系统。
从产品体系来看,月之暗面的布局也呈现出清晰的层次:
注:产品线信息来自社区抓包与后台曝光,非官方发布。柱形宽度示意相对能力侧重,非精确量化。
一个模型负责快速交流,一个模型负责复杂推理,再通过 Agent 系统执行具体任务——这很可能成为下一代 AI 产品的标准形态。月之暗面正在用这套组合拳,回答一个行业级问题:超级模型如何变成日常工具?
Kimi K3 如果属实,它代表的不是参数规模的简单跃升,而是国产模型从「追赶」到「并跑」的转折点。但一个需要 35 分钟才能完成任务的超级模型,能否变成普通用户每天都愿意使用的 AI 助手——这才是决定它商业价值的真正考验。