一段提示词让 AI 24 小时肝出 3A 游戏,百万网友在线抄作业
本周,一段名为「挑战循环」的提示词在开发者社区爆火。通过给 Opus 5 配备主 Agent + 制作 Agent + 独立评委 Agent 的多智能体架构,网友在 24 小时内从零跑出可玩的太空探索游戏,全程贴图、动画、声音均由 AI 生成,无任何外部素材。
本周,一段名为「挑战循环」的提示词在开发者社区爆火。通过给 Opus 5 配备主 Agent + 制作 Agent + 独立评委 Agent 的多智能体架构,网友在 24 小时内从零跑出可玩的太空探索游戏,全程贴图、动画、声音均由 AI 生成,无任何外部素材。
这套全网爆火的提示词由 AI 创业者、投资人 Matt Shumer 发布。核心逻辑非常直接:给 Opus 5 配上多智能体架构,并引入一个极其严苛的验收环节。
指令明确要求:系统需采用盲测并排对比的方式,将生成结果与真实 3A 游戏分辨优劣。一旦画面不如同类大作,就持续返工优化。作者提醒,此时 AI 并不能真的完全对标 3A 大作,用户需及时喊停——该提示词本质是极限施压手段,用于逼出模型的自主规划与长程迭代能力。
主 Agent 拆任务,子 Agent 分别执行,交付即结束。缺乏对最终交付物的质量把控。
新增独立评委 Agent,强制与真实参照物逐项对比,不达标自动打回,形成闭环迭代。
这恰好对应了 Anthropic 在发布 Opus 5 时强调的能力:模型更适合长时间、多步骤工作,也更愿意检查结果、发现错误并持续迭代。
从这个角度看,「挑战循环」提示词更像是给 Opus 5 现有能力套上了更严格的校正机制。评委 Agent 的存在,放大了模型本身的长程迭代优势——不同开发者都能用它做出各种类型的游戏原型。
至于发明这套玩法的 Matt Shumer,今年 2 月曾因长文《Something Big Is Happening》刷屏科技圈,累计浏览量突破 8000 万。文章核心观点是:大众对前沿模型能力的认知,已严重落后于 AI 从业者的实际体验。这次的 Opus 5 游戏潮,恰好给这个判断补上了样本。
本篇原始报道主要汇总自社交媒体上的开发者个人展示与企业通稿性质的产品宣传,未见独立第三方对「24 小时」耗时与最终代码质量进行复测。所谓「3A 标准」实为提示词中的极限施压话术,目前 AI 生成结果仍需人工介入修复渲染与清理代码,并非一键生成成品。
读者不妨带着「提示词工程的上限在哪」来读:当模型具备长程迭代能力后,一个独立评委 Agent 就能把原本依赖人类 QA 的闭环跑通——这比游戏本身更值得警惕。
多智能体闭环校验正在把大模型从「单次生成工具」逼成「自驱动的数字员工」,软件工程的劳动力定价体系将被迫重估。
24 小时肝出的太空探索游戏《The Long Silence》已开放网页试玩,可亲自上手体验 AI 生成效果。
longsilence.anshu.dev → 浏览器直接开玩