📷 视觉搜索 · 25 周年

视觉搜索 25 年:从图片检索到 AI 即时生成,图像搜索的进化之路

2000 年,Jennifer Lopez 一件绿色 Versace 礼服让互联网第一次意识到:纯文本链接根本不够用。2001 年 7 月,Google Images 诞生。25 年后,视觉搜索已从"找图"进化到"生图"——AI Overviews 中直接生成定制图像的时代正式开启。

综合公开信息整理 2026-07-14 全文约 4 分钟读完
#Google Images #视觉搜索 #Nano Banana #AI 生图 #多模态搜索
25 年 2001 → 2026 · 视觉搜索演进
10+ 重大功能里程碑
5.8 亿+ Circle to Search 覆盖设备数

⚡ 30 秒速览

  • 两个新功能同日上线:全新可浏览的 Google Images 首页(动态沉浸式画廊)+ AI Overviews 中直接生成图像(Nano Banana 模型)。
  • Nano Banana 模型入场:从零生成高质量定制图像,无缝融入 AI Overviews,文本→图像一步到位。
  • 25 年 10+ 里程碑:从 Similar Images、Search by Image 到 Lens、Multisearch、Circle to Search,再到今天的 AI 生图。
  • 一条清晰的进化逻辑:每一次迭代都在降低"从想法到视觉信息"的摩擦——从文本到图像,从图像到多模态,从检索到生成。

01两个新能力 可浏览的首页 + AI 即时生图

25 周年之际,Google 带来了两个方向截然不同、但目标一致的更新:一个让发现图片更沉浸,一个让创造图片更简单。

全新 Google Images 首页

动态、沉浸式画廊,实时更新,智能匹配个人兴趣。浏览时保存灵感至 collections,自动生成标签栏,随时跳回继续探索。桌面端美国英文版率先上线。

AI Overviews 中直接生图

基于 Nano Banana 模型,从零生成定制图像。文本描述 → 高质量视觉输出,无需任何素材。覆盖所有已支持 AI Mode 图像生成的地区,英文版率先推出。

两个功能互补:一个帮你发现已有图像,一个帮你创造尚未存在的图像。覆盖"探索"与"生成"两端。

其中,AI 生图能力的落地更具标志性——它意味着搜索不再只是"找到",而是"创造"。当你脑中有一个极其具体的画面,但网络上不存在任何匹配的图片时,你不再需要妥协。

🎯 场景示例:从"不存在"到"即时生成"

  • 「一把北欧风木质摇椅,扶手有藤编细节,坐垫是深绿色丝绒」——以前你需要翻遍电商网站和家居图库,现在一句描述即可生成。
  • 「一张 1920 年代上海咖啡馆的复刻海报,带 Art Deco 边框,暖色调」——设计师找参考图可能需要数小时,AI 生图在几秒内交付。
  • 「我的猫穿着宇航服站在火星上,背景是蓝色夕阳」——纯娱乐需求,但展示了"从零构建"的自由度。
Nano Banana 模型完全在 AI Overviews 框架内运行,无需跳转工具,输入即输出。

0225 年,10 个关键节点 从"绿裙子"到多模态

这套能力并非凭空出现。它建立在 25 年持续迭代之上——每一次都在解决同一个问题:如何让视觉信息像文字一样可搜索、可交互、可创造。

2001

Google Images 诞生

Jennifer Lopez 的绿色 Versace 礼服引爆搜索需求——人们要"看到"而非"读到"。第一个图像搜索引擎上线。

2009

Similar Images

用图像找图像,不再依赖文字。点击"找相似",视觉搜索开始脱离文本拐杖。

2011

Search by Image

上传图片或粘贴 URL,图像本身成为搜索词。反向溯源、视觉相似内容发现成为可能。

2018

Google Lens 登陆搜索

手机摄像头变成搜索入口。识别物体、翻译文字、实时查询——物理世界可搜索了。

2022

Multisearch

文本 + 图像同时搜索。拍一张照片,加一句描述,多模态理解首次落地。

2024

Circle to Search

圈选即搜索,无需切换应用。覆盖 5.8 亿+ Android 设备,交互成本降到最低。

2025

Lens + AI Mode · Search Live · Visual Results

实时摄像头 + 语音对话;视频输入理解场景;可视化结果展示——多模态进入全交互时代。

2026

AI 生图 + 智能搜索框

Nano Banana 模型实现从零生成;智能搜索框支持多图上传与深度问答。创造与检索合二为一。

时间线选取了 10 个代表性里程碑,完整列表包含更多细分更新。每一次迭代都在扩大"视觉信息"的定义边界。

03进化的底层逻辑 信息摩擦不断降低

回顾这 25 年,可以抽象出一条清晰的线索:从"文本→图像"到"图像→信息"再到"想法→图像"。

2001 年的原始创新,本质是把"图像"变成了可搜索的索引条目。2011 年的 Search by Image 反转了方向——让图像自己"说话"。2018 年的 Lens 把摄像头变成输入设备,物理世界第一次被纳入搜索索引。2022 年的 Multisearch 开始混合文本与图像,2025 年的 AI Mode 引入了推理能力。

2026 年,AI 生图完成了最后一环:从"检索已有"到"创造未有"。

这背后有两个关键支撑:一是多模态模型的理解能力达到临界点,能精准解析"北欧风木质摇椅 + 深绿色丝绒坐垫"这样的复合描述;二是生成模型的质量已足够可靠,Nano Banana 的产出可以融入搜索主流程,而非作为独立玩具存在。

2001文本→图像
2011图像→信息
2022文本+图像
2026想法→图像

四个阶段,每一次跨越都重新定义了"搜索"的边界。2026 年的"想法→图像"可能是迄今为止最根本的一次跃迁。

一个诚实的注脚:AI 生图的质量仍高度依赖提示词的精确度,且对于高度专业化的商业场景(如产品级渲染图),目前仍需要人工打磨。但"从零到一"的摩擦已经消失——这是真正的质变。

编辑核心判断

视觉搜索 25 年的进化,本质上是在不断降低"从想法到视觉信息"的摩擦。2026 年的 AI 生图不是终点,而是一个新起点——当搜索不再只是"找到"而是"创造",整个信息获取的范式正在被重写。真正的分水岭不在于模型能生成多好看的图,而在于"生成"已经被嵌入搜索的主流程,成为默认选项而非额外功能。

现在就能用

全新 Google Images 首页将在未来几周内向桌面端美国英文用户开放;AI Overviews 图像生成能力同步在已支持 AI Mode 的地区上线。登录 Google 账号即可体验。

images.google.com → 探索新首页

注:功能逐步开放,具体可用性因地区与语言而异。