谷歌重构搜索框,AI模型竞逐新战场
过去一周,科技行业迎来多项重磅更新:谷歌首次在25年内重新设计搜索框,OpenAI发布GPT-5.6开发者指南,Google AI推出Gemini 3.7 Flash,微软公布MindTopo空间推理基准,而Flock则因监控争议收紧警察技术规则。从搜索体验到模型定价,AI竞争正进入更细颗粒度的新阶段。
谷歌搜索框25年来首次改版:AI优先的界面革命
谷歌于2026年5月19日宣布,其搜索框迎来25年来的首次重新设计。这不仅仅是视觉层面的变化,更标志着搜索产品从“链接列表”向“AI应答”的根本性转型。据VentureBeat报道,此次改版的核心在于将AI生成摘要直接嵌入搜索主界面,用户无需跳转即可获得结构化答案。
原文链接:Google just redesigned the search box for the first time in 25 years
要点:
- 搜索框首次集成多模态输入(文字、语音、图像)
- AI概览(AI Overviews)成为默认显示模块
- 传统蓝色链接排名下沉,对话式结果优先展示
- 广告位与AI答案的边界重新划定
这次改版的意义远超界面本身——它意味着谷歌承认传统搜索模式已无法满足用户对“直接答案”的需求,AI不是附加功能,而是搜索的默认形态。
OpenAI发布GPT-5.6构建者指南:从模型到产品的工程化路径
OpenAI于8月13日发布《The builder's guide to GPT-5.6》,面向开发者提供从原型到生产的完整指南。该文档涵盖了GPT-5.6的上下文窗口管理、工具调用优化、流式输出策略以及成本控制等关键议题。
要点:
- 强调“上下文工程”取代传统提示工程
- 推荐使用结构化输出(Structured Outputs)保证JSON格式稳定
- 提供多Agent协作模式的设计模式参考
- 明确token预算分配的最佳实践
这份指南的发布时机耐人寻味——在谷歌推出Gemini 3.7 Flash后仅数小时,OpenAI便放出面向开发者的深度文档,竞争意味明显。
Gemini 3.7 Flash发布:低价高能的编码与Agent模型
Google AI于8月13日推出Gemini 3.7 Flash,定位为编码与Agent任务优化的轻量级模型。其定价极具侵略性:输入仅$0.75/百万token,输出$3.00/百万token,远低于同级竞品。
要点:
- 专为代码生成、代码审查、Agent循环优化
- 支持128K上下文窗口,可处理中型代码库
- 在HumanEval和SWE-bench上表现优于同尺寸模型
- 原生支持函数调用与并行工具执行
| 指标 | Gemini 3.7 Flash | 同类竞品参考 |
|---|---|---|
| 输入价格(/1M tokens) | $0.75 | $1.00-$3.00 |
| 输出价格(/1M tokens) | $3.00 | $5.00-$15.00 |
| 上下文窗口 | 128K | 32K-200K |
| 核心场景 | 编码、Agent | 通用对话 |
这一价格策略直接瞄准中小开发团队和AI Agent创业公司,意图在开发者生态中抢占心智。
MindTopo基准发布:揭示视觉语言模型的空间推理短板
微软研究院发布MindTopo,一个专门测试视觉语言模型(VLM)空间推理能力的基准。初步结果显示,当前主流VLM在拓扑关系理解、空间路径规划等任务上表现远低于人类水平。
要点:
- 覆盖拓扑、方向、距离、路径四类空间任务
- 测试发现VLM在“遮挡推理”和“相对位置判断”上错误率超40%
- 多模态模型的空间能力与语言能力存在显著脱节




