返回

谷歌重构搜索框,AI模型竞逐新战场

谷歌重构搜索框,AI模型竞逐新战场

过去一周,科技行业迎来多项重磅更新:谷歌首次在25年内重新设计搜索框,OpenAI发布GPT-5.6开发者指南,Google AI推出Gemini 3.7 Flash,微软公布MindTopo空间推理基准,而Flock则因监控争议收紧警察技术规则。从搜索体验到模型定价,AI竞争正进入更细颗粒度的新阶段。


谷歌搜索框25年来首次改版:AI优先的界面革命

谷歌于2026年5月19日宣布,其搜索框迎来25年来的首次重新设计。这不仅仅是视觉层面的变化,更标志着搜索产品从“链接列表”向“AI应答”的根本性转型。据VentureBeat报道,此次改版的核心在于将AI生成摘要直接嵌入搜索主界面,用户无需跳转即可获得结构化答案。

原文链接:Google just redesigned the search box for the first time in 25 years

要点:

  • 搜索框首次集成多模态输入(文字、语音、图像)
  • AI概览(AI Overviews)成为默认显示模块
  • 传统蓝色链接排名下沉,对话式结果优先展示
  • 广告位与AI答案的边界重新划定

这次改版的意义远超界面本身——它意味着谷歌承认传统搜索模式已无法满足用户对“直接答案”的需求,AI不是附加功能,而是搜索的默认形态。


OpenAI发布GPT-5.6构建者指南:从模型到产品的工程化路径

OpenAI于8月13日发布《The builder's guide to GPT-5.6》,面向开发者提供从原型到生产的完整指南。该文档涵盖了GPT-5.6的上下文窗口管理、工具调用优化、流式输出策略以及成本控制等关键议题。

原文链接:The builder’s guide to GPT‑5.6

要点:

  • 强调“上下文工程”取代传统提示工程
  • 推荐使用结构化输出(Structured Outputs)保证JSON格式稳定
  • 提供多Agent协作模式的设计模式参考
  • 明确token预算分配的最佳实践

这份指南的发布时机耐人寻味——在谷歌推出Gemini 3.7 Flash后仅数小时,OpenAI便放出面向开发者的深度文档,竞争意味明显。


Gemini 3.7 Flash发布:低价高能的编码与Agent模型

Google AI于8月13日推出Gemini 3.7 Flash,定位为编码与Agent任务优化的轻量级模型。其定价极具侵略性:输入仅$0.75/百万token,输出$3.00/百万token,远低于同级竞品。

原文链接:Google AI Just Released Gemini 3.7 Flash

要点:

  • 专为代码生成、代码审查、Agent循环优化
  • 支持128K上下文窗口,可处理中型代码库
  • 在HumanEval和SWE-bench上表现优于同尺寸模型
  • 原生支持函数调用与并行工具执行
指标 Gemini 3.7 Flash 同类竞品参考
输入价格(/1M tokens) $0.75 $1.00-$3.00
输出价格(/1M tokens) $3.00 $5.00-$15.00
上下文窗口 128K 32K-200K
核心场景 编码、Agent 通用对话

这一价格策略直接瞄准中小开发团队和AI Agent创业公司,意图在开发者生态中抢占心智。


MindTopo基准发布:揭示视觉语言模型的空间推理短板

微软研究院发布MindTopo,一个专门测试视觉语言模型(VLM)空间推理能力的基准。初步结果显示,当前主流VLM在拓扑关系理解、空间路径规划等任务上表现远低于人类水平。

原文链接:MindTopo reveals VLMs’ spatial reasoning abilities

要点:

  • 覆盖拓扑、方向、距离、路径四类空间任务
  • 测试发现VLM在“遮挡推理”和“相对位置判断”上错误率超40%
  • 多模态模型的空间能力与语言能力存在显著脱节