Google Research 将 Heat Resilience 数据扩展至全球 50+ 城市
Google Research 将建筑级屋顶反射率数据扩展至全球 9 个国家的 50+ 城市,支持城市规划者制定凉爽屋顶改造方案。数据通过新上线的 Heat Resilience Earth Engine App 公开提供,可交互查看并下载高分辨率数据,用于本地分析与政策制定。
Google Research 将建筑级屋顶反射率数据扩展至全球 9 个国家的 50+ 城市,支持城市规划者制定凉爽屋顶改造方案。数据通过新上线的 Heat Resilience Earth Engine App 公开提供,可交互查看并下载高分辨率数据,用于本地分析与政策制定。
Google DeepMind 发布 Nano Banana 2 Lite,并向开发者开放 Gemini Omni Flash,分别用于快速图像生成和视频生成、对话式编辑。
推荐理由:文中明确区分图像模型的速度、成本与质量定位,并列出视频模型的输入处理限制,为多媒体工作流选型提供具体依据。
Dharma AI 从优化理论、生物演化与市场竞争出发,论证专业化为何是高效 AI 系统的重要方向。无免费午餐定理指出,没有通用优化算法能在所有可能问题上胜过其他算法。在算力、数据与开发时间有限的条件下,聚焦目标任务比无限扩展任务范围更有利于取得高性能。
Google Research 发布表格基础模型 TabFM,通过上下文学习对未见过的表格进行分类与回归,无需针对新任务训练模型或调参。模型完全使用数亿个合成数据集训练,结合行列交替注意力、行压缩与 Transformer 架构,标准配置通过单次前向传播生成预测,另提供加入交叉特征、SVD 特征的 32 路集成配置 TabFM-Ensemble。
推荐理由:把表格预测改为上下文学习,为减少逐数据集训练和调参提供了不同路径,文中还区分了直接预测与加入特征工程的集成配置。
Every Eval Ever(EEE)与 Hugging Face Community Evals 现已互通,评测结果可展示在模型页面并汇入基准排行榜。转换工具可将 EEE 记录转为所需的 YAML 文件,来源徽章链接至完整评测记录,便于查阅生成配置、评测框架版本和复现说明。
DiScoFormer 可通过单次前向传播估计数据分布的密度与得分,切换分布无需重新训练。在 100 维测试中,相比手动调优的最佳 KDE,得分误差降低约 6.5x,密度误差降低超过 37x。模型还可利用无需标签的一致性损失,在推理时适应分布外输入。
Google Research 为冻结权重的 Gemini Nano v3 加装多 token 预测(MTP)头,相关加速方案已部署至 Pixel 9 和 10 系列。
Google Research 的线性弹性缓存在 Spanner 生产环境中将内存使用量降低15.5%,总拥有成本降低约5%。该方法将缓存页面淘汰建模为滑雪租赁问题,用轻量级决策树预测页面存活时间,动态调整缓存大小。缓存未命中增加5.5%,但集中于读取成本较低的数据,实际 I/O 成本仅增加0.5%。
Google Research 的研究发现,链式推理可帮助大语言模型召回关闭推理时难以获取的简单事实,作用机制包括计算缓冲与事实启动。
推荐理由:研究将事实召回收益拆解为额外计算与相关事实启动两种机制,为理解简单问答为何也能受益于链式推理提供了实验依据。
Google DeepMind 将计算机操作作为内置工具集成至 Gemini 3.5 Flash,支持开发者构建跨浏览器、移动端和桌面环境的智能体。
推荐理由:从独立模型转为主模型内置工具,计算机操作可与既有工具调用能力结合,为跨环境自动化提供更集中的开发入口。
Mistral AI 为 Connectors 新增权限管控、多账户连接和故障诊断能力,提升企业平台连接的安全性。管理员可按组织、工作区及单个工具配置权限,带连接器权限范围的 API 密钥与多账户连接已正式可用。Connectors Debugger 和 Workflows 集成进入公开预览,Vibe Code 集成已正式可用。
Mistral 发布文档理解模型 Mistral OCR 4,在提取文本的同时返回边界框、块类型及逐页、逐词置信度,支持 10 个语言组的 170 种语言。官方报告其在人类盲评中的平均胜率为 72%,OlmOCRBench 得分为 85.20,同时说明自动基准存在标注与格式匹配局限,竞品分数来自内部复现。
推荐理由:边界框、块类型和置信度让文档提取结果能同时用于定位引用与安排人工核验,为检索和智能体流程提供更明确的输入结构。
Google DeepMind 正与英国政府等合作,开发基于 Gemini 的规划审批原型,目标将房主规划申请的决策时间缩短 50%。工具可整合资料、核对政策并提供引用、汇总咨询反馈及起草评估报告,由规划官员逐行审核并保留最终决定权,同时记录各步骤供审计。原型在 Barnet、Camden 和 Dorset 开展早期试验后,政府计划从 2027 年起向全国地方议会提供。
Google 发布基于 Earth AI 的矢量化数据集,将英格兰树篱、石墙和小树林的像素地图转化为可用于自然修复规划的生态清单。团队微调 RSF 视觉模型,并结合双层标注、跨网格几何合并与形状分类,识别标准卫星检测容易遗漏的细小生态特征,为土地管理者提供测量和扩展这些特征的数据支持。
Google DeepMind 介绍 AI Control Roadmap,为 Google 内部部署的 AI 智能体建立模型对齐之外的系统级纵深防护。框架基于 MITRE ATT&CK 进行威胁建模,以覆盖率、召回率和响应时间衡量监控效果,并按模型逃避检测与执行攻击的能力配置检测及预防响应级别。
推荐理由:将智能体视作潜在内部威胁,并按逃避检测与执行攻击的能力分级配置防护,为不完全依赖模型对齐的系统安全提供参考。
Google Research 分享的研究发现,AI 辅助能提高用户识别皮肤问题的准确率,但未显著改善标准 AI 组选择后续医疗步骤的准确率。本周发表于 JAMA Dermatology 的研究纳入 2,345 名参与者,AI 组病症名称猜测准确率为 23%,对照组为 8%;AI 组建议的处理紧迫程度低于皮肤科医生判断的比例为 30%,对照组为 27%。
推荐理由:研究区分了识别皮肤问题与选择就医步骤两种能力,为理解医疗信息工具的准确率提升为何不等于决策改善提供了具体对照。
Google Research 提出 Regularized f-Divergence Kernel Tests 框架,通过相对距离检验判断遗忘后的模型更接近安全重训模型还是原始受污染模型。该框架自动选择散度与超参数;理论证明其可在任意样本量下控制误报,漏报风险随样本增加趋于零。
Google DeepMind 发布实验性开放模型 DiffusionGemma,以 Apache 2.0 许可提供权重,在专用 GPU 上实现最高 4x 的文本生成速度。
推荐理由:本地低并发与高并发云端的收益差异交代清楚,能帮助开发者结合输出质量取舍判断文本扩散是否适合自己的工作负载。
Google DeepMind 联合多家机构,面向全球研究者发起最高 $10M 的多智能体 AI 安全研究资助征集。资助聚焦沙盒与测试平台、智能体网络科学、智能体基础设施强化、监督与控制,旨在理解并缓解大规模智能体交互产生的群体风险。申请截止日期为 8 月 8 日。
Google 发布音频模型 Gemini 3.5 Live Translate,支持自动识别 70+ 种语言并进行近实时语音到语音翻译。模型持续生成译音,保留说话者的语调、节奏和音高,官方称整个会话中仅落后说话者几秒,所有生成音频均带有 SynthID 水印。
推荐理由:相较于等待说话结束再翻译的系统,连续生成译音的方式把上下文质量与跟随延迟的取舍带入实时跨语言沟通。
Google DeepMind 发布 Gemma 4 12B,采用统一的无编码器架构,将视觉与音频输入直接接入 LLM 主干,面向笔记本本地多模态智能体应用。官方称其标准基准表现接近 26B MoE 模型,总内存占用不到后者一半,可在配备 16GB 显存或统一内存的设备上运行,并配备 Multi-Token Prediction(MTP)草稿模型以降低延迟。
推荐理由:无独立编码器的音视频处理路径与本地内存要求,为评估多模态智能体从大模型迁移到笔记本的资源取舍提供了具体参照。
Google DeepMind 机器人加速器选出欧洲 15 家初创企业,提供为期 3 个月的密集辅导与技术支持,帮助其将 AI 融入核心产品。入选企业可使用 Google 的 AI 技术栈、专业技术资源及 Gemini 机器人模型,应用领域涵盖物流、制造、医疗、气候及先进导航。
Google DeepMind 在塞拉利昂的预注册试验显示,使用 Gemini Guided Learning 的学生在八周内数学成绩较对照组提升了 +0.258 个标准差。
推荐理由:教师主导的课堂试验为引导式 AI 教学提供了量化依据,但数学基础更强的学生获益更多也提示了缩小学业差距的挑战。
Google 在 Gemini Enterprise Agent Platform 提供由 Agentic RAG 驱动的跨语料库检索功能,现已开放公开预览。该框架通过 Sufficient Context Agent 检查检索片段与回答草稿,识别信息缺口并反馈给查询改写环节,推动后续检索。
Google Research 在 Nature 发表 PHRM 研究,利用面部解锁后的 8 秒前置摄像头视频,通过深度学习估算心率并汇总每日静息心率。在真实生活验证中,经置信度筛选后的心率平均绝对百分比误差为 6.09%,每日静息心率相对 Fitbit Charge 6 的平均绝对误差为 4.39 bpm,但较深肤色组的心率测量成功率较低。
推荐理由:研究将真实生活场景中的误差与不同肤色的测量成功率分开呈现,为评估手机健康监测的准确性与覆盖差异提供了参考。
Google Research 在 GitHub 以 Apache 2.0 许可开源水文建模框架,让研究人员和预报机构使用驱动 Flood Hub 的模型架构训练洪水预报模型。
推荐理由:框架允许气象水文机构保留数据控制权并融入本地资料,已有业务平台的适配案例为接入现有洪水预警流程提供了参考。
Google Research 汇总 I/O 2026 展示的研究与应用进展,涵盖科学发现、健康、端侧 AI、灾害预测及智能体开发等领域。Gemini for Science 将 ERA、Co-Scientist 等研究用于计算实验、假设生成和文献整理,正逐步开放访问,可通过 labs.google/science 登记兴趣。
推荐理由:从科研假设生成到长时程软件工程,材料展示了多智能体研究进入具体工具的路径,有助于理解研究成果与产品工作流的连接。
Mistral 在 AI Now Summit 2026 推出工业工程 AI 栈,并更新 Vibe 智能体、公布 Les Ulis 推理数据中心计划。工业方案融合物理模型、工程知识与机器人技术,与 Airbus、BMW Group 和 ASML 的合作覆盖设计、碰撞仿真及零部件优化;Vibe 支持长时间多步骤任务,包括深度研究、日常流程编排,以及从需求到合并变更的编码工作。
Mistral 将 Le Chat 升级为 Vibe,以同一智能体和许可覆盖办公与编码,迁移原有对话、设置和订阅。Work Mode 支持跨企业工具的多步任务、定时执行和可复用技能;Code Mode 支持在隔离沙箱中并行运行远程编码会话并提交拉取请求,同时新增 VS Code 扩展,CLI 可通过 /teleport 在终端与云端间迁移会话并保留历史和审批记录。
推荐理由:办公与编码被纳入同一智能体和许可体系,结合可编辑计划、会话权限及终端与云端迁移,为跨工具任务的人工管控提供了具体参考。
Mistral AI 今天发布 Search Toolkit 公共预览版,以统一接口整合 AI 应用搜索管线的数据摄取、检索与评估,开源并支持云端、本地和边缘部署。框架支持文档解析、分块、嵌入向量生成,以及 BM25、稠密向量和混合检索,内置召回率、精确率、MRR 和 NDCG 指标,可独立衡量检索器表现。入门应用模板提供预配置的 Vespa 索引、混合检索和示例数据摄取管线。
Google 将新密码学聚合协议与可信执行环境结合,用于隐私分析,确保仅获取匿名化的群体聚合结果。设备只需发送一次消息,无须为多轮交互持续在线,个人原始数据不会在任何服务器内存中暴露或重建。该方案已集成至 Google 的机密联邦分析系统,并通过硬件证明验证协议按预期执行。
Mistral 将 Emmi AI 纳入旗下,正为企业解决方案构建物理 AI 能力,以加速工业工程设计与运行分析。此类模型从物理求解器输出中学习,可在单个 GPU 上以秒级速度预测物理场,传统求解器仍用于验证和边缘情况。其应用方向包括产品设计、工装与工艺优化,以及实时数字孪生。
Mistral 在收购 Emmi AI 后加大基础 Physics AI 研究投入,面向航空航天、汽车、半导体和能源等行业。其 AB-UPT 可在单个 GPU 上处理含 9M 表面单元和 140M 体积单元的原始几何,无需重新划分网格;NeuralDEM 支持流化床反应器等工业过程的实时仿真。
Mistral AI 本周签署收购物理 AI 公司 Emmi AI 的最终协议,旨在增强物理建模能力并推进面向工程师的 AI 智能体。Emmi AI 创立于奥地利,其模型支持实时仿真和数字孪生,可将耗时多日的计算替换为实时仿真。其联合创始人与超过 30 名研究人员及工程师将于 5 月加入 Mistral AI 的 Science 和 Applied AI 团队。
Mistral 发布公开预览版 Mistral Medium 3.5,并将其设为 Vibe 和 Le Chat 的默认模型,支持云端编码智能体与多步骤 Work mode。
推荐理由:本地会话连同任务状态和审批记录迁至云端的设计,为长任务异步执行与保留人工审查之间的衔接提供了具体参考。
Mistral AI 在 Studio 推出公开预览版 Connectors,内置连接器与自定义 MCP 均可通过 API/SDK 用于模型和智能体调用。连接器支持程序化管理和集中注册,可跨 LeChat 与 AI Studio 复用,Vibe 支持即将到来。
Google DeepMind 在亚太推出以“AI for the Planet”为主题的加速器计划,支持运用前沿 AI 应对环境挑战。计划为期3个月,面向初创企业、研究团队和非营利组织,提供专家指导、定制支持及模型集成帮助。项目将以新加坡线下训练营启动,即日起可登记参与意向。
Google 的科研工具 ERA 研究今天发表于 Nature,该工具利用 Gemini 编写和优化科学代码,在多个学科基准上达到专家水平。ERA 根据科学问题与成功指标检索文献、编写代码并评估结果,通过树搜索探索数千种方案;团队现有 8 篇稿件将其用于具体科学问题,包括提前最多 4 周预测美国各州呼吸道疾病住院人数。
推荐理由:以科学问题和成功指标驱动文献检索、代码生成与实验评估的闭环,为将科研代码优化方法迁移到不同学科提供了具体参考。
生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 利用 Co-Scientist 寻找逆转细胞衰老的遗传因素,并加速分析大规模遗传筛选结果。
Google DeepMind 为 Project Genie 新增 Street View 功能,让用户以真实地点影像为起点创建可交互世界。该功能由 Maps Imagery Grounding 支持,目前可选择美国境内地点,并搭配场景风格与角色描述生成环境,未来计划扩展地点覆盖范围。
推荐理由:以街景影像约束生成世界的起始位置,为理解世界模型如何连接真实地点与可交互虚拟环境提供了具体案例。