跳到正文

#Google

今日 4 条
8月22日周六
8月21日周五
  1. Google Research46

    ME-POIs 如何利用流动数据加深语言模型对地点的理解

    Google Research 提出 ME-POIs 框架,将匿名聚合的流动模式融入文本地点表示,提升地点属性预测能力。结合先进文本模型后,访问意图预测相对提升最高达 81.9%,价格等级分类提升 75.1%,未见地点的繁忙程度估计准确率提升 24.7%。框架还利用周边地点的访问模式缓解数据稀疏问题。

8月17日周一
  1. Google Research60

    Google Research 探索超越 BMI:用 PhotoScan 手机影像估算心血管代谢风险

    Google Research 介绍研究原型 PhotoScan,从普通手机照片估算体脂率及脂肪分布指标,用于预测胰岛素抵抗风险。该框架以 35,323 名参与者的数据预训练、677 名成人的数据微调,并在 132 人的独立队列中验证。

    推荐理由:研究将手机照片估算的脂肪分布指标与智能手表及临床扫描对照,展示了体脂率之外的信息对胰岛素抵抗风险识别的价值。

8月14日周五
8月12日周三
  1. Google Research71

    Google Research 研究:回忆而非知识编码是大语言模型参数化事实性的瓶颈

    Google Research 研究发现,在 WikiProfile 测试中,前沿大语言模型的事实性瓶颈更多来自已编码知识无法被可靠回忆,而非知识缺失。该基准包含 2,150 条维基百科事实,每条配有 10 项任务;Gemini-3-Pro 和 GPT-5 已编码 95–98% 的事实,却无法直接回忆其中 26–34% 的事实,启用思考后仍有 11–12% 的事实回答失败。

    推荐理由:将事实未被编码与已编码却无法回忆分开诊断,为判断事实性改进应侧重扩充知识还是提升已有知识利用率提供了依据。

  2. Google Research69

    Google Research 推进 AMIE 实时视听问诊研究,模拟评估达到专家级表现

    Google Research 的 AMIE (Video) 在涵盖 100 个场景、300 次模拟问诊的随机研究中,核心临床能力获评与初级保健医生相当。系统基于 Gemini 和 Project Astra,通过对话、规划、感知三个异步智能体并行处理交流、临床推理和视听线索,在引导患者演员进行虚拟体格检查方面的平均评分显著高于医生组及文本版 AMIE。

    推荐理由:研究将视频问诊与文本问诊、医生问诊放在同一模拟框架中比较,帮助区分视听感知带来的收益与真实临床适用性的边界。

8月6日周四
  1. Google DeepMind78

    WeatherNext 气旋预报取得进展,同等精度下可多提前约一天预警

    Google DeepMind 的 WeatherNext 在气旋路径、强度和风场结构预测中达到 SOTA 精度,平均三天预报可达到以往模型两天预报的准确度。发表于 Nature 的研究基于 2023 至 2024 年历史气旋进行评测,模型可在单个 TPU 上用不到一分钟生成一次 15 天预报,今年每个气旋的集合预测已扩展至 1,000 种可能情景。

    推荐理由:以相同预报精度比较提前量,比单看误差更容易理解模型进步的实际意义,也为评估气旋预报工具提供了具体参照。

8月3日周一
7月31日周五
7月30日周四
  1. Google DeepMind75

    Gemini Robotics ER 2 以视频理解、任务编排和多机器人协作增强机器人能力

    Google DeepMind 发布 Gemini Robotics ER 2,通过连续视频理解、任务编排和多机器人协作增强具身推理能力,并由底层 VLA 模型执行动作。

    推荐理由:将连续视频中的进度判断与底层控制接口编排结合,为机器人边执行边纠错、而非每一步停下重新规划提供了具体实现参考。

  2. Google DeepMind61

    Google DeepMind 在 Google Flow Music 推出 Lyria 3.5,改进音乐性、歌词、人声与创作控制

    Google DeepMind 今日开始在 Google Flow Music 推出音乐生成模型 Lyria 3.5,提升音乐性、歌词与人声质量。该模型支持生成更丰富、复杂且自然的旋律结构,改善歌词对提示词的遵循和结构感知,并让人声更逼真、情感表达更细腻、发音更准确。用户还可以更轻松地控制生成作品的节奏与时长。

    推荐理由:此次更新同时涉及歌曲生成质量与节奏、时长控制,为判断音乐生成模型能否更贴合具体创作要求提供了清晰的比较维度。

7月28日周二
  1. Google DeepMind74

    Gemini Robotics 2 为机器人带来全身智能控制与多机器人协作

    Google DeepMind 推出 Gemini Robotics 2 系列模型,支持全身控制、精细操作及多机器人协作。Gemini Robotics ER 2 负责规划持续数分钟、涉及数百次决策的任务;Gemini Robotics On-Device 2 支持本地运行,通常用少于 200 个示例、数小时适配新的双臂机器人形态。

    推荐理由:从上半身桌面操作扩展到全身协调与多机器人协作,这次更新提供了观察机器人如何承接更长任务链的具体样例。

7月23日周四
  1. Google Research69

    Google Research 的 SymptomAI 研究:面向日常症状评估的对话式 AI 智能体

    Google Research 在 13,917 名参与者中随机比较了基于 Gemini Flash 2.0 的五种 SymptomAI 智能体,发现主动追问策略的鉴别诊断准确性显著优于未加提示词、由用户主导的基线。

    推荐理由:研究将主动追问与用户主导的问答进行对照,为症状评估智能体提供了通过补充患者信息改善鉴别诊断的设计思路。

  2. Google Research50

    Google Research 探索让量子计算机从错误中学习

    Google Research 验证了强化学习量子控制框架,让 AI 智能体从量子错误检测中学习,在计算期间持续校准控制参数、抵消漂移。在 Willow 超导处理器上,人为注入漂移后,纠错码的逻辑稳定性提升至 3.5 倍;经专家充分校准后,强化学习微调仍将逻辑错误率进一步降低 20%。

7月22日周三
7月21日周二
7月20日周一
7月17日周五
  1. Google DeepMind65

    Google 推出 Gemini 3.5 Flash Cyber,面向漏洞发现、验证与修复

    Google 推出 Gemini 3.5 Flash Cyber,这款基于 3.5 Flash 微调的轻量网络安全模型专用于快速发现、验证和修复漏洞。在固定调用次数的 V8 测试中,该模型发现 55 个已确认的独特问题,主线 3.5 Flash 和 Claude Opus 4.6 分别发现 47 个和 36 个,其中 10 个问题未被另外两个模型发现。

    推荐理由:轻量模型的低成本让安全智能体能够反复探索更多代码路径,为比较漏洞发现方案提供了单次模型能力之外的架构视角。

7月16日周四
7月13日周一
  1. Google DeepMind42

    ATL Saathi 助力印度下一代创新者成长

    Google DeepMind 启动 ATL Saathi 网页应用试点,为印度首批 100 所试点学校的 ATL 教师提供由 Gemini 驱动的 24/7 规划与培训助手。应用提供 12 个核心模块的学习材料,支持 8 种语言,并利用 Gemini 3.5 Flash 生成符合年级与课程要求的项目创意、组装步骤及安全注意事项。

7月9日周四
7月8日周三
7月3日周五
  1. Google DeepMind50

    Google DeepMind 与 A24 宣布研究合作,Google 同时投资 A24

    Google DeepMind 与 A24 今天宣布建立研究合作关系,将围绕多个项目持续开展研发,帮助艺术家探索新的工作流程与技术。A24 及其电影创作者将参与测试、迭代和开发,为技术融入创作过程提供反馈;具体目标、技术产出与创作里程碑将随合作推进而演变。Google 还对 A24 进行了投资。

7月1日周三
6月30日周二
  1. Google Research69

    Google Research 发布 TabFM,用于表格数据零样本分类与回归

    Google Research 发布表格基础模型 TabFM,通过上下文学习对未见过的表格进行分类与回归,无需针对新任务训练模型或调参。模型完全使用数亿个合成数据集训练,结合行列交替注意力、行压缩与 Transformer 架构,标准配置通过单次前向传播生成预测,另提供加入交叉特征、SVD 特征的 32 路集成配置 TabFM-Ensemble。

    推荐理由:把表格预测改为上下文学习,为减少逐数据集训练和调参提供了不同路径,文中还区分了直接预测与加入特征工程的集成配置。

6月27日周六
6月25日周四
6月17日周三
  1. Google DeepMind52

    Google DeepMind 与英国政府共建 AI 规划审批原型,目标将房主申请处理时间减半

    Google DeepMind 正与英国政府等合作,开发基于 Gemini 的规划审批原型,目标将房主规划申请的决策时间缩短 50%。工具可整合资料、核对政策并提供引用、汇总咨询反馈及起草评估报告,由规划官员逐行审核并保留最终决定权,同时记录各步骤供审计。原型在 Barnet、Camden 和 Dorset 开展早期试验后,政府计划从 2027 年起向全国地方议会提供。

  2. Google Research41

    从像素到规划:Google Earth AI 助力自然修复

    Google 发布基于 Earth AI 的矢量化数据集,将英格兰树篱、石墙和小树林的像素地图转化为可用于自然修复规划的生态清单。团队微调 RSF 视觉模型,并结合双层标注、跨网格几何合并与形状分类,识别标准卫星检测容易遗漏的细小生态特征,为土地管理者提供测量和扩展这些特征的数据支持。

6月16日周二
  1. Google DeepMind61

    Google DeepMind 如何通过 AI Control Roadmap 保障 AI 智能体安全

    Google DeepMind 介绍 AI Control Roadmap,为 Google 内部部署的 AI 智能体建立模型对齐之外的系统级纵深防护。框架基于 MITRE ATT&CK 进行威胁建模,以覆盖率、召回率和响应时间衡量监控效果,并按模型逃避检测与执行攻击的能力配置检测及预防响应级别。

    推荐理由:将智能体视作潜在内部威胁,并按逃避检测与执行攻击的能力分级配置防护,为不完全依赖模型对齐的系统安全提供参考。

6月13日周六
  1. Google Research63

    Google Research 研究 AI 如何帮助用户理解皮肤问题及其决策局限

    Google Research 分享的研究发现,AI 辅助能提高用户识别皮肤问题的准确率,但未显著改善标准 AI 组选择后续医疗步骤的准确率。本周发表于 JAMA Dermatology 的研究纳入 2,345 名参与者,AI 组病症名称猜测准确率为 23%,对照组为 8%;AI 组建议的处理紧迫程度低于皮肤科医生判断的比例为 30%,对照组为 27%。

    推荐理由:研究区分了识别皮肤问题与选择就医步骤两种能力,为理解医疗信息工具的准确率提升为何不等于决策改善提供了具体对照。

6月11日周四