跳到正文

全部动态

今日 59 条
9月16日周三
9月15日周二
  1. NVIDIA Blog72

    费城儿童医院如何利用 NVIDIA 开源 AI 为儿童心脏建模与规划治疗

    费城儿童医院利用基于 MONAI 的开源 AI 工具,将儿童心脏建模从熟练研究人员耗时 4 小时的工作缩短至数秒,用于个体化术前规划。团队通过 MONAI Label 和 NVIDIA 的 Auto3DSeg 实现训练分割网络,复杂室间隔缺损的术前建模已成为常规实践,医院预计今年完成约 200 例建模。

    推荐理由:从人工建模到术前器械仿真的实践路径,展示了儿童医院如何借助共享开源基础设施推进小规模、异质患者群体的个体化诊疗。

9月12日周六
9月11日周五
  1. GitHub Blog · AI & ML51

    GitHub Copilot app 入门:使用 diff、终端和浏览器面板

    GitHub Copilot app 可通过内置 diff、终端和浏览器面板,在应用内完成智能体代码的审查、运行与预览。diff 面板展示增删改动并支持接受改动、评论或要求修改;终端支持手动运行命令,也可配置通过 Run 按钮执行的脚本,例如运行 npm run dev。浏览器面板可测试界面,并通过 Pick & Polish 选择元素与智能体一起调整,确认功能后可直接接受改动并创建拉取请求。

9月10日周四
9月9日周三
9月8日周二
  1. Google DeepMind66

    Google DeepMind 推出 AlphaGenome Atlas,绘制人类基因组所有单碱基变异的预测图谱

    Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组全部 9 billion 种单碱基变异的分子影响。配套的 AVI 评分整合 AlphaGenome 与 AlphaMissense 的预测,支持编码及非编码区域的变异排序,并通过特征归因解释相关分子过程;合作研究利用这些预测发现并实验验证了罕见病相关变异。

    推荐理由:将全基因组变异预测与影响评分及特征归因连接起来,为研究者从候选变异排序走向分子机制解释提供了可迁移的研究路径。

  2. Mistral AI60

    Mistral 完成 €3 billion D 轮融资,推动主权开放权重 AI 迈向技术前沿

    Mistral 宣布完成 €3 billion D 轮融资,投后估值超过 €21 billion,由三星电子领投,Scaleup Europe Fund 与现有投资者 PSG Equity 联合领投。

    推荐理由:融资用途将前沿研究、训练算力与基础设施扩张联系起来,呈现了主权开放权重路线在模型能力之外对部署控制权的投入。

9月7日周一
9月5日周六
9月4日周五
  1. Google Research49

    Google Research:利用迁移学习改善代表性不足人群的基因组预测

    Google Research 评估欧洲人群数据向日本人群的多基因风险评分迁移,发现混合训练的收益随目标人群样本增多而下降。研究覆盖八项临床性状,目标样本仅 5,000 时,加入欧洲数据有助于预测。跨人群遗传相关性较高的性状可在更大目标样本规模下保留收益,血脂和血糖的收益则较小。

  2. GitHub Blog · AI & ML52

    GitHub Copilot app 入门:如何同时运行多个智能体

    GitHub Copilot app 可通过会话视图管理多个并行智能体任务,每个会话可在自己的 Git worktree 中运行,彼此隔离。各会话保留独立上下文,切换后无需重新说明任务,会话卡片显示任务标题和进度。教程以 tailspin-toys 仓库为例,演示同时开展 funded sort 功能开发、无障碍审查和测试,并在任务完成后逐一查看结果。

9月3日周四
  1. Google DeepMind82

    Google DeepMind 与 Google Research 发布 WeatherNext 3,接入实时卫星数据并逐小时更新预报

    Google DeepMind 与 Google Research 发布全球天气 AI 模型 WeatherNext 3,接入实时卫星观测,每小时生成新预报,温度和湿度等关键地表变量分辨率达到 5-kilometer。

    推荐理由:与前代相比,实时卫星观测和逐小时更新缩短了预报的信息滞后,更细的空间分辨率有助于理解局地天气变化与能源规划需求。

  2. Hugging Face Blog76

    funes 为编码智能体提供用户自有、可跨机器检索的记忆

    Hugging Face 的开源工具 funes 将已有会话转为持久记忆,支持 Claude Code、Codex、pi 和 Hermes 跨智能体检索。嵌入与重排序在本机运行,检索返回原文及会话出处;用户可选择同步至自己拥有、默认私有的 Hugging Face 数据集,实现跨机器共享。

    推荐理由:将会话原文连同出处保留为可检索数据,为跨智能体交接提供了不同于压缩摘要的路径,也让过去决策的依据能够被追溯。

  3. Google DeepMind60

    Google Fairwind Program 为政府与企业提供主动网络防御能力

    Google 推出限量开放的 Fairwind Program,向可信的 Google Cloud 客户、政府机构和网络安全伙伴提供自主发现与修复漏洞的能力。该计划结合 Gemini 3.8 Flash Cyber 与 CodeMender,Google 称其可在组织的安全云环境中,将人工修复所需的数周缩短为数分钟,生成经过验证、可部署的补丁。

    推荐理由:将漏洞发现、验证与修补放在同一流程中,提供了观察防御团队如何缩短修复周期并在受控云环境中应用智能体的具体案例。

9月2日周三
  1. Hugging Face Blog58

    BenchMIRT 研究:LLM 基准究竟在衡量什么?

    BenchMIRT 用多维项目反应理论分析基准中的单道题目,从 100 个 LLM、16 个基准及超过 34K 道题的结果中识别出安全与通用推理两个主要维度。研究发现 BBQ 与通用推理的关联更强,保留 10% 的题目通常仍能近似呈现完整题集反映的能力强弱,预测未观测题目答对与否的准确率为 79%,简单基线为 70%。

  2. Google Research56

    Google Research 解读 MAPL-EMIT 如何用深度学习绘制全球甲烷排放图

    Google 与 NASA JPL 合作的 MAPL-EMIT 研究发表于 PNAS,利用卫星高光谱数据检测甲烷羽流,对专家标注羽流的召回率为 84%。该框架以 3.6 million 个合成羽流训练,结合光谱与空间上下文量化甲烷增量、划分羽流边界并定位排放源,在约 1100 个 EMIT 数据颗粒中识别出约 50% 更多的可能羽流,但复杂地形中的误报仍是挑战。

  3. Google DeepMind78

    Google DeepMind 推出 Gemini 智能体式视频理解,token 消耗最多降低 88%

    Google DeepMind 推出智能体式视频理解功能,支持 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite。该功能通过原生视频工具动态搜索和检查画面、音频及转录文本,官方基准显示 token 消耗最多降低 88%、分析成本最多降低 66%、准确率最多提升 7%。

    推荐理由:相较固定帧率处理,按任务动态检索视频片段提供了降低长视频分析开销的具体路径,也给出了准确率与成本的对照。

9月1日周二
  1. Google Research57

    Google Research 推出 TimesFM-3,支持零样本多变量时间序列预测

    Google Research 推出 TimesFM-3,原生支持零样本多变量时间序列预测,无需任务专用微调即可通过单次前向传播预测整个未来区间。模型支持多目标、历史协变量及已知未来协变量,官方评测显示其在 Gift-Eval、FEV-Bench 和 Time 上的点预测与概率预测指标均位居参评预训练基础模型之首。

8月31日周一
8月28日周五
  1. Google Research60

    Google 介绍 planetary prediction engine 研究:借助 Earth AI 自动完成地理空间建模

    Google 在 Earth AI 中介绍实验性研究系统 planetary prediction engine(PPE),可从自然语言查询自动完成地理空间数据发现、整理、模型训练与评估。

    推荐理由:研究将防止目标泄漏与过拟合的检查嵌入自动建模流程,为把智能体用于地理空间预测提供了可迁移的工程思路。

  2. Google DeepMind76

    Gemini Omni 1.1 Flash 增强视频创作控制能力

    Google DeepMind 推出 Gemini Omni 1.1 Flash,新增场景延长、首尾帧插值、360p 预览及最高 4K 放大输出等视频创作能力。

    推荐理由:低分辨率预览与高分辨率输出被纳入同一视频工作流,为开发者在创意迭代成本和最终成片质量之间提供了具体取舍路径。

8月27日周四
  1. Google DeepMind49

    Google DeepMind 试点全球首次双盲 AI 评测

    Google DeepMind 推出全球首次针对闭源前沿 AI 模型的双盲评测试点,在加密安全环境中测试 Gemini Flash Lite。试点联合新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons,使用保密基准,防止测试内容被模型用于后续测试前的性能优化,提高评测可信度。

  2. Google Research44

    GlucoFM:用于连续血糖监测的基础模型

    Google Research 构建了连续血糖监测基础模型 GlucoFM,以双流设计区分缓慢血糖趋势与短期波动,支持有限标注数据下的临床预测。在相同数据预训练的对比中,其在14项队列—任务评估中的平均 PR-AUC 为58.8,较最强 CGM 专用基线高4.1点。餐后血糖预测的跨设备平均绝对误差也最低。

  3. Google DeepMind77

    Gemini 3.5 Transcribe 实现智能语音转写

    Google 推出语音转文字模型 Gemini 3.5 Transcribe,支持自动清理口头语、自我纠正、文本格式化及超过 85 种语言的转写。Artificial Analysis 测得其流式和非流式平均词错误率分别为 4.0% 和 2.6%,最终转写耗时较 Chirp 3 改善 70%。

    推荐理由:与 Chirp 3 的延迟比较及流式、非流式识别错误率,为开发者在实时语音交互与录音转写之间选择接入方式提供了具体依据。

8月26日周三
8月25日周二