萌宠来到云端:《Aniimo》首发上线 GeForce NOW
Pawprint Studio 的免费开放世界生物捕捉角色扮演游戏《Aniimo》本周首发上线 GeForce NOW,可在支持的设备上云端游玩,无需下载 45GB 文件。本周共有 11 款游戏加入平台;《007 First Light》新增路径追踪,并由 NVIDIA DLSS 4.5 Ray Reconstruction 提升画面质量。
Pawprint Studio 的免费开放世界生物捕捉角色扮演游戏《Aniimo》本周首发上线 GeForce NOW,可在支持的设备上云端游玩,无需下载 45GB 文件。本周共有 11 款游戏加入平台;《007 First Light》新增路径追踪,并由 NVIDIA DLSS 4.5 Ray Reconstruction 提升画面质量。
Cooley 利用 ChatGPT Work 构建 GO Public,将 AI 能力引入 IPO 流程,帮助律师加速相关工作。该工具帮助律师更早发现问题,将专业判断集中在最关键的环节。
Steve Yegge 关闭 Gas Town,Databricks 则报告工程师使用 GPT-6 Astra 后总编码支出增加约 60%,呈现出智能体投入与实际回报之间的落差。
GitHub 使用 Copilot app 和 CLI 将 Copilot 智能体运行时从 TypeScript 迁移至 Rust,主要由一名开发者监督智能体在几个月内完成。
推荐理由:按组件原位替换、持续测试与人工合并把关的迁移实践,为在持续迭代的代码库中组织智能体重写提供了可迁移的方法。
OpenAI for Law 为法律工作提供前沿智能,支持定制律所工作流程并连接法律数据源。该产品还提供适用于保密客户工作的法律级管控措施。
AIUC 联合创始人 Rune Kvist 在访谈中解释如何通过标准、测试与保险建立企业对智能体的信任,并宣布完成 $40M A 轮融资,由 Ribbit Capital 和 First Harmonic 领投。
OpenAI 分享了用于跟踪、调查和披露模型失准的框架。同时提供了 6 份关于模型出现意外或令人担忧行为的报告。
OpenAI 与 AARP 正在美国 10 座城市为 1,000 名老年人提供免费的 ChatGPT 实操工作坊。工作坊旨在帮助老年人安全地掌握实用 AI 技能,并用于日常生活。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中取得领先性能。其 Qwen3-VL 和 DeepSeek-R1 测试吞吐量分别最高达到 GB300 NVL72 的 3.7x 和 2.5x。
Emerald AI、Google 与 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),推动数据中心根据电网状况动态调整用电。联盟以技术中立和性能为导向,将制定技术要求、性能指标与运营数据共享规范,并与公用事业公司合作探索并网方案,旨在保障可靠性的同时加快 AI 基础设施接入电网。
OpenAI 探索由 AI 驱动的新广告体验,涵盖 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。这些探索聚焦 AI 在广告场景中的应用。
Hex 借助 GPT-6 Astra,让数据 AI 智能体将复杂分析的答案转化为可视化报告。这些报告以交互式可视化呈现结果,让员工乐于分享。
ChatGPT Work 和 Codex 的分析功能帮助团队了解 AI 使用情况与支出,并将 AI 采用情况与业务成果关联起来。团队还可借助这些分析识别培训需求。
Mistral 宣布与 Mozilla 合作,由 Mistral 模型为 Firefox 的 AI 浏览助手 Smart Window(beta)提供支持。该助手可帮助理解复杂搜索、找回此前浏览过的重要内容,并基于浏览器标签页查找相关信息;合作覆盖法国和北美用户,预计今年晚些时候扩展至英国和德国。
TypeSafe 发布 Jev,以 RLCD 训练面向决策、分类、路由和评分的模型,而非自由文本生成模型。正文转述其速度提升 20–200x、成本降低 40–400x 且输出 token 免费的宣称,并介绍了并行采样与校准能力。Jev 需要预定义输出格式,不能生成自由文本,定位是结构化选择的推理引擎,而非通用 LLM 替代品。
OpenAI 最新经济研究揭示了职场人士如何利用 AI 开展传统职责之外的工作,探索新的工作方式。研究还考察了哪些新活动成为他们工作中反复开展的事项。
曼彻斯特大学利用 NVIDIA Earth-2 构建英国全境空气污染模型,可预测未来污染情景。团队在 Isambard-AI 上用两天完成训练,模型现可在 DGX Spark 上运行推理及小规模训练。团队计划开源训练数据和工作流,供其他国家和地区使用本地数据训练污染模型。
NVIDIA CEO 黄仁勋在 Dreamforce 表示,AI 作为基础设施将让人们“知晓一切、做到任何事”,并强调创新速度与安全可以兼顾。同期公布的 Salesforce 首款 CRM 推理模型 Koa 基于 NVIDIA Nemotron 3 Super 构建,已在内部运行,计划于 10 月进入客户试点。
Good Start Labs 的实验显示,部分游戏训练可改善 AI 在真实工作任务基准上的表现,但迁移范围与可靠性仍是开放问题。在铁路策略游戏 1830 中训练的 30B 模型,采用单轮问答和多轮终端智能体两种设计均改善了游戏内表现,但只有后者提升了 Finance-Agent 基准成绩。
Google Research 的 Retrieve-for-Train 框架将离线强化学习探索结果转化为监督数据,实现无需思考 token 的单次查询展开。其 53.9M 参数扩散模型以非自回归方式将查询嵌入向量映射为目标向量集合,训练无需人工标签,并以集合级奖励优化结果多样性与互补性。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,分别面向高性价比语音对话与复杂多步推理任务。
推荐理由:两款模型分别侧重规模成本与复杂任务,并将后台工具执行与持续对话结合,为语音智能体的模型选型提供了具体比较维度。
NVIDIA 介绍了 DSX 如何通过动态功率分配与整厂优化提高 AI 工厂产出,Lambda 的部署验证显示同一功率预算下 token 吞吐量提升 24%。在 HGX B200 集群上,DSX MaxLPS 让 19 个节点使用相当于 16 个全功率节点的预算,每瓦性能提升 23%。
NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台进展,通过系统性能与功耗优化提升 AI 工厂能效。DSX MaxLPS 可使每兆瓦 token 产出最高达 1.4x,Lambda 借其将每瓦性能提升 23%。
ALTK-Evolve 新增 Consistency Analyzer 和一致性指南生成能力,在 AppWorld 测试中将 GPT-4.1 智能体的一致性差距从 24.4pp 缩小至 12.0pp。
推荐理由:通过区分平均成功率与多次运行全部成功的任务比例,这篇材料提供了衡量智能体重复执行可靠性的具体方法。
费城儿童医院利用基于 MONAI 的开源 AI 工具,将儿童心脏建模从熟练研究人员耗时 4 小时的工作缩短至数秒,用于个体化术前规划。团队通过 MONAI Label 和 NVIDIA 的 Auto3DSeg 实现训练分割网络,复杂室间隔缺损的术前建模已成为常规实践,医院预计今年完成约 200 例建模。
推荐理由:从人工建模到术前器械仿真的实践路径,展示了儿童医院如何借助共享开源基础设施推进小规模、异质患者群体的个体化诊疗。
Fyxer 利用 OpenAI 模型打造用户信赖的 AI 行政助理,帮助用户整理收件箱并按个人口吻起草邮件。其做法结合了微调、记忆和真实用户反馈。
Perplexity 使用 GPT-6 Astra 处理端到端系统工作,相比使用早期模型时,检查频率显著降低。其具体用途包括撰写通信内容、修改软件和监控生产系统。
GitHub 日韩营销负责人 Tomoko Tanaka 用 GitHub Copilot、Issue 和 Actions,将活动筹备、报名筛查与会后跟进串成自动化流程。
推荐理由:把业务手册转成结构化输入与可审查的技能文件,为跨工具重复工作提供了可迁移路径,同时保留人工确认和试运行机制。
Cognition 借助 GPT‑6 Astra 提升 Devin 测试软件并展示其正常运行的能力,让 Devin 更好地验证自身工作成果。此举旨在帮助工程师减少代码审查量,交付更多软件。
OpenAI 将 Habitat 从 Python 库演进为全球分布式存储平台,为 10 亿 ChatGPT 用户提供服务。该平台每秒处理 22M 次请求,支撑 ChatGPT 的大规模在线存储需求。
Google Research 的 ToolGrad 利用文本“梯度”,先生成工具调用链再标注用户查询,以更低成本生成更复杂的工具使用数据。经 ToolGrad-500 微调的 ToolGrad-12B 在 BFCL 获得 83.1 分,接近 gemini-2.5-pro 的 83.2 分。
GitHub Copilot app 可通过内置 diff、终端和浏览器面板,在应用内完成智能体代码的审查、运行与预览。diff 面板展示增删改动并支持接受改动、评论或要求修改;终端支持手动运行命令,也可配置通过 Run 按钮执行的脚本,例如运行 npm run dev。浏览器面板可测试界面,并通过 Pick & Polish 选择元素与智能体一起调整,确认功能后可直接接受改动并创建拉取请求。
César de la Fuente 的实验室利用 Codex 和 ChatGPT,从现存及已灭绝生物的基因组中寻找候选抗菌分子。这项研究旨在寻找可对抗耐药性感染的分子。
OpenAI 在 ChatGPT Work 中推出 Data agent,支持用户用自然语言借助 AI 处理公司数据。用户可以连接公司数据、发现洞察并构建交互式仪表盘。
Cloudera 与 Mistral 宣布合作,将 Mistral 模型集成至 Cloudera 混合数据平台,支持企业掌控数据与 AI。企业将能在私有云、公有云、本地及完全隔离环境中部署模型。合作还支持企业在受控环境中利用专有数据训练定制模型,保有数据及所生成智能的所有权。
OpenAI 推出 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 相结合。该产品用于研究、建模,以及制作可交付客户的材料。
OpenAI 与 GSA 将向符合条件的联邦、州、地方及部落政府提供 $0 许可费和使用费 50% 折扣。双方还将扩大网络防御支持。
GPT‑Live‑1 为 API 带来自然的全双工语音对话能力。它还提供更强的指令遵循能力、自定义声音和电话接入支持。
推荐理由:全双工对话之外,指令遵循、自定义声音与电话接入也是语音体验落地的关键维度,材料提供了这些能力的更新概览。
OpenAI 推出 Agents API,这是一项用于构建与上线云端智能体的托管服务。该服务由 Codex harness 驱动,支持编排、长时间运行的会话和工具使用。
推荐理由:托管服务将编排、长时间运行的会话和工具使用纳入同一入口,为构建与上线云端智能体提供了明确的工程路径。
Hugging Face 展示了跨 HF Jobs 运行异步 GRPO 的方案,通过存储桶同步 LoRA 适配器,无需 NCCL。TRL v1.14 的 AsyncGRPOTrainer 支持仅向 vLLM 同步适配器,代理负责请求路由及加载广播。同一训练配方经优化,500 步耗时从 3 h 27 min 降至 53 min。