Amazon Bedrock 扩展 Claude 模型可用范围,支持印度境内推理
Amazon Bedrock 新增 Claude 模型印度境内推理支持,通过地理跨区域推理将数据处理限定在印度。可用模型包括 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5。请求仅在孟买与海得拉巴区域之间路由,用户可通过控制台或 API 访问。
Amazon Bedrock 新增 Claude 模型印度境内推理支持,通过地理跨区域推理将数据处理限定在印度。可用模型包括 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5。请求仅在孟买与海得拉巴区域之间路由,用户可通过控制台或 API 访问。
Amazon Bedrock 现支持在首尔对 Claude Opus 5 和 Claude Sonnet 5、在新加坡对 Claude Sonnet 5 进行区域内推理。请求和数据全程留在指定区域,吞吐量受该区域容量及服务配额限制。用户可通过控制台或 bedrock-runtime 端点调用。
Microsoft Research 推出实验性 AI 研究系统 Quine,将多模态生物学世界模型与科学工具、文献及研究人员连接。团队与 Broad Institute 合作,用一个周末从数千种化合物中筛出待实验验证的候选物,随后在多项湿实验中验证了部分高排名化合物对胰腺癌细胞状态的预测性转变效果。
推荐理由:胰腺癌细胞状态实验展示了模型预测如何进入湿实验筛选流程,也呈现了较弱的反向转变与意外表型如何成为后续研究线索。
OpenAI DevDay 2026 带来超过 20 项公告,涵盖 GPT-6 Astra、ChatGPT 和 Codex。公告内容还包括 API、安全及面向开发者的新工具。
OpenAI 推出主动式助手 dots,可持续处理复杂项目和日常任务。dots 在推进工作的同时,帮助用户保持对工作的掌控。
Amazon Bedrock 已上线 xAI 的 Grok 4.7,提供 500K token 上下文窗口,以及 low、medium、high、xhigh 四档推理强度。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近实时视频生成与语音对话结合,即日起在 Gemini Enterprise 提供。
推荐理由:后台工具调用与持续对话并行,让虚拟形象不只承担视听呈现,也能在查询数据和处理任务时保持交互连贯。
Remedy Entertainment 的《CONTROL Resonant》首发登陆 GeForce NOW,Ultimate 会员可享 GeForce RTX 5080 级云端性能。9 月 27 日前购买 12 个月 Ultimate 会员可免费获得该游戏。GeForce NOW 也将很快支持 Googlebooks。
Google 公布 Private AI Compute 架构更新方案,将引入私密的服务端持久记忆,以支持跨设备延续上下文并保持端侧隐私标准。方案把数据存入加密的用户专属数据库,解密密钥仅由个人设备持有,处理请求时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密并将新增上下文加密保存。
Harvey 借助 GPT-6 Astra,将法律上下文转化为结构更清晰、更贴合上下文的法律文书。生成的文稿让律师能够腾出精力,专注于策略工作。
invideo 借助 GPT‑6 Astra 更精准地规划剪辑,将色彩校正和调色效果提升至原来的 3 倍。它还可在一天内制作 50 个自定义效果。
Ringg 借助 OpenAI 的 AI 智能体解决高达 65% 的客户来电问题。其使用 GPT-5.6,为语音、聊天、WhatsApp 和网页渠道提供多语言智能体,成本较 GPT-4.1 降低 90%。
ChatGPT Ads 正扩展至东南亚和台湾,为符合条件的企业提供新的触达渠道。这项扩展让符合条件的企业能够覆盖超过 60 个国家的人群。
GPT-6 改进了提示词缓存,通过更高的缓存命中率、新增诊断功能、显式断点及控制选项,降低延迟与成本。这些改进涵盖缓存命中、诊断与控制,原文未提供具体性能数据或成本降幅。
NVIDIA 在 ROSCon 发布免费开源的 Isaac ROS 5.0,新增智能体开发工作流,并支持 ROS Lyrical 和 Ubuntu 24.04。
Hugging Face 为 Transformers 新增高效运行 GGUF 量化模型的支持,通过复用 ggml 内核并优化 generate,初期面向 Apple Silicon 本地推理。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新视频功能,加快创意工具面市。GPT-6 Astra 还让小企业更容易制作视频广告。
OpenAI Academy 新增面向员工、开发者、领导者、教育工作者和学生的学习路径。这些学习路径旨在帮助学习者培养并展示实用 AI 技能。
V7 借助 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。V7 使用 GPT-5.6 将分散的公司文件转化为 AI 智能体可用的上下文,支持其完成关联来源的复杂工作。
Pawprint Studio 的免费开放世界生物捕捉角色扮演游戏《Aniimo》本周首发上线 GeForce NOW,可在支持的设备上云端游玩,无需下载 45GB 文件。本周共有 11 款游戏加入平台;《007 First Light》新增路径追踪,并由 NVIDIA DLSS 4.5 Ray Reconstruction 提升画面质量。
Cooley 利用 ChatGPT Work 构建 GO Public,将 AI 能力引入 IPO 流程,帮助律师加速相关工作。该工具帮助律师更早发现问题,将专业判断集中在最关键的环节。
OpenAI for Law 为法律工作提供前沿智能,支持定制律所工作流程并连接法律数据源。该产品还提供适用于保密客户工作的法律级管控措施。
OpenAI 探索由 AI 驱动的新广告体验,涵盖 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。这些探索聚焦 AI 在广告场景中的应用。
Hex 借助 GPT-6 Astra,让数据 AI 智能体将复杂分析的答案转化为可视化报告。这些报告以交互式可视化呈现结果,让员工乐于分享。
ALTK-Evolve 新增 Consistency Analyzer 和一致性指南生成能力,在 AppWorld 测试中将 GPT-4.1 智能体的一致性差距从 24.4pp 缩小至 12.0pp。
推荐理由:通过区分平均成功率与多次运行全部成功的任务比例,这篇材料提供了衡量智能体重复执行可靠性的具体方法。
Perplexity 使用 GPT-6 Astra 处理端到端系统工作,相比使用早期模型时,检查频率显著降低。其具体用途包括撰写通信内容、修改软件和监控生产系统。
Cognition 借助 GPT‑6 Astra 提升 Devin 测试软件并展示其正常运行的能力,让 Devin 更好地验证自身工作成果。此举旨在帮助工程师减少代码审查量,交付更多软件。
OpenAI 在 ChatGPT Work 中推出 Data agent,支持用户用自然语言借助 AI 处理公司数据。用户可以连接公司数据、发现洞察并构建交互式仪表盘。
OpenAI 推出 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 相结合。该产品用于研究、建模,以及制作可交付客户的材料。
OpenAI 推出 Agents API,这是一项用于构建与上线云端智能体的托管服务。该服务由 Codex harness 驱动,支持编排、长时间运行的会话和工具使用。
推荐理由:托管服务将编排、长时间运行的会话和工具使用纳入同一入口,为构建与上线云端智能体提供了明确的工程路径。
Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组全部 9 billion 种单碱基变异的分子影响。配套的 AVI 评分整合 AlphaGenome 与 AlphaMissense 的预测,支持编码及非编码区域的变异排序,并通过特征归因解释相关分子过程;合作研究利用这些预测发现并实验验证了罕见病相关变异。
推荐理由:将全基因组变异预测与影响评分及特征归因连接起来,为研究者从候选变异排序走向分子机制解释提供了可迁移的研究路径。
OpenAI 推出 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像。生成结果能更好地体现用户的创意。
GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中按任务动态选择模型与执行流程,面向所有 Copilot 套餐开放。
推荐理由:三组离线评测同时列出质量差异与完整工作流成本,为比较多模型编排和单一强模型的质量成本取舍提供了具体依据。
Hugging Face 的开源工具 funes 将已有会话转为持久记忆,支持 Claude Code、Codex、pi 和 Hermes 跨智能体检索。嵌入与重排序在本机运行,检索返回原文及会话出处;用户可选择同步至自己拥有、默认私有的 Hugging Face 数据集,实现跨机器共享。
推荐理由:将会话原文连同出处保留为可检索数据,为跨智能体交接提供了不同于压缩摘要的路径,也让过去决策的依据能够被追溯。
Google 推出限量开放的 Fairwind Program,向可信的 Google Cloud 客户、政府机构和网络安全伙伴提供自主发现与修复漏洞的能力。该计划结合 Gemini 3.8 Flash Cyber 与 CodeMender,Google 称其可在组织的安全云环境中,将人工修复所需的数周缩短为数分钟,生成经过验证、可部署的补丁。
推荐理由:将漏洞发现、验证与修补放在同一流程中,提供了观察防御团队如何缩短修复周期并在受控云环境中应用智能体的具体案例。
Google DeepMind 推出智能体式视频理解功能,支持 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite。该功能通过原生视频工具动态搜索和检查画面、音频及转录文本,官方基准显示 token 消耗最多降低 88%、分析成本最多降低 66%、准确率最多提升 7%。
推荐理由:相较固定帧率处理,按任务动态检索视频片段提供了降低长视频分析开销的具体路径,也给出了准确率与成本的对照。
Hugging Face 发布 @huggingface/kernels,可从 Hub 加载并运行优化的 WebGPU 内核,首批提供 207 个。内核采用 Apache-2.0 许可,附带版本化接口、正确性测试与基准用例。同步推出的 Fleet 可在浏览器中测试 GPU 性能与正确性,经用户同意收集结果以改进内核。
Mistral 推出 Agentic Search,通过多步检索与文档导航帮助 AI 系统查找、阅读和核验复杂文档中的信息。它基于现有索引提供 search、open、navigate、read 和 grep 五种工具,可通过 Mistral Search Toolkit 集成,也已内置于 Studio 和 Vibe 的 Libraries,支持云端和本地部署。
推荐理由:通过区分单次检索、循环搜索和文档导航的评测结果,材料展示了复杂文档问答中准确率提升与检索开销下降之间的关系。
OlmoEarth Studio 现已支持按需计算并导出地球观测嵌入向量,用于相似性搜索、分割和无监督探索。用户可通过界面或 API 自定义区域、时间范围、编码器、分辨率及影像来源,获取 COG 文件。OlmoEarth 基础模型的源码与权重已公开,也可自行计算嵌入向量。
Mistral AI 加强推理的区域控制与可靠性,扩展第三方开放模型支持,并联合企业锁定欧洲长期算力。Mistral Regional Endpoints 已正式可用,支持选择欧洲或美国推理区域;平台将从 GLM-5.2 开始支持第三方开放模型。企业多年期承诺将通过 European Compute Units 换取基础设施使用权。