跳到正文

#部署/工程

今日 12 条
9月22日周二
  1. NVIDIA Blog37

    为什么规模化部署物理 AI 需要每一层的安全保障:NVIDIA Halos 的全栈方案

    NVIDIA 将物理 AI 的规模化部署安全落实到硬件、软件、AI 行为及运行环境,并以 Halos 提供全栈支持。动态环境、模型更新及复杂场景要求安全验证贯穿设计、部署与验证,而非仅在部署前检查。Halos 覆盖自动驾驶与机器人,结合仿真、真实世界验证和可重复检查,为第三方系统级认证做准备。

9月21日周一
  1. NVIDIA Blog51

    NVIDIA 解读如何在智能体技术栈的每一层解决 AI 安全工程问题

    NVIDIA 将 AI 安全视为覆盖模型、智能体编排框架和运行环境的工程问题,要求每次部署具备可强制执行的边界、明确责任人及防护有效性的证据。运行环境应独立于智能体推理限制文件、网络和进程访问,为智能体配置可追溯身份与任务范围内的凭据,并对重大操作和权限变更保留人工审批。

9月18日周五
  1. Latent Space51

    AINews 日报综述:Claude Code 多线程编排、Jev 分类路由与智能体安全

    AINews 汇总 9/16/2026–9/17/2026 的 AI 动态,主线是智能体向持久运行、多会话编排和领域专用产品演进。Claude Code Projects 支持由单一对话协调并行云端会话,OpenAI 推出配有 26 个合作伙伴插件和 47 个社区插件的 Astra for Law,社区则探索将 Jev 用于分类路由与结构化决策。

9月17日周四
9月16日周三
  1. NVIDIA Blog44

    Emerald AI、Google 与 NVIDIA 成立联盟,推进灵活用电的 AI 数据中心

    Emerald AI、Google 与 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),推动数据中心根据电网状况动态调整用电。联盟以技术中立和性能为导向,将制定技术要求、性能指标与运营数据共享规范,并与公用事业公司合作探索并网方案,旨在保障可靠性的同时加快 AI 基础设施接入电网。

  2. Latent Space60

    TypeSafe 发布决策模型 Jev,宣称比小型前沿 LLM 快超 100 倍、便宜超 200 倍

    TypeSafe 发布 Jev,以 RLCD 训练面向决策、分类、路由和评分的模型,而非自由文本生成模型。正文转述其速度提升 20–200x、成本降低 40–400x 且输出 token 免费的宣称,并介绍了并行采样与校准能力。Jev 需要预定义输出格式,不能生成自由文本,定位是结构化选择的推理引擎,而非通用 LLM 替代品。

9月15日周二
  1. NVIDIA Blog72

    费城儿童医院如何利用 NVIDIA 开源 AI 为儿童心脏建模与规划治疗

    费城儿童医院利用基于 MONAI 的开源 AI 工具,将儿童心脏建模从熟练研究人员耗时 4 小时的工作缩短至数秒,用于个体化术前规划。团队通过 MONAI Label 和 NVIDIA 的 Auto3DSeg 实现训练分割网络,复杂室间隔缺损的术前建模已成为常规实践,医院预计今年完成约 200 例建模。

    推荐理由:从人工建模到术前器械仿真的实践路径,展示了儿童医院如何借助共享开源基础设施推进小规模、异质患者群体的个体化诊疗。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
9月8日周二
  1. Mistral AI60

    Mistral 完成 €3 billion D 轮融资,推动主权开放权重 AI 迈向技术前沿

    Mistral 宣布完成 €3 billion D 轮融资,投后估值超过 €21 billion,由三星电子领投,Scaleup Europe Fund 与现有投资者 PSG Equity 联合领投。

    推荐理由:融资用途将前沿研究、训练算力与基础设施扩张联系起来,呈现了主权开放权重路线在模型能力之外对部署控制权的投入。

9月3日周四
9月1日周二
8月26日周三
8月25日周二
  1. Hugging Face Blog72

    如何用 Gradio 连接、运行和部署 AI 工作流

    Gradio 内置的 gr.Workflow 可将 AI 流水线表示为带类型节点的图,并提供可拖拽、逐节点运行和查看中间结果的画布。节点可连接 Python 函数、Hugging Face Inference Providers 上的模型、Gradio Spaces 或数据集,文中通过图像编辑、并行生成和数据集分析等示例演示用法。

    推荐理由:将中间结果可见的节点画布与同一工作流的接口调用结合,为多步骤 AI 应用提供了从排查问题到复用服务的具体方法。

  2. Mistral AI44

    Mistral 与 HUMAIN 宣布战略合作,推进沙特及中东地区主权 AI

    Mistral 与 HUMAIN 宣布战略合作,推进沙特及中东地区的主权 AI,涵盖基础设施、模型开发和解决方案部署。双方计划开发和本地化先进模型,初期聚焦网络安全与语音,并开发阿拉伯语表现强劲的前沿模型。Mistral 将探索使用 HUMAIN 数据中心,双方还计划面向沙特受监管行业制定联合市场策略。

8月24日周一
  1. Import AI50

    Import AI 470:不给机器权利;用 SPADE 自动生成环境;用 Hawkeye 构建更好的 GPU 内核

    多所大学的研究人员开发了 SPADE,通过自博弈交替生成可执行训练环境并学习求解,提升模型在游戏和工具使用任务中的表现。在游戏评测中,30B-A3B 规模模型的套件平均分达 58.3,较基础模型提高 8.1,较最强固定环境基线提高 5.3。该方法仍受限于生成环境所用基础模型的想象能力。

8月21日周五
8月20日周四
  1. Mistral AI67

    Mistral Agentic Search 提供多步文档检索,提高搜索准确率与效率

    Mistral 推出 Agentic Search,通过多步检索与文档导航帮助 AI 系统查找、阅读和核验复杂文档中的信息。它基于现有索引提供 search、open、navigate、read 和 grep 五种工具,可通过 Mistral Search Toolkit 集成,也已内置于 Studio 和 Vibe 的 Libraries,支持云端和本地部署。

    推荐理由:通过区分单次检索、循环搜索和文档导航的评测结果,材料展示了复杂文档问答中准确率提升与检索开销下降之间的关系。

8月18日周二
8月14日周五
  1. Hugging Face Blog70

    Hugging Face 夏季开放模型报告:关注度与采用分化,Qwen 衍生生态扩大

    Hugging Face 的夏季开放模型报告显示,Hub 上前沿模型的关注度与持续使用明显分化,Qwen 已积累 151,448 个衍生模型。报告主要分析 2026 年前 7 个月的数据,下载量与点赞数前 25 名仅有 1 个仓库重合;在声明参数量的模型中,低于 1B 的模型占历史累计下载量的 83%。

    推荐理由:通过区分点赞、下载与衍生模型三类指标,这份报告提供了辨别社区关注度与生态依赖的方法,避免将发布热度等同于持续使用。

  2. Hugging Face Blog44

    如何用 Strands Agents、LeRobot 和 Hugging Face Storage Buckets 在一处完成录制、训练与部署

    Strands Robots 可结合 LeRobot 与 Hugging Face Storage Buckets,在单个智能体内串联机器人演示录制、策略训练和硬件部署。同步仅上传变化的字节,训练直接从 Hub 流式读取数据,无需完整下载,全程保持 LeRobot 数据格式。默认模拟路径使用 mock 策略,可跑通流程,但不产生实用策略。

8月11日周二
  1. Mistral AI47

    Mistral AI 的主权 AI 布局:区域内推理、开放模型与欧洲新基础设施

    Mistral AI 加强推理的区域控制与可靠性,扩展第三方开放模型支持,并联合企业锁定欧洲长期算力。Mistral Regional Endpoints 已正式可用,支持选择欧洲或美国推理区域;平台将从 GLM-5.2 开始支持第三方开放模型。企业多年期承诺将通过 European Compute Units 换取基础设施使用权。