跳到正文

#部署/工程

今日 1 条
今天9月30日周三
9月29日周二
  1. MIT Technology Review · AI33

    企业如何让 AI 成为资产,而非开支

    企业将 AI 从试验转向生产时,应按持续需求和利用率评估按量付费与自有算力,让 AI 投入成为可优化的资产。自有算力并非天然更便宜,成本交叉点取决于实际工作负载、模型、性能要求及运营成本。企业还需通过用户采用、治理和用例扩展保持算力有效利用,才能兑现投资价值。

9月28日周一
9月26日周六
9月23日周三
9月22日周二
  1. NVIDIA Blog37

    为什么规模化部署物理 AI 需要每一层的安全保障:NVIDIA Halos 的全栈方案

    NVIDIA 将物理 AI 的规模化部署安全落实到硬件、软件、AI 行为及运行环境,并以 Halos 提供全栈支持。动态环境、模型更新及复杂场景要求安全验证贯穿设计、部署与验证,而非仅在部署前检查。Halos 覆盖自动驾驶与机器人,结合仿真、真实世界验证和可重复检查,为第三方系统级认证做准备。

9月18日周五
  1. Latent Space51

    AINews 日报综述:Claude Code 多线程编排、Jev 分类路由与智能体安全

    AINews 汇总 9/16/2026–9/17/2026 的 AI 动态,主线是智能体向持久运行、多会话编排和领域专用产品演进。Claude Code Projects 支持由单一对话协调并行云端会话,OpenAI 推出配有 26 个合作伙伴插件和 47 个社区插件的 Astra for Law,社区则探索将 Jev 用于分类路由与结构化决策。

8月24日周一
  1. Import AI50

    Import AI 470:不给机器权利;用 SPADE 自动生成环境;用 Hawkeye 构建更好的 GPU 内核

    多所大学的研究人员开发了 SPADE,通过自博弈交替生成可执行训练环境并学习求解,提升模型在游戏和工具使用任务中的表现。在游戏评测中,30B-A3B 规模模型的套件平均分达 58.3,较基础模型提高 8.1,较最强固定环境基线提高 5.3。该方法仍受限于生成环境所用基础模型的想象能力。

8月14日周五
  1. Hugging Face Blog70

    Hugging Face 夏季开放模型报告:关注度与采用分化,Qwen 衍生生态扩大

    Hugging Face 的夏季开放模型报告显示,Hub 上前沿模型的关注度与持续使用明显分化,Qwen 已积累 151,448 个衍生模型。报告主要分析 2026 年前 7 个月的数据,下载量与点赞数前 25 名仅有 1 个仓库重合;在声明参数量的模型中,低于 1B 的模型占历史累计下载量的 83%。

    推荐理由:通过区分点赞、下载与衍生模型三类指标,这份报告提供了辨别社区关注度与生态依赖的方法,避免将发布热度等同于持续使用。

7月30日周四
  1. Hugging Face Blog29

    GPU 管理:为什么闲置 GPU 如同停飞的飞机

    企业 AI 的下一道关键瓶颈正转向 GPU 利用率:硬件持续产生成本,只有有效计算才能带来产出。API 成本随 token 用量线性增长,自购 GPU 则以固定资本投入替代可变支出。集群按峰值需求配置,但实际需求并不持续,购入硬件后能否让其有效运转,决定了投入是否值得。

7月7日周二
  1. Berkeley AI Research53

    智能趋近免费之后,数据系统如何服务、承载并由 AI 智能体构建?

    Berkeley AI Research 的观点文章提出,推理成本趋近零将推动数据系统沿服务智能体、承载智能体群和由智能体构建三个方向演进。在文中引用的多智能体 text-to-SQL 实验中,80-90% 的子查询执行重复工作,为结果复用与近似查询提供了优化空间。作者结合自身研究,讨论了结构化纠错记忆、共享状态并发与故障处理,以及通过辅助验证智能体和正确性证明应对定制数据系统的规范缺漏问题。

7月6日周一
6月29日周一
  1. Import AI51

    Import AI 第463期:机器人自主改进、腾讯万卡 GPU 集群与人类时代的挽歌

    NVIDIA 研究团队开发 ENPIRE,将编码智能体的实验与改进闭环用于实体机器人,研究报告称其可在部分灵巧操作任务上达到 99% 成功率。腾讯披露训练追踪与性能诊断系统 ARGUS,已在超过 10,000 张 GPU 的生产集群运行超过 6 个月,但机器人集群的资源利用与并行扩展仍是 ENPIRE 面临的工程挑战。