NVIDIA Kumo Tabular 提升表格预测的准确率与效率
NVIDIA 发布开放表格基础模型 Kumo Tabular,利用带标签行作为上下文,单次前向传播即可完成分类或回归,无需针对任务训练、调参或特征工程。
推荐理由:相较每个任务重新训练的表格建模流程,上下文学习把带标签样本直接用于预测,为减少特征工程与调参提供了具体路径。
开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。
NVIDIA 发布开放表格基础模型 Kumo Tabular,利用带标签行作为上下文,单次前向传播即可完成分类或回归,无需针对任务训练、调参或特征工程。
推荐理由:相较每个任务重新训练的表格建模流程,上下文学习把带标签样本直接用于预测,为减少特征工程与调参提供了具体路径。
H company 发布 Holo4 智能体模型系列,包含 27B 稠密模型和 35B-A3B MoE 模型,可结合 GUI、代码、MCP 和 API 完成任务。
推荐理由:公开评测轨迹与成本计算口径为比较跨界面智能体提供了依据,文中也明确列出了任务子集和运行框架不同带来的比较边界。
OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 在访谈中复盘平台从早期多模型押注到加入 Stripe 的历程。
推荐理由:访谈把模型训练后的分发难题与开发者接入体验联系起来,为理解中立推理平台为何不只是接口封装提供了具体商业背景。
费城儿童医院利用基于 MONAI 的开源 AI 工具,将儿童心脏建模从熟练研究人员耗时 4 小时的工作缩短至数秒,用于个体化术前规划。团队通过 MONAI Label 和 NVIDIA 的 Auto3DSeg 实现训练分割网络,复杂室间隔缺损的术前建模已成为常规实践,医院预计今年完成约 200 例建模。
推荐理由:从人工建模到术前器械仿真的实践路径,展示了儿童医院如何借助共享开源基础设施推进小规模、异质患者群体的个体化诊疗。
Mistral 宣布完成 €3 billion D 轮融资,投后估值超过 €21 billion,由三星电子领投,Scaleup Europe Fund 与现有投资者 PSG Equity 联合领投。
推荐理由:融资用途将前沿研究、训练算力与基础设施扩张联系起来,呈现了主权开放权重路线在模型能力之外对部署控制权的投入。
Google DeepMind 的 WeatherNext 在气旋路径、强度和风场结构预测中达到 SOTA 精度,平均三天预报可达到以往模型两天预报的准确度。发表于 Nature 的研究基于 2023 至 2024 年历史气旋进行评测,模型可在单个 TPU 上用不到一分钟生成一次 15 天预报,今年每个气旋的集合预测已扩展至 1,000 种可能情景。
推荐理由:以相同预报精度比较提前量,比单看误差更容易理解模型进步的实际意义,也为评估气旋预报工具提供了具体参照。
微软研究院推出开源框架 Orchard,通过可复用的 Orchard Env 环境服务,支持软件工程、网页导航和个人助理智能体的训练与评估。该服务基于 Kubernetes,可直接在 Codex、OpenClaw、ZeroClaw 等实际部署框架内训练智能体,并配套开放训练流程、数据和评估方法。
推荐理由:将运行环境独立为可复用服务,并在实际部署框架内训练智能体,为减少跨任务基础设施重复建设和训练部署差异提供了具体路径。