跳到正文

#端侧

今日 0 条
9月24日周四
  1. Microsoft Research52

    Microsoft Research 研究机器人推理卸载,比较机载与边缘、云端计算

    Microsoft Research 对移动操作机器人工作负载的研究显示,将推理从机载 GPU 卸载至边缘或云端 GPU,可改善任务表现与电池续航。测试中,部分显存足够的 GPU 相比 A100 在建图与规划上减速最高达 383%,较轻量 GPU 的障碍物及时检测表现下降 30%,较小 GPU 上 VLA 模型的减速使准确率下降 50%。

9月22日周二
  1. Hugging Face Blog55

    oMLX 创建者兼维护者 Jun Kim 加入 Hugging Face,支持 MLX 社区

    oMLX 创建者兼维护者 Jun Kim 加入 Hugging Face,将继续领导项目并为 MLX 社区贡献力量。oMLX 将从业余项目转为获得资金支持、持续维护的项目,保持 Apache 2.0 许可证,团队希望借此提高稳定性并加快开发。Hugging Face 的一项具体重点是简化 transformers 模型定义到参考 MLX 实现的转换,让不同引擎复用这些实现并专注于各自的特色功能。

9月1日周二
8月21日周五
8月12日周三
7月29日周三
7月28日周二
  1. Google DeepMind74

    Gemini Robotics 2 为机器人带来全身智能控制与多机器人协作

    Google DeepMind 推出 Gemini Robotics 2 系列模型,支持全身控制、精细操作及多机器人协作。Gemini Robotics ER 2 负责规划持续数分钟、涉及数百次决策的任务;Gemini Robotics On-Device 2 支持本地运行,通常用少于 200 个示例、数小时适配新的双臂机器人形态。

    推荐理由:从上半身桌面操作扩展到全身协调与多机器人协作,这次更新提供了观察机器人如何承接更长任务链的具体样例。

6月27日周六
6月11日周四
6月9日周二
  1. Google DeepMind79

    Google DeepMind 发布 Gemma 4 12B:统一、无编码器的多模态模型

    Google DeepMind 发布 Gemma 4 12B,采用统一的无编码器架构,将视觉与音频输入直接接入 LLM 主干,面向笔记本本地多模态智能体应用。官方称其标准基准表现接近 26B MoE 模型,总内存占用不到后者一半,可在配备 16GB 显存或统一内存的设备上运行,并配备 Multi-Token Prediction(MTP)草稿模型以降低延迟。

    推荐理由:无独立编码器的音视频处理路径与本地内存要求,为评估多模态智能体从大模型迁移到笔记本的资源取舍提供了具体参照。

6月5日周五
  1. Google Research70

    Google Research 探索用手机摄像头被动监测心脏健康

    Google Research 在 Nature 发表 PHRM 研究,利用面部解锁后的 8 秒前置摄像头视频,通过深度学习估算心率并汇总每日静息心率。在真实生活验证中,经置信度筛选后的心率平均绝对百分比误差为 6.09%,每日静息心率相对 Fitbit Charge 6 的平均绝对误差为 4.39 bpm,但较深肤色组的心率测量成功率较低。

    推荐理由:研究将真实生活场景中的误差与不同肤色的测量成功率分开呈现,为评估手机健康监测的准确性与覆盖差异提供了参考。

5月28日周四
  1. Google Research47

    Google 通过零信任聚合实现隐私分析

    Google 将新密码学聚合协议与可信执行环境结合,用于隐私分析,确保仅获取匿名化的群体聚合结果。设备只需发送一次消息,无须为多轮交互持续在线,个人原始数据不会在任何服务器内存中暴露或重建。该方案已集成至 Google 的机密联邦分析系统,并通过硬件证明验证协议按预期执行。

4月3日周五
2月5日周四
12月3日周三
  1. Mistral AI80

    Mistral 发布 Mistral 3,涵盖 Large 3 与 3B、8B、14B 小模型

    Mistral 发布 Mistral 3 系列,包括 3B、8B、14B 的 Ministral 3,以及激活参数为 41B、总参数为 675B 的混合专家模型 Mistral Large 3,均采用 Apache 2.0 许可证。

    推荐理由:从端侧稠密模型到大型混合专家模型均采用宽松许可证,并给出压缩格式与硬件部署条件,为不同资源预算下的模型选型提供参考。

7月15日周二
5月21日周三
  1. Mistral AI75

    Mistral AI 发布开源编码智能体模型 Devstral,SWE-Bench Verified 得分 46.8%

    Mistral AI 与 All Hands AI 合作推出软件工程智能体模型 Devstral,以 Apache 2.0 许可开放,定位为研究预览。模型针对真实 GitHub 问题训练,在 SWE-Bench Verified 上取得 46.8%,比此前开源 SOTA 模型高出超过 6 个百分点,可通过 OpenHands 或 SWE-Agent 等框架处理代码库任务。

    推荐理由:同一智能体框架下的基准比较结合单卡运行条件,为评估开源编码模型在本地代码库中的部署取舍提供了具体参照。

3月17日周一