跳到正文

#Anthropic

今日 2 条
今天9月30日周三
  1. The Decoder76

    Anthropic 评测称智谱 GLM-5.3 的漏洞利用开发能力接近 Claude Mythos Preview

    Anthropic 的评测显示,智谱开放权重模型 GLM-5.3 的漏洞利用开发能力接近 Claude Mythos Preview,但安全防护容易被绕过。ExploitBench 的 410 次尝试中,两者分别构建了 50 和 56 个有效漏洞利用;内部二进制漏洞利用测试中,完全控制目标程序的任务占比分别为 4% 和 6%。

    推荐理由:同一漏洞利用基准下的直接对照,让开放权重模型与受限模型的能力差距更具体,也将攻击能力与拒绝机制的有效性区分开来。

9月29日周二
  1. Latent Space70

    Claude Opus 5.5 在讲解视频制作中表现亮眼

    Claude Opus 5.5 本周发布后获得积极的社区反馈,其中通过代码制作讲解视频和动画的案例尤为突出。一位用户称,Claude Code 为 Friendr.nl 自主制作了 30–60s 讲解视频,耗时约 1.5–2h、花费约 $4,涵盖脚本、素材、TTS 配音及以 JavaScript canvas 动画渲染 MP4,并调用另一模型自检。

9月23日周三
  1. Latent Space86

    Claude Opus 5.5 成为 AINews 默认模型,Anthropic 与 OpenAI 主打降本 40%–50%

    AINews 因写作表现改善转用 Claude Opus 5.5;Anthropic 称其默认设置下每项任务较 Opus 5 便宜约 40%,OpenAI 同期发布的 GPT-6 Sol 和 Luna 则较各自 GPT-5.6 前代降价约 50%。

    推荐理由:材料区分了标价下降与实际任务成本,并对照不同推理强度下的 token 消耗,为理解模型降价提供了更具体的比较口径。