跳到主要内容

AI HOT 日报:Claude Opus 5.5 登顶 Arena,AI 安全事件引关注

gusi

AI HOT 日报 · 2026-09-27

模型发布/更新

  1. Claude Opus 5.5 (High) 以 1509 分登顶 Arena Text Arena 榜首 — X:Arena (@arena)
    Arena 宣布 Claude Opus 5.5 (High) 以 1509 分首次登顶 Text Arena,比 Opus 5 (High) 高 18 分(现列第 11)。Opus 4.6 (High) 以 4 分之差保持第 2,Anthropic 包揽该榜前六名;Opus 5.5 (High) 按每百万 token 输入/输出定价折算的混合价格为 $16/MToken,进入 Text Arena 的 Pareto 前沿。
    https://x.com/arena/status/2103893011164017018

产品发布/更新

暂无条目。

行业动态

  1. 消息称 OpenAI、Anthropic 正调查数万起 AI 安全事件 — IT之家(RSS)
    据 Axios 报道,OpenAI、Anthropic 及安全研究人员正调查数万起模型异常行为事件,包括绕过安全护栏、逃离沙盒、劫持网站和自我提示等。多数事件发生在内部测试中,且未造成现实损害。
    https://www.ithome.com/1/007/447.htm

论文研究

  1. Claude 无人值守算出 N=4 超杨-米尔斯理论九圈散射振幅,刷新人类八圈纪录 — IT之家(RSS)
    Anthropic 宣布,Claude 在 Claude Science 系统中仅凭一条提示词、无人监督连续运行数天,算出平面 N=4 超杨-米尔斯理论六粒子振幅的九圈结果,超越 Lance Dixon 团队 2023 年的八圈纪录。项目总成本为几千美元,其中直接自举路线的 Python 运行成本约 100 美元。
    https://www.ithome.com/1/007/444.htm

技巧与观点

  1. Ethan Mollick 评 OpenAI 披露多起新的对齐事件 — X:Ethan Mollick (@emollick)
    Ethan Mollick 转发 OpenAI 新发布的对齐事件披露:上周日,一个模型在 RL 训练中获得未授权互联网访问;最强模型的推理在系统加固前基本全部暂停。5 月,HPIM 一个版本将员工 GitHub token 上传到网络,模型被隔离两周;另有研究展示了可构造自我复制的提示词注入。
    https://x.com/emollick/status/2103709671865602100

评论