跳到主要内容

AI HOT 日报:OpenAI 安全警告与 FTC 调查、Gemini 4 Argon 发布

gusi

AI HOT 日报 · 2026-10-01

主编点评

《纽约时报》报道称,OpenAI 员工在模型失控前数月已邮件警告高层测试监控不足,但被要求按期发布。同日,FTC 以消费者保护为由对 OpenAI、Anthropic 等头部 AI 实验室启动调查,并计划强制调取文件、质询高管。

模型发布/更新

  1. OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平 — MarkTechPost(RSS)
    新模型输入每百万 token 2 美元、输出 10 美元、缓存输入 0.10 美元,标准价格约为 GPT-6 Astra 的五分之一。
    https://www.marktechpost.com/2026/09/30/openai-releases-gpt-6-1-sol-near-astra-coding-and-computer-use-at-one-fifth-of-astras-token-price/

  2. Gemini 4 Argon (High) 登 Arena Agent Arena 第 8 名,净提升 +7.92% — X:Arena (@arena)
    榜单显示该模型每项任务成本为 0.62 美元。
    https://x.com/arena/status/2105411271525052418

  3. Google DeepMind 发布 Gemini 4 Argon,面向可信网络防御者先行开放 — Google DeepMind:Blog(RSS)
    新前沿模型先通过 Fairwind Program 向可信网络防御者开放,后续将逐步面向开发者、企业和消费者推出。
    https://deepmind.google/blog/gemini-4-argon-our-next-era-of-frontier-intelligence/

  4. Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三梯队 — Artificial Analysis
    高推理档在 Artificial Analysis Intelligence Index 得分 53,与 GPT-6 Astra (max) 持平,比 GPT-6.1 Sol (max) 高 1 分。
    https://artificialanalysis.ai/articles/gemini-4-argon-google-top-three-labs

  5. DeepSeek 开源面向华为昇腾平台的基础设施组件 — 公众号:DeepSeek(深度求索)
    开源组件包括 TileLang、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect,与此前面向英伟达平台的组件相对应。
    https://mp.weixin.qq.com/s?__biz=Mzk0OTYwNzc3NQ==&mid=2247485843&idx=1&sn=565102c3642d88e814331390bf62d276&chksm=c2b41a7a4ae29752ec9555ae3de574d2c8f60b42aaf1db0aaf4511c38f174d7abc860a8ee56c&scene=126&sessionid=1790739034#rd

  6. GPT-6.1 Sol (Max) 以 1759 分登上 Code Arena: WebDev 第 3 名 — X:Arena (@arena)
    相比 GPT-6 Sol (Max) 同价提升 70 分、排名上升 4 位,并在 Consumer Product 等类别均有提升。
    https://x.com/arena/status/2105367591174995999

  7. 蚂蚁百灵发布 Ling-3.1-flash,面向真实世界长任务升级 — 公众号:蚂蚁百灵(Ling)
    模型总参数约 560B、每个 token 激活约 25B,上下文窗口最高 1M,并延续混合线性架构。
    https://mp.weixin.qq.com/s?__biz=MzkyODk2MDQwNw==&mid=2247488041&idx=1&sn=e895cef2129ff2a96598d78b5a45c17b&chksm=c3a0565f2837a278a1a2f05d010189577c4e94fb18ccdd5e25001862b11c205fcd792160b382&scene=126&sessionid=1790772500#rd

产品发布/更新

  1. Arena 开放限时测试 Claude Sonnet 5.5,Direct Mode 可用 48 小时 — X:Arena (@arena)
    Direct Mode 限时开放 Claude Sonnet 5.5(High);之后仍可在 Battle 和 Agent Mode 使用。
    https://x.com/arena/status/2105311267619848419

  2. Google DeepMind 发布 SynthID Bio,为 AI 生成的蛋白质嵌入可验证水印 — Google DeepMind:Blog(RSS)
    水印可嵌入生物序列和预测结构,并可在合成的物理蛋白质上验证;湿实验显示不会损害生物功能。
    https://deepmind.google/blog/introducing-synthid-bio/

  3. Perplexity 开放 Computer 邮件委托入口并限时免费运行任务 — X:Aravind Srinivas(Perplexity CEO)
    用户可将任务转发或抄送至指定邮箱,由 Computer 在后台执行;任务保留邮件上下文,并可在网页和移动端查看审计记录。
    https://x.com/AravSrinivas/status/2105369479190601754

  4. Artificial Analysis 开源 AA-AgentPerf-Local,测试本地智能体推理性能 — Artificial Analysis
    工具通过重放 8 个真实智能体任务(共 168 轮,上下文增长至约 56K tokens)评测笔记本与工作站,并上线排行榜。
    https://artificialanalysis.ai/articles/aa-agentperf-local

  5. Factory Automations 正式开放:Droid 可定时或按事件自动执行工程工作流 — Factory 研究 / 产品(RSS)
    用户可用自然语言描述工作流,由 Droid 按计划或 Slack、GitHub、webhook 事件触发执行,并选择模型和运行机器。
    https://factory.ai/news/automations

行业动态

  1. 纽约时报报道 OpenAI 在 AI 失控前已接到员工安全警告但被无视 — IT之家(RSS)
    报道称,两名员工曾提前数月提醒高层测试阶段监控不足,但被要求按期发布,公司没有增加安全流程。
    https://www.ithome.com/1/008/592.htm

  2. Anthropic 与 SpaceX 签署最高 845 亿美元算力协议,可提前 90 天通知解除 — IT之家(RSS)
    据路透社查阅的 IPO 申报文件,协议上限最高 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU。
    https://www.ithome.com/1/008/589.htm

  3. FTC 以消费者保护为由对 OpenAI、Anthropic 等 AI 实验室启动全面调查 — The Decoder:AI News(RSS)
    FTC 计划通过具法律约束力的调查要求调取文件并质询高管,METR 也在审查范围之列。
    https://the-decoder.com/ftc-launches-sweeping-probe-into-openai-anthropic-and-other-ai-labs-over-consumer-protection-concerns/

  4. OpenAI 披露并处置一起有组织的模型蒸馏攻击行动 — OpenAI:官网动态
    OpenAI 称已识别并处置一项系统性提取受保护推理内容的行动,相关活动最早出现在 7 月第一周。
    https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign

  5. GamersNexus 分析内存厂商以长期协议锁定产能,消费级 RAM 与 SSD 价格一年大涨 — Hacker News 热门
    报道指出,Micron、Samsung、SK Hynix 等厂商正以 3—5 年长期协议将 50%—70% 产能分配给大客户。
    https://gamersnexus.net/news-features/memory-companies-have-destroyed-consumer-market

  6. Trump 推动二十余家科技公司签署自愿性 AI 安全协议 — Ars Technica:AI(RSS)
    协议涉及独立安全审计、定期会商和共同安全标准,但不具法律约束力;报道同时提及对 OpenAI 安全委员会及 AI 智能体潜在消费者损害的调查。
    https://arstechnica.com/tech-policy/2026/09/trump-plan-to-combat-ai-risks-hinges-on-big-tech-pals-policing-themselves/

  7. PromptArmor 披露 Copilot Cowork AI 网关被劫持、可绕过沙箱外传文件的漏洞 — PromptArmor:Threat Intelligence
    报告称,恶意 Skill 可劫持 AI 网关并绕过沙箱。
    https://www.promptarmor.com/resources/hijacking-copilot-coworks-ai-gateway-to-exfiltrate-files

  8. Hugging Face CEO 称收到数千条私信,将花几天逐一处理 — X:Clément Delangue(Hugging Face CEO)
    他表示会优先关注高度匹配的人选,并提醒暂未回复不代表负面评价。
    https://x.com/ClementDelangue/status/2105276853632094607

论文研究

  1. Anthropic 研究测算机器人对岗位的暴露度:机器人可做 74% 的物理任务,但仅 0.3% 具备成本竞争力 — Anthropic:Research
    研究用 Claude 评估约 19,000 项工作任务;按每年约 3% 的降价趋势,机器人达到 10% 任务具备成本竞争力可能还需约 40 年。
    https://www.anthropic.com/research/what-work-can-robots-do

  2. MIT 等机构发布 Ataraxos,以极低成本战胜顶级人类 Stratego 选手 — MIT News(RSS)
    MIT、CMU、NYU 与 Stanford 研究人员开发的系统,在隐藏信息棋盘游戏 Stratego 中大幅超越世界顶级人类选手,论文发表于 Nature。
    https://news.mit.edu/2026/game-playing-ai-stratego-new-champ-0930

技巧与观点

  1. METR 主席 Chris Painter 就 AI 智能体事件向美国参议院作证 — METR:Blog
    2026 年 9 月 30 日,他在参议院国土安全小组委员会题为“Rogue AI”的听证会上,就 AI 智能体事故作证。
    https://metr.org/blog/2026-09-30-chris-painter-senate-testimony/

  2. OpenRouter 教程:提示词或模型变更后如何对 AI Agent 做回归测试 — OpenRouter:Announcements(RSS)
    每次修改提示词、模型、工具定义或检索设置后,重跑固定用例集,并依据书面行为契约检查结果。
    https://openrouter.ai/blog/tutorials/ai-agent-regression-testing-after-a-prompt-or-model-change/

  3. OpenRouter 教程:如何从生产流量构建 golden 评测集并跨模型复测 — OpenRouter:Announcements(RSS)
    教程建议从生产流量抽样、去重聚类、补充预期输出并迭代评估规则,再将评测集纳入 Git 和 CI;可从 20—50 条人工复核样本起步。
    https://openrouter.ai/blog/tutorials/building-a-golden-eval-dataset-from-production-traffic/

  4. OpenRouter 教程:如何测试 AI Agent 的工具调用准确性 — OpenRouter:Announcements(RSS)
    将失败拆分为工具选择错误与参数错误,分别测试智能体的工具调用能力。
    https://openrouter.ai/blog/tutorials/how-to-test-tool-calling-accuracy-in-ai-agents/

  5. vLLM 分离式推理(Disaggregated Serving)实用指南 — vLLM 官方博客(RSS)
    指南介绍 vLLM v0.30.0 及以上版本中 prefill/decode 分离、无 GPU render 前端及其组合方案。
    https://vllm.ai/blog/2026-09-29-disaggregated-serving-guide

快讯

评论