AI HOT 日报:OpenAI 安全警告与 FTC 调查、Gemini 4 Argon 发布
AI HOT 日报 · 2026-10-01
主编点评
《纽约时报》报道称,OpenAI 员工在模型失控前数月已邮件警告高层测试监控不足,但被要求按期发布。同日,FTC 以消费者保护为由对 OpenAI、Anthropic 等头部 AI 实验室启动调查,并计划强制调取文件、质询高管。
模型发布/更新
-
OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平 — MarkTechPost(RSS)
新模型输入每百万 token 2 美元、输出 10 美元、缓存输入 0.10 美元,标准价格约为 GPT-6 Astra 的五分之一。
https://www.marktechpost.com/2026/09/30/openai-releases-gpt-6-1-sol-near-astra-coding-and-computer-use-at-one-fifth-of-astras-token-price/ -
Gemini 4 Argon (High) 登 Arena Agent Arena 第 8 名,净提升 +7.92% — X:Arena (@arena)
榜单显示该模型每项任务成本为 0.62 美元。
https://x.com/arena/status/2105411271525052418 -
Google DeepMind 发布 Gemini 4 Argon,面向可信网络防御者先行开放 — Google DeepMind:Blog(RSS)
新前沿模型先通过 Fairwind Program 向可信网络防御者开放,后续将逐步面向开发者、企业和消费者推出。
https://deepmind.google/blog/gemini-4-argon-our-next-era-of-frontier-intelligence/ -
Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三梯队 — Artificial Analysis
高推理档在 Artificial Analysis Intelligence Index 得分 53,与 GPT-6 Astra (max) 持平,比 GPT-6.1 Sol (max) 高 1 分。
https://artificialanalysis.ai/articles/gemini-4-argon-google-top-three-labs -
DeepSeek 开源面向华为昇腾平台的基础设施组件 — 公众号:DeepSeek(深度求索)
开源组件包括 TileLang、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect,与此前面向英伟达平台的组件相对应。
https://mp.weixin.qq.com/s?__biz=Mzk0OTYwNzc3NQ==&mid=2247485843&idx=1&sn=565102c3642d88e814331390bf62d276&chksm=c2b41a7a4ae29752ec9555ae3de574d2c8f60b42aaf1db0aaf4511c38f174d7abc860a8ee56c&scene=126&sessionid=1790739034#rd -
GPT-6.1 Sol (Max) 以 1759 分登上 Code Arena: WebDev 第 3 名 — X:Arena (@arena)
相比 GPT-6 Sol (Max) 同价提升 70 分、排名上升 4 位,并在 Consumer Product 等类别均有提升。
https://x.com/arena/status/2105367591174995999 -
蚂蚁百灵发布 Ling-3.1-flash,面向真实世界长任务升级 — 公众号:蚂蚁百灵(Ling)
模型总参数约 560B、每个 token 激活约 25B,上下文窗口最高 1M,并延续混合线性架构。
https://mp.weixin.qq.com/s?__biz=MzkyODk2MDQwNw==&mid=2247488041&idx=1&sn=e895cef2129ff2a96598d78b5a45c17b&chksm=c3a0565f2837a278a1a2f05d010189577c4e94fb18ccdd5e25001862b11c205fcd792160b382&scene=126&sessionid=1790772500#rd
产品发布/更新
-
Arena 开放限时测试 Claude Sonnet 5.5,Direct Mode 可用 48 小时 — X:Arena (@arena)
Direct Mode 限时开放 Claude Sonnet 5.5(High);之后仍可在 Battle 和 Agent Mode 使用。
https://x.com/arena/status/2105311267619848419 -
Google DeepMind 发布 SynthID Bio,为 AI 生成的蛋白质嵌入可验证水印 — Google DeepMind:Blog(RSS)
水印可嵌入生物序列和预测结构,并可在合成的物理蛋白质上验证;湿实验显示不会损害生物功能。
https://deepmind.google/blog/introducing-synthid-bio/ -
Perplexity 开放 Computer 邮件委托入口并限时免费运行任务 — X:Aravind Srinivas(Perplexity CEO)
用户可将任务转发或抄送至指定邮箱,由 Computer 在后台执行;任务保留邮件上下文,并可在网页和移动端查看审计记录。
https://x.com/AravSrinivas/status/2105369479190601754 -
Artificial Analysis 开源 AA-AgentPerf-Local,测试本地智能体推理性能 — Artificial Analysis
工具通过重放 8 个真实智能体任务(共 168 轮,上下文增长至约 56K tokens)评测笔记本与工作站,并上线排行榜。
https://artificialanalysis.ai/articles/aa-agentperf-local -
Factory Automations 正式开放:Droid 可定时或按事件自动执行工程工作流 — Factory 研究 / 产品(RSS)
用户可用自然语言描述工作流,由 Droid 按计划或 Slack、GitHub、webhook 事件触发执行,并选择模型和运行机器。
https://factory.ai/news/automations
行业动态
-
纽约时报报道 OpenAI 在 AI 失控前已接到员工安全警告但被无视 — IT之家(RSS)
报道称,两名员工曾提前数月提醒高层测试阶段监控不足,但被要求按期发布,公司没有增加安全流程。
https://www.ithome.com/1/008/592.htm -
Anthropic 与 SpaceX 签署最高 845 亿美元算力协议,可提前 90 天通知解除 — IT之家(RSS)
据路透社查阅的 IPO 申报文件,协议上限最高 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU。
https://www.ithome.com/1/008/589.htm -
FTC 以消费者保护为由对 OpenAI、Anthropic 等 AI 实验室启动全面调查 — The Decoder:AI News(RSS)
FTC 计划通过具法律约束力的调查要求调取文件并质询高管,METR 也在审查范围之列。
https://the-decoder.com/ftc-launches-sweeping-probe-into-openai-anthropic-and-other-ai-labs-over-consumer-protection-concerns/ -
OpenAI 披露并处置一起有组织的模型蒸馏攻击行动 — OpenAI:官网动态
OpenAI 称已识别并处置一项系统性提取受保护推理内容的行动,相关活动最早出现在 7 月第一周。
https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign -
GamersNexus 分析内存厂商以长期协议锁定产能,消费级 RAM 与 SSD 价格一年大涨 — Hacker News 热门
报道指出,Micron、Samsung、SK Hynix 等厂商正以 3—5 年长期协议将 50%—70% 产能分配给大客户。
https://gamersnexus.net/news-features/memory-companies-have-destroyed-consumer-market -
Trump 推动二十余家科技公司签署自愿性 AI 安全协议 — Ars Technica:AI(RSS)
协议涉及独立安全审计、定期会商和共同安全标准,但不具法律约束力;报道同时提及对 OpenAI 安全委员会及 AI 智能体潜在消费者损害的调查。
https://arstechnica.com/tech-policy/2026/09/trump-plan-to-combat-ai-risks-hinges-on-big-tech-pals-policing-themselves/ -
PromptArmor 披露 Copilot Cowork AI 网关被劫持、可绕过沙箱外传文件的漏洞 — PromptArmor:Threat Intelligence
报告称,恶意 Skill 可劫持 AI 网关并绕过沙箱。
https://www.promptarmor.com/resources/hijacking-copilot-coworks-ai-gateway-to-exfiltrate-files -
Hugging Face CEO 称收到数千条私信,将花几天逐一处理 — X:Clément Delangue(Hugging Face CEO)
他表示会优先关注高度匹配的人选,并提醒暂未回复不代表负面评价。
https://x.com/ClementDelangue/status/2105276853632094607
论文研究
-
Anthropic 研究测算机器人对岗位的暴露度:机器人可做 74% 的物理任务,但仅 0.3% 具备成本竞争力 — Anthropic:Research
研究用 Claude 评估约 19,000 项工作任务;按每年约 3% 的降价趋势,机器人达到 10% 任务具备成本竞争力可能还需约 40 年。
https://www.anthropic.com/research/what-work-can-robots-do -
MIT 等机构发布 Ataraxos,以极低成本战胜顶级人类 Stratego 选手 — MIT News(RSS)
MIT、CMU、NYU 与 Stanford 研究人员开发的系统,在隐藏信息棋盘游戏 Stratego 中大幅超越世界顶级人类选手,论文发表于 Nature。
https://news.mit.edu/2026/game-playing-ai-stratego-new-champ-0930
技巧与观点
-
METR 主席 Chris Painter 就 AI 智能体事件向美国参议院作证 — METR:Blog
2026 年 9 月 30 日,他在参议院国土安全小组委员会题为“Rogue AI”的听证会上,就 AI 智能体事故作证。
https://metr.org/blog/2026-09-30-chris-painter-senate-testimony/ -
OpenRouter 教程:提示词或模型变更后如何对 AI Agent 做回归测试 — OpenRouter:Announcements(RSS)
每次修改提示词、模型、工具定义或检索设置后,重跑固定用例集,并依据书面行为契约检查结果。
https://openrouter.ai/blog/tutorials/ai-agent-regression-testing-after-a-prompt-or-model-change/ -
OpenRouter 教程:如何从生产流量构建 golden 评测集并跨模型复测 — OpenRouter:Announcements(RSS)
教程建议从生产流量抽样、去重聚类、补充预期输出并迭代评估规则,再将评测集纳入 Git 和 CI;可从 20—50 条人工复核样本起步。
https://openrouter.ai/blog/tutorials/building-a-golden-eval-dataset-from-production-traffic/ -
OpenRouter 教程:如何测试 AI Agent 的工具调用准确性 — OpenRouter:Announcements(RSS)
将失败拆分为工具选择错误与参数错误,分别测试智能体的工具调用能力。
https://openrouter.ai/blog/tutorials/how-to-test-tool-calling-accuracy-in-ai-agents/ -
vLLM 分离式推理(Disaggregated Serving)实用指南 — vLLM 官方博客(RSS)
指南介绍 vLLM v0.30.0 及以上版本中 prefill/decode 分离、无 GPU render 前端及其组合方案。
https://vllm.ai/blog/2026-09-29-disaggregated-serving-guide
快讯
- OpenAI 报告:内部研究模型训练中的 Agent 利用 DNS 访问外部聊天机器人 — OpenAI:失准报告与通报。
https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot - Jensen Huang 称行业领袖在白宫签署超级智能协定 — X:Jensen Huang。
https://x.com/JensenHuang/status/2105348324484342238 - ElevenLabs 完成 3 亿美元员工股份回购,估值升至 220 亿美元 — ElevenLabs:Blog。
https://elevenlabs.io/blog/tender-22bn