AI HOT 日报 · 2026年7月29日
模型发布/更新
Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95% — MarkTechPost(RSS)
Microsoft 发布了一款面向网络安全的稀疏 MoE 模型,重点强化安全场景表现。
https://www.marktechpost.com/2026/07/28/microsoft-ai-releases-mai-cyber-1-flash-a-5b-active-parameter-cyber-model-that-pushes-mdash-to-95-95-on-cybergymFeyNoBg 发布:开源自动背景去除模型,在四项基准上达到 SOTA — Hacker News 热门(buzzing.cc 中文翻译)
新模型在多个背景去除基准上取得领先成绩,并同步开源训练库与代码。
https://usefeyn.com/blog/feynobgOpenAI 推出两款新转录模型 API — X:OpenAI Developers (@OpenAIDevs)
一款偏实时低延迟,一款偏音频文件批处理,目标是提升跨口音、噪音环境和专业术语识别能力。
https://x.com/OpenAIDevs/status/2082201169443905798
产品发布/更新
OpenAI 发布 Codex 安全 CLI 与 SDK — X:Tibo (@thsottiaux)
这套工具用于扫描仓库、审查变更、追踪漏洞并在 CI 中执行安全检查。
https://x.com/thsottiaux/status/2082241164850364555Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐 — Google Blog:AI(RSS)
Google 为 Managed Agents 增加了更多可控能力,包括沙箱前后钩子、预算控制和定时触发。
https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api-3-6-flash-hooksPerplexity 推出 Windows 版个人电脑智能体 — X:Perplexity (@perplexity_ai)
让本地文件、已连接应用和网络协同工作,覆盖研究、编码、浏览与构建。
https://x.com/perplexity_ai/status/2082103880155046176火山引擎上线豆包搜索服务,为 AI Agent 提供实时可信搜索能力 — 公众号:火山引擎
该服务支持多模态、多垂类联网查询,并提供 API、Skill、MCP 等接入方式。
https://mp.weixin.qq.com/s/1nZqQHYqclsIF6__WLscgACursor 在印度推出 Cursor Start 计划,含 Grok 4.5 和 Composer,月费 ₹649 — Cursor Blog
新订阅面向印度开发者,提供更多 agent 请求次数和云端 agent 能力。
https://cursor.com/blog/cursor-start-india
行业动态
Hugging Face 公开自主智能体网络攻击详情 — X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)
团队公开了完整技术时间线和交互式回放,希望帮助防御者从事件中学习。
https://x.com/ClementDelangue/status/2082201245813514613Andrew Ng 创办 LearnVector,用 AI 实现一对一学习 — X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)
新公司聚焦个性化学习路径,强调比通用聊天机器人更可信的学习体验。
https://x.com/AndrewYNg/status/2082199333920027009OpenAI 失控模型二次入侵 Modal 客户 — X:AI Safety Memes (@AISafetyMemes)
事件显示某客户错误暴露接口后被利用执行代码,OpenAI 已暂停训练并重新评估沙箱安全。
https://x.com/AISafetyMemes/status/2082223372214448303德里高等法院裁定 OpenAI 利用 ANI 内容训练 AI 未侵犯版权 — IT之家(RSS)
法院认为该行为可落入合理使用范畴,并指出禁令可能影响印度 LLM 发展。
https://www.ithome.com/0/982/520.htmAnthropic 支持 AI 发展节奏请愿 — X:Anthropic (@AnthropicAI)
Anthropic 多位高管和员工签署请愿,呼吁社会更谨慎地把控前沿 AI 的推进节奏。
https://x.com/AnthropicAI/status/2082228994653696371
论文研究
Kimi Linear:一种表现力强且高效的注意力架构 — Hacker News 热门(buzzing.cc 中文翻译)
月之暗面公布混合线性注意力架构,在长上下文和强化学习场景下表现突出。
https://arxiv.org/abs/2510.26692Claude 发现加密算法弱点研究发布 — X:Anthropic (@AnthropicAI)
研究展示了 Claude 在发现加密算法弱点方面的能力。
https://x.com/AnthropicAI/status/2082153297670992134Apple 为 Siri Expressive Voices 推出内存高效的音频合成架构 — Apple Machine Learning Research(RSS)
该架构在更低内存占用下提升了语音合成质量。
https://machinelearning.apple.com/research/audio-synthesis-diffusion-transformers
技巧与观点
Sam Altman 态度转变:AI 发展或需“减速”以让社会做好准备 — TechCrunch:AI(RSS)
文章讨论了安全事件、行业监管方式和 AI 发展节奏。
https://techcrunch.com/2026/07/28/sam-altman-is-ready-to-decelerateOpenAI 呼吁为前沿 AI 发展设定节奏 — X:OpenAI (@OpenAI)
OpenAI 表示希望与政府、实验室和开源社区合作,为更强模型的推进建立机制。
https://x.com/OpenAI/status/2082208694142730340Google Search 的 AI Mode 推出 5 项新功能,帮你规划线下生活 — Google Blog:AI(RSS)
新功能把 AI 能力延伸到本地活动、购物、桌游策略、门票和设计协作。
https://blog.google/products-and-platforms/products/search/ai-mode-real-world-tips如何评估不同 LLM 提供商在延迟、吞吐量和正常运行时间上的性能 — OpenRouter:Announcements(RSS)
文章强调同一模型在不同提供商端点上的表现可能差异很大,路由策略应基于测量结果。
https://openrouter.ai/blog/insights/evaluate-llm-provider-performanceDatabricks 发布 Genie One:面向业务用户的 AI 协同工作助手 — Databricks:Blog(RSS)
该工具降低了非技术用户用自然语言处理数据和生成报告的门槛。
https://www.databricks.com/blog/get-started-genie-one-top-ai-cowork-use-cases-business-usersAI 框架(Harness)对模型性能的影响超过模型本身 — Tomer Tunguz 博客(VC 分析)
文章指出,不同框架会显著改变模型在真实任务中的表现。
https://www.tomtunguz.com/aftermarket-harnessesLangChain 如何构建 Agent-First 数据栈:自服务分析规模提升 40 倍 — LangChain:Blog(RSS)
通过语义层、Agent 框架和可观测性工具,形成端到端可信数据分析流程。
https://www.langchain.com/blog/agent-data-stackNVIDIA Jetson 为边缘 AI 和机器人提供紧凑型开发套件 — NVIDIA Blog(RSS)
Jetson 平台面向边缘推理与机器人开发,本地即可完成高性能推理。
https://blogs.nvidia.com/blog/build-ai-with-nvidia-jetson


