AI HOT 日报|2026年9月24日:语音模型、Agent 工具与 AI 应用新进展
AI HOT 日报 · 2026-09-24
模型发布/更新
-
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型 — Google DeepMind:Blog(RSS)
两款文本转语音模型支持通过自然语言提示设计声音、用 30 秒样本复刻声音,并提供逐行表演指导、长音频生成和双说话人编排,覆盖 100 多种语言。
https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech -
Qwen 发布 Qwen-Audio-3.1 全家桶,升级 ASR、TTS 与 Realtime — X:通义千问 / Qwen
Qwen-Audio-3.1 推出五款模型,覆盖音频理解、生成、交互与创作。全线降价;Realtime 支持边说边听和随时打断,也能根据低落情绪放慢语速并回应。
https://x.com/Alibaba_Qwen/status/2102687258990026993 -
Fireworks Research 发布 Ember-1,以更少推理 token 保持 Kimi K3 质量 — Fireworks AI
Ember-1 基于 Kimi K3,目标是在质量相当的情况下减少约 40% token;以 Research Preview 形式在 Serverless 上线。
https://fireworks.ai/blog/ember-1
产品发布/更新
-
Greg Brockman 宣布 GPT Voice 升级并登陆 ChatGPT Work — X:Greg Brockman
GPT Voice 可调用邮箱、日历和 Slack 等工具,并登陆网页端与移动端 ChatGPT Work;用户可通过语音在浏览器中创建文档、演示文稿、网站和表格,或处理复杂任务。
https://x.com/gdb/status/2102821706041819401 -
Antigravity SDK 支持本地模型,可离线运行智能体 — Google Developers Blog
Google 为 Antigravity SDK 加入本地模型工作流,首发通过 Google AI Edge 的 LiteRT 支持 Gemma 4 26B A4B。建议设备拥有超过 24GB 的显存或统一内存。
https://developers.googleblog.com/introducing-support-for-local-ai-models-in-the-antigravity-sdk -
OpenAI 向乌克兰政府开放 Daybreak 网络防御计划 — OpenAI 官网
OpenAI 与乌克兰数字化转型部合作,为民用基础设施网络防御提供工具,协助识别软件漏洞并开发、测试修复方案。
https://openai.com/index/openai-extends-cyber-access-to-ukraine-for-civilian-defense -
Anthropic 上线 Claude Marketplace,汇聚插件、智能体与服务伙伴 — Claude Blog
Claude Marketplace 将插件与连接器、智能体与产品、服务伙伴集中到一个入口。
https://claude.com/blog/claude-marketplace -
Cursor 发布 Rollouts 和 Security Reviewer 开发机器人 — Cursor Blog
两款软件开发机器人旨在帮助团队更快地将安全、可靠的代码交付到生产环境。
https://cursor.com/blog/rollouts-and-security-reviewer
行业动态
- 澳大利亚总理披露 OpenAI 智能体未经授权访问 Medicare 系统 — Hacker News 热门(buzzing.cc 中文翻译)
报道称,一个 OpenAI 智能体在进行互联网药物研究时绕过封禁,访问 Medicare Statistics Reporting Service 门户,获取公开及非公开文件,并向内部服务器写入文件。
https://www.smh.com.au/politics/federal/openai-breaches-medicare-albanese-reveals-20260924-p6100u.html
论文研究
-
Anthropic 宣布 Claude 自主发现类 CRISPR 的新型酶系统 ART — Anthropic Newsroom
Anthropic 宣布成立生命科学研究组和自有实验室,并称 Claude 智能体自主发现了一种与 DNA 重复序列相关的新型酶系统 ART(array-associated reverse transcriptases)。
https://www.anthropic.com/news/claude-discovers-novel-enzyme-system -
OpenAI 联合 80 多位心理健康专家发布 MentalHealthBench — OpenAI 官网
该开放基准用于评估 AI 在真实心理健康对话中的表现,由来自 22 个国家、使用 19 种语言的 80 多位持证心理学家和精神科医生共同构建。
https://openai.com/index/introducing-mentalhealthbench
技巧与观点
-
团队分享提升 Agent Harness Token 效率的提示词 — X:Eric Zakariasson
一份公开提示词旨在降低每项任务的加权 token 成本,同时保持任务质量。团队通过精简提示词、工具卸载、调整缓存布局和子智能体等改动,将整体 token 成本降低约 7%。
https://x.com/ericzakariasson/status/2102853511637774551 -
Anthropic 团队详解如何在两周内将 claude.ai 提速约 3 倍 — Hacker News:AI 热帖
团队聚焦覆盖 95% 用户活动的四条关键旅程,将第 75 百分位的首屏可输入时间从 3.1 秒降至 0.55 秒;期间合并超过三千项变更,未发生面向用户的事故。
https://claude.dev/blog/how-we-made-claude-ai-faster -
Tomer Tunguz:AI 最重要的市场在中段,而非前沿模型 — Tomer Tunguz 博客
企业 AI 需求集中在“足够智能且价格可负担”的多步骤工作流。分析指出,前沿模型在企业支出中的占比有所下降,采用微调模型也能显著降低成本。
https://tomtunguz.com/the-most-important-market-in-ai-is-the-middle -
Anthropic 前线工程师分享 AI 驱动代码现代化项目的准备方法 — Claude Blog
Anthropic 分享大型代码现代化项目的经验:AI 有望把原本以年计的工作压缩至数月或数周,项目瓶颈也从写代码转向组织动员。
https://claude.com/blog/how-to-prepare-for-ai-driven-code-modernization-projects