跳到主要内容

AI 日报 · 2026-09-16:Gemini 3.8 实时语音发布,Perplexity 自研数据库年省 1 亿美元

gusi

模型发布/更新

  1. Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking — Google DeepMind:Blog
    Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。
    https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking

  2. 生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频 — 公众号:生数科技
    生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。
    https://mp.weixin.qq.com/s?__biz=MzkzMDQ5NTQwMQ%3D%3D&mid=2247489246&idx=2&sn=b23b39da69f6c75594eccac11854111f

  3. 阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一 — 公众号:阶跃星辰
    阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。
    https://mp.weixin.qq.com/s?__biz=MzkyNTYxNzg5Mg%3D%3D&mid=2247488074&idx=1&sn=7d92ce0f0098ec0c53b243df4709b522

产品发布/更新

  1. Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言 — Google Blog
    Google 宣布其语言技术已支持超过 300 种语言、覆盖全球 86% 人口,并发布 TranslateGemma 轻量开源翻译模型(基于 Gemini 训练、支持 55 种语言、可离线运行)。
    https://blog.google/innovation-and-ai/technology/ai/ai-for-every-language

  2. Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划 — Claude Blog
    Anthropic 为 Claude for Small Business 新增 43 个工作流和 27 个集成,覆盖 Shopify、Salesforce、Stripe、Gusto 等,自 5 月上线以来安装量超 90 万次。工作流默认处于审批模式,高风险操作需用户确认。
    https://claude.com/blog/claude-for-small-business-launches-new-workflows-integrations-and-training-programs

行业动态

  1. Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元 — X:Aravind Srinivas
    Perplexity 宣布自研键值数据库 CobbleDB 替代 AWS DynamoDB 用于快速网页抓取,每年最多可节省一亿美元。该项目由 2 名工程师与数百个 Computer 智能体在两个月内完成,热存储批次读取延迟 P50 从 31.4ms 降至 5.60ms。
    https://x.com/AravSrinivas/status/2099957318935028173

技巧与观点

  1. Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂 — Pragmatic Engineer
    实地探访 OpenAI 总部并访谈七位工程师与工程负责人,Codex 和 ChatGPT Work 已成为公司几乎所有日常工作的基础设施。
    https://newsletter.pragmaticengineer.com/p/openai-software-factory

  2. Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,批评者质疑真实动机 — The Decoder
    Anthropic 呼吁行业与政府协调放缓前沿 AI 开发并寻求反垄断豁免,Sam Altman 与 Elon Musk 表示赞同,但 Cohere 等批评者对其真实动机表示质疑。
    https://the-decoder.com/not-everyone-is-convinced-that-big-ais-proposed-development-slowdown-is-really-about-safety

  3. 404 Media 曝光 OpenAI 莉莉计划:人工审核聊天记录优化模型 — IT之家
    OpenAI 内部代号莉莉计划(Project Lily)被曝光,由时薪超 50 美元的审核员查看匿名化真实聊天记录,评估回复切题度及消除 AI 谄媚套话。
    https://www.ithome.com/1/002/750.htm

  4. Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶 — X:Arena
    Arena 更新 Image-to-WebDev 榜单,GPT-6 Astra (Max) 以 1733 分位居榜首,领先 GPT-5.6 Sol 129 分;Claude Fable 5.1 排第二。
    https://x.com/arena/status/2099971741993050236

  5. Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index — X:Artificial Analysis
    在端到端语音评测中,OpenAI 的 GPT-Live-1 以 81.5 分夺冠,略高于 Grok Voice Think Fast 2.0 High 的 81.3。
    https://x.com/ArtificialAnlys/status/2099698254414029207

  6. Trail of Bits 批评 1Password AI 补丁基准存在误导 — Trail of Bits
    Trail of Bits 撰文指出 1Password 发布的 FLAWED 报告中 26% 的 AI 修复率因多项实验设计失真(包括 22% 故意诱导错误修复的提示词)。
    https://blog.trailofbits.com/2026/09/15/1passwords-ai-patching-benchmark-is-misleading

  7. Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人 — Tomer Tunguz 博客
    Vercel COO 表示公司 inbound 销售开发已实现 90% 自动化,年成本仅数千美元,团队规模从 10 人缩减至 1.25 人。
    https://tomtunguz.com/single-digit-thousand-dollar-ai-sdr

评论