AI 每日简报禾维 AI11 分钟阅读

AI 每日简报|最新 AI 工具该用来做什么|2026.09.11

本期聚焦 AI 行业的语音交互、成本优化与垂直化趋势:OpenAI 发布 GPT Live 1,微软扩大数据中心布局,Anthropic 揭露模型蒸馏攻击,Cognition、DeepSeek 和 Cursor 推出更高性价比的开发工具。

有时,一次发布的重要性在于它能让你做什么;有时,则在于它预示着不久之后我们所有人都会做什么。

本周第二波产品发布指向两个明确趋势:我们将通过语音管理更多计算机交互,而模型技术栈也越来越重视成本和“够用”的能力,而不是单纯追求前沿性能。NLW 的实用建议是:现在就开始把工作流程转向语音,并关注那些理解特定人群实际工作方式的垂直化工具——因为无论如何,这正是整个行业正在推动所有人走向的方向。


数据速览

  • 30万 — Moonshot 在 10 天内转发给 Anthropic 的客户请求,其中大部分发往 Opus
  • 0.05 美元/分钟 — OpenAI GPT Live 1 在 API 中的音频价格
  • 38GW — 微软到 2032 年的全球数据中心容量目标,高于目前的 12GW
  • 70% — NVIDIA CEO 黄仁勋表示,供应能力让他有信心交付的增长比例
  • 850万美元 — 黄仁勋所说的一套通过 NVLink 连接的 NVIDIA GPU 系统成本
  • 480亿美元 — Cognition 在融资 20 亿美元并保持独立后达到的估值
  • 64% — Cognition 的 SWE-2 相较同类前沿代码模型的成本降低幅度
  • 6 倍 — Cursor Projects 测试者合并的 PR 数量增幅

头条

Anthropic 称已阻断来自阿里巴巴、DeepSeek 和小米的蒸馏攻击

Anthropic 发布的一份新滥用报告,详细说明了一些欺诈账户网络如何从 Claude 模型中提取推理轨迹,并将其用于训练数据。该报告有意聚焦于最值得关注、最具新颖性的威胁,而不是典型的滥用案例。

据称 Moonshot 将 30 万条用户查询转发给 Claude

Anthropic 声称,DeepSeek 和 Kimi K3 Meeker(Moonshot)将请求路由至 Claude,再把回复提供给自己的用户——在 10 天内,Moonshot 转发了近 30 万条请求,其中大部分发往 Opus。Anthropic 认为,这并不是在伪造能力,而是在为蒸馏流程收集真实查询;这一过程曾多次暴露中国政府和企业的敏感数据。

Anthropic 的分类器阻止了一项功能获得性研究资助申请

今年 5 月,一个分类器阻止了一项资助申请相关工作。该申请旨在识别能够增强基孔肯雅病毒的突变,并在活体动物中筛选毒力。由于研究面向一家军事研究机构,Anthropic 将其标记为可能具有恶意,尽管该公司也指出,这类研究可以用于无害的疫苗开发。

奥尔特曼告诉员工,他愿意放缓 AI 发展

在一次全员会议上,萨姆·奥尔特曼表示,OpenAI 可以放慢新模型的开发节奏,并可能与其他实验室协调行动,但他担心并非所有竞争对手都会同意。这似乎是奥尔特曼首次释放愿意放缓发展的信号,此前 OpenAI 首席科学家雅库布·帕乔茨基曾呼吁自愿放缓,保罗·克里斯蒂亚诺也加入了 OpenAI 董事会。

对我来说,这是迄今为止最有力的紧迫性证据。

— OpenAI CEO 萨姆·奥尔特曼 奥尔特曼是在 OpenAI 据报找到一道千禧年大奖难题的解法后发表上述言论的。他还表示,自己没想到这么快就会出现如此量级的成果,而如今世界已经拥有能力极强的模型。

OpenAI 遭遇算力瓶颈,暂停 200 美元 Pro 订阅

GPT-6 Astra 发布后带来了前所未有的需求,OpenAI 暂停了新的 200 美元 Pro 方案订阅——这是保护现有用户服务的最小措施。其他所有方案和 API 仍可正常使用。正如 Matt Schumer 所说:“补贴代币的时代正在结束。请做好相应准备。”

微软计划到 2032 年将数据中心容量增至 38GW

微软曾是最保守的超大规模云服务商,并在 2025 年初取消过部分租约;如今它将全球容量目标提高到 38GW,高于目前的 12GW。其中 AI 所占比例将增至三分之一,同时还会增加 CPU,以支持智能体工作流。NLW 的看法是:AI 基础设施远未过度建设,预计至少还会有五年较高水平的资本支出。

尽管我们的需求远高于 70%,但供应能力让我们有信心交付 70%。

— NVIDIA CEO 黄仁勋 黄仁勋在高盛会议上重申了增长预测,并指出这是他一年来首次讨论未来预期。他强调,如今一套 GPU 系统的价格已经达到 850 万美元——包含 200 万个部件,并通过 NVLink 连接——而机架级订单正以每月 27% 的速度增长。

美国司法部调查 NVIDIA 与 Groq 的 200 亿美元交易

美国司法部正在调查 NVIDIA 与 Groq 达成的非独家授权协议是否旨在规避反垄断审查。该交易还促成 Groq CEO 和 COO 加入 NVIDIA。此前,参议员曾将这波类似“收购式招募”的交易(Google/Character、Google/Windsurf、Meta/Scale)称为旨在绕过审查的“事实上的合并”。

Meta 的 Muse 智能体更受华尔街认可,而非用户认可

Muse 上线首日获得 8.3 万次 iOS 下载——对 Meta 来说并不算多(Threads 曾达到 430 万次),但足以排在 App Store 第二位。更重要的信号来自华尔街:Meta 股价上涨 6%,摩根大通将其评级上调至“买入”,认为 Meta 约 40 亿用户构成了决定性的分发优势。

主要内容

OpenAI 将 GPT Live 1 推向 API

这一全双工语音模型可以同时进行对话和聆听,能够应对嘈杂环境与打断,还能将任务交给后端推理模型——演示中,它在对话过程中控制了机器人和显示屏。音频价格为每分钟 5 美分,后端模型则按标准 API 价格计费。

现在就开始转向语音——反正行业也在把你推向那里

NLW 认为,从打字转向说话是一场代际变革,而过去主要是被 Siri 等原生语音识别工具糟糕的表现拖慢了。除了联络中心和漏接电话服务企业等显而易见的应用,他还看好 B2B 销售线索接入(在演示前先通过对话了解需求)、语言学习、辅导,以及工作互动模拟等领域。

Cognition 发布 Devin Voice:“你说出来,Devin 就交付”

Devin Voice 使用 GPT Live 作为语音层,后端则采用 Cognition 的新模型 SWE-2,让可打断、自然的语音成为一种一等公民式的编程方式。Cognition 的 Nader Dabit 表示,他如今日常工作中有 90% 都通过语音完成。

NLW 的实用语音建议:设置 Whisper Flow,然后出去走走

即使不使用 Devin,NLW 也恳请听众有意识地转向语音——可以使用 ChatGPT 的原生语音功能,也可以在电脑上使用 Whisper Flow 之类的工具。他认为,这样能提高速度,让你在做其他事情(比如散步)的同时完成更多工作。

Cognition 的 SWE-2 展示了“够用”能力已经走了多远

SWE-2 是 Kimi K3 的后训练版本,完全针对编程进行了优化,在 Frontier Code 1.1 上取得了 50% 的成绩,接近前沿水平,同时成本降低了 64%,甚至比 SWE-1.7 更便宜。用户还可以通过调整工作量级别进一步降低成本;对于构建模型技术栈的团队来说,它可以让模型能力与实际需求相匹配,从而控制成本。

DeepSeek V4.1 Flash 以四分之一的成本击败自家 Pro 模型

这款拥有 5520 亿参数的模型定价处于市场最低水平(输入每百万 token 0.30 美元,输出每百万 token 1.20 美元)。根据 Artificial Analysis 的数据,它在智能指数上超过了 DeepSeek 的全尺寸 Pro,成本却只有四分之一。NLW 认为,它适合那些需要构建完整架构、任务基础但高度重复且计算密集的团队。

OpenAI 推出小型企业插件合集

这套工具包为 ChatGPT 中的中小企业用户收集了 Dropbox、HubSpot、Canva、Figma、Shopify、DocuSign、PayPal、QuickBooks、Stripe、Gusto、Slack 等常用工具。正如一位评论者所指出的,第一代插件只是藏在聊天框后的 API 包装器;在智能体时代,智能体可以运行完整工作流,不过分发问题仍未解决。

ChatGPT 金融版内置高级数据源

该产品已针对 GPT-6 更新,并运行在 ChatGPT Work 中,整合了数据连接器和技能(DeLupa、LSEG News、Crunchbase),让分析师无需设置 MCP 即可使用,同时提供企业级安全与治理能力。它与摩根士丹利和 Evercore 合作构建,面向金融模型、研究和客户材料;副总裁 Nick Turley 表示,它经过训练,能够“像分析师一样研究,并像分析师一样为结论提供依据”。

金融 AI 是初级银行家的强力工具,而不是替代者

NLW 认为,资深银行家不会仅仅因为智能体变得更强,就亲自构建模型和演示文稿——责任承担与反复迭代仍然落在初级员工身上。真正值得关注的是,像 UBS 这样的公司如今已经要求应聘初级银行家展示 AI 熟练度,将其作为招聘条件。

OpenAI 新数据智能体让你可以与专有数据对话

面向 ChatGPT Work 的这一智能体可以连接 Redshift、Datadog、BigQuery、ClickHouse、Databricks、MongoDB 和 Snowflake,摄取数据,并围绕转化率、留存率等指标生成洞察,无需额外工具。Tableau 集成则把可信的业务语义带入员工已经在使用的工作环境。

OpenAI 真正的趋势:理解特定人群工作方式的垂直化

综合来看,OpenAI 的这些更新正聚焦于特定业务用户,把他们所需的工具和上下文连接起来,让工作流程迁移到 ChatGPT 中变得更容易、更有吸引力。这是整个行业的共同趋势——GrokBot 也为销售团队新增了 Salesforce、HubSpot、Gong、Clay 和 Granola 的原生集成。

Cursor Projects 将文件夹变成持久化项目架构

Projects 不仅用于积累上下文,还包含计划任务、长期运行的智能体和编排能力——它提供一个持久化的协调线程,负责规划并将任务分派给子智能体,而不是让每次会话结束后一切归零。测试者合并的 PR 数量增加了 6 倍,合并率提高了 30%;这种持久线程模式对非开发者同样具有重要意义。

单线程模式兴起:上下文压缩已经足够好,可以一直运行下去

NLW 指出,曾困扰 2025 年工作流程的上下文窗口交接问题已经大幅缓解。Block 的 Kensar 描述了这样的线程:它们可以构建完整的同步协议,并跨多个代码仓库部署,同时不会中断。NLW 表示,AI Daily Brief 网站的所有工作都放在一个长期运行的线程中,而且从未遇到上下文问题。