每日AI资讯 2026-08-22
AI 行业动态:推理提速 14 倍,芯片采购与巨头重组并行
OpenAI 推出 Ultrafast 极速推理模式。 8 月 21 日,OpenAI 宣布 GPT-5.6 Sol 在 Ultrafast 模式下输出速度达到 750 tokens/s,约为常规模式的 14 倍(53 → 750 tokens/s)。提速秘密藏在硬件里:由 Cerebras Systems 的 WSE-3 晶圆级引擎驱动——整片晶圆做成一颗芯片,专为推理优化。目前仅面向 API 预览,主打语音 AI、实时智能体等低延迟场景。750 tokens/s 意味着:实时对话的"响应感"会发生质变,AI 说话比人还快。
谷歌与 Marvell 达成 122 亿美元芯片"对赌"。 谷歌将以每股 206.58 美元认购 Marvell 约 5897 万股(合计约 122 亿美元),前提是 Marvell 达成收入目标。这笔钱直接绑定 TPU 生态的定制硅开发,谷歌想用"股权绑定"锁住定制芯片产能、降低供应链依赖。AI 芯片竞争已经升级:从"抢现货芯片"到"抢定制芯片代工厂"。
首批英伟达 Vera Rubin 机架已为 OpenAI 训练堆栈供能。 OpenAI CTO 在 X 上晒出首批 Vera Rubin 机架到货、训练堆栈已开始运行。SpaceX 也宣布基于该平台构建 AI 基础设施,据称锁定了下一代平台约 20% 产能——AMD 因此失去一位旗舰客户,尽管其数据中心收入同比增 107%,股价仍跌近 14%。新芯片平台正式进入头部大模型公司的生产环境,下一代预训练竞赛进入"换引擎"阶段。
阿里宣布重大战略重组。 与 2027 财年 Q1 财报同日官宣:将电商、云计算、芯片与 AI 模型整合为三大板块——云智能集团与平头哥合并为"AI 云与算力服务",千问相关业务并入"AI 实验室及应用"。本季营收 2689.5 亿元(+9%),但调整后 EBITA 同比降 30%,技术投入明显加大;AI 实验室板块经调整亏损 138.61 亿元、同比扩大 330%——典型的"亏损换增长"押注。亮点:阿里云外部收入 +45%,AI 相关产品收入连续 12 个季度三位数增长,自研芯片真武 M890 已覆盖超 650 家外部客户。
Claude 全球宕机,Fable 5.1 测试版意外泄露。 8 月 21 日 Claude Web 与 Code 服务全球范围宕机,据称与下一代模型 Fable 5.1 测试版的部署异常有关,未发布功能疑似提前曝光。一场宕机把"版本管理翻车"演成了发布会——AI 服务商的灰度发布(先小范围放量再全量)能力,越来越成为基本功。
注释:tokens/s(每秒生成 token 数,AI 的"语速");晶圆级引擎(wafer-scale,整片晶圆做一颗芯片);TPU(谷歌自研 AI 芯片);EBITA(税息折旧摊销前利润);灰度发布(分批次放量,降低风险)。
AI 论文速览:把你的"思考过程"偷走——加密推理被攻破
本周引爆社区的论文:《Stealing Reasoning Traces from Proprietary LLM APIs》(arXiv:2608.09867,116 页,8 月 10-11 日发布),Anthropic、OpenAI、Google 三家巨头为此紧急打补丁。
它讲的是什么? 现在的推理模型回答前会先生成一段"思维链"(Chain-of-Thought,内部推理步骤)。厂商为了保护这些思考过程不被竞争对手蒸馏走(拿输出训练自家模型),把思维链放进加密块(机密计算/confidential computing)里再返回给用户。这篇论文发现了一个架构级漏洞:这些加密块与推理轨迹完全兼容,可以被完整窃取。
- 研究者收集 6708 条公开轨迹,重建出 315320 个思考块
- 标注后发现:1028 个思考块包含真实隐私信息(约 0.3%),328 个会话出现泄漏(4.9%)——"思考过程"里藏着用户没说过的话
- 三大厂商力推的"安全防线"机密计算,形同虚设
它有什么用?
- 安全警示:加密推理保护不了思维链,隐私与蒸馏防护都得重新设计
- 数据金矿:思维链是训练高质量推理模型的核心燃料,"偷思维链"≈ 免费拿到顶级模型的推理方法,小模型有望靠蒸馏快速变强——这正是厂商最怕的
- 行业影响:三巨头同一天打补丁,说明架构级漏洞不是打几个补丁能根治的
注释:思维链(CoT,Chain-of-Thought,模型"先想后答"的中间步骤);蒸馏(distillation,用大模型输出训练小模型);机密计算(confidential computing,在加密环境里处理数据)。
AI 工具技巧:让 AI"开口说思路"——思维链的正确用法
正好接着上面的论文聊:既然厂商拼命加密这段"思考",说明它真的很值钱。**思维链(CoT)**是这几年来最实用的提示技巧之一——把"先想后答"写进提示词,复杂任务的准确率会明显提升。
一个可直接套用的模板:
请一步一步思考,并把推理过程写出来,最后再给出结论。
- 第一步:列出我需求里的关键信息
- 第二步:分析可能的方案,比较各自优缺点
- 第三步:选出最优方案,并说明理由
- 最后:给出结论和可执行的下一步
我的问题:……
四个要点:
- 明确要求"分步思考":"请一步步思考"远比"请认真思考"有效
- 给思考结构:告诉 AI 先分析什么、再比较什么,比让它自由发挥更稳
- 结论放最后:要求"先过程、后结论",方便你核对推理有没有漏洞
- 控长度:长文档/代码场景可加一句"思考过程不超过 100 字",避免刷屏
适用场景:数学逻辑题、代码调试、方案决策,以及一切"怕 AI 直接给错误答案"的任务。简单问题(闲聊、翻译)就别开了——杀鸡不用牛刀,还能省 token。
注释:token(文本的最小处理单位);CoT(Chain-of-Thought)。
GitHub AI Skill:agency-agents —— 给 AI 装上"职业人格"
近期 GitHub 爆火的仓库:msitarzewski/agency-agents(总星标超 14.4 万,8 月中旬仍保持日增近 2000 星)。它提供一套完整的 AI Agent 人格(persona)库:代码审查员、安全审计员、数据分析师、DevOps 工程师、产品经理、技术写作……每个角色都配有精心设计的系统提示词、行为准则与专业工具集。
它做什么?安装后,一行命令就能让 AI 助手以指定"人格"上岗:
claude --persona code-reviewer # 以"代码审查员"人格启动
为什么有趣?
- 人格即技能:告别每次手写大段角色提示词,一个名字召唤一位"专家"
- 内行视角:每个角色内置该领域的审查清单与行为准则,比"你扮演一个……"专业一个档次
- 生态信号:14.4 万星说明"给 Agent 装人格"正成为标配玩法
适合人群:经常让 AI 做代码审查、安全审计、数据分析的开发者;想让 AI 输出更"专业"的团队。
注释:persona(人格/角色);系统提示词(system prompt,约束 AI 行为的基础指令);Skill(技能包,给 Agent 预装的专业能力)。
AI Agent 动态
阿里发布 Qwen-UI-Agent:面向真实世界的 GUI 操作智能体,覆盖手机、电脑、网页与深度搜索环境,让 Agent 像人一样"看屏幕、点按钮"完成跨端任务。GUI 智能体(图形界面操作)成为 8 月最热的方向。