每日AI资讯 2026-09-22
一、AI 行业动态
1. OpenAI 成立数学与AI顾问组:神秘模型 24 天攻破 100+ 道开放难题(09-22)
OpenAI 宣布成立"数学与AI顾问组",这是设在普林斯顿高等研究院的独立咨询机构。公告同时披露:自 8 月 28 日开始训练的一个内部神秘模型,已成功解决超过 100 个长期开放的数学问题,并发调用约一万个 Agent、借助 Lean 定理证明器完成形式化验证。值得注意的是,该顾问组的职责范围明确排除了"限速"——即不会对模型研发节奏设限。数学界对此忧虑加深:批量自动化正在威胁年轻研究者的生计空间。
注释:形式化验证 用数学方法一步步严格证明每一步推理都无漏洞,而不是靠"看起来对"。Lean 是流行的证明辅助工具,机器写的证明必须通过它检验才算数。
2. 云栖大会开幕:吴泳铭宣布 2032 年数据中心超 20GW,平头哥发布真武V900(09-22)
2026 杭州云栖大会今日开幕,英伟达位列巅峰合作伙伴。阿里巴巴 CEO 吴泳铭在主论坛宣布:客户 AI 需求非常强劲,阿里将全力投入 AI 基础设施建设,目标 2032 年阿里云全球数据中心规模超 20GW。当天平头哥发布最强国产 AI 芯片真武V900,算力达上代真武M890 的 3 倍,平头哥 AI 芯片年出货量将大幅提升。模型、芯片、云"三大基石"全部亮牌,阿里把 AI 基建的牌桌直接摆到了云栖现场。
3. Plugin4Shell:AI 编程生态首个重大供应链漏洞,四大智能体沦陷(09-22)
安全公司 AIR 披露的 Plugin4Shell 零点击远程代码执行漏洞持续发酵:Claude Code、OpenAI Codex、GitHub Copilot、Gemini CLI 四大 AI 编程智能体全部受影响——攻击者可绕过插件市场的 SHA 校验机制,在你安装插件的瞬间静默执行任意代码。修复状态三档分化:Anthropic(Claude Code 2.1.179)与 OpenAI(Codex 0.146.0)已发补丁,微软 Copilot 暂无补丁,谷歌则直接弃用 Gemini CLI 相关机制。研究人员称这是"AI 代理生态首个重大供应链漏洞"。
注释:零点击 RCE 无需用户任何点击确认即可远程执行恶意代码;SHA 校验是给文件算"指纹"防篡改的机制,此漏洞恰好能伪造指纹。
4. Grok 4.7 发布:速度翻倍、价格砍半,主打编程与知识工作(09-22)
马斯克旗下 xAI 正式发布 Grok 4.7,定位公司史上最强编码与知识处理模型:CursorBench 46.3%、Terminal Bench 38.0%,较 Grok 4.6 分别提升 6 和 18 个百分点;API 定价每百万 token 输入 2 美元、输出 6 美元,约为竞品一半,官方称速度达同类模型两倍。不过 3D 任务表现低于此前宣传预期,"吹牛成分"受到质疑。此前预告的 2.5 万亿参数 Grok 4.8 仍在训练中,4.7 属于"先交作业"。
5. OpenRouter 格局逆转:DeepSeek 25.4% 份额登顶,中国模型前十占七席(09-22)
日经转引 AI 模型路由平台 OpenRouter 数据:一年前美国模型占平台 Token 调用量约 80%、中国不足 20%;如今 DeepSeek 以 25.4% 份额升至全球第一,中国厂商整体份额超 45%,前十榜单占据七席(腾讯混元 Hy4 Preview 第2、智谱 GLM-5.3 Flash 第3、DeepSeek V4 Flash 第4)。中国大模型周调用量已连续 20 周全球第一,DoorDash、Airbnb 等美国企业开始把底层模型切换为中国模型——价格战的尽头,是流量版图的重画。
二、AI 新元素
1. 星环科技登陆港股:企业级 AI 基础设施第一股,募资 8.55 亿港元(09-21)
星环科技 9 月 21 日在港交所主板挂牌,发行价 61 港元,募资约 8.55 亿港元。公司从事企业级 AI 和大数据基础软件,客户覆盖金融、政府、能源等行业。
它怎么赚钱? 星环科技做的是"数据底座"生意:把分布式存储、大数据平台、AI 开发平台打包成企业级软件,卖给金融、政府、能源等大客户,靠软件授权+订阅服务收费。创始人孙元浩曾是英特尔亚太研发高管,创业十余年主攻国产基础软件替代。上游对接芯片与开源社区,下游是付得起钱的大 B 客户——这类生意慢热但粘性极强:数据底座一旦建好,客户迁移成本极高。上市前公司仍处亏损期,募资主要投向 AI 基础设施软件研发,赌的是国产替代与企业 AI 落地的长周期。(约 230 字)
2. 超聚变发布桌面 AI 超算 FusionXpark M:把机房塞进办公桌(09-21)
超聚变在郑州 2026 国际探索者大会上发布 FusionXpark M 系列桌面 AI 超级计算机,这是其更新招股书后的首次重大公开活动。财务数据显示,超聚变 2026 上半年 AI 服务器收入 198.52 亿元,占主营收入比例从 50.91% 升至 53.29%,净利润约为去年全年两倍。桌面超算瞄准的是数据不能出域的政企研发场景——模型可以本地跑,机房不用建。
3. 快看漫画内测 Livo:AI"仿生世界",角色在你离线时继续生活(09-21)
快看漫画推出 AI"仿生世界"产品 Livo 开启内测,核心创新在于角色拥有独立人格、记忆和自主行为逻辑——用户离线后世界仍持续运转,角色会自己经历事件、积累记忆。这代表 AI 产品从"生成互动内容"向"生成持续存在的世界"跨越:内容不再等你来消费,而是自己在生长。二次元社区做 AI 世界模拟,用户底盘与情感付费习惯是天然优势。
4. 阿里云百炼语音模型降价:语音交互卷入价格战(09-22)
阿里云宣布自 9 月 22 日 00:00 起,下调百炼平台国内站语音系列模型价格,涉及 Qwen-Audio-3.0-Realtime 等多款语音模型。语音是 AI 应用的下一波入口:实时语音对话、语音 Agent、播客生成都在起量,但实时推理成本一直偏高。此前 DeepSeek 把文本推理价格打到地板,如今语音也开始跟进——全模态的"Token 平价时代"正在到来。
5. GOAI 世界人工智能开源大赛总决赛开战:12279 支队伍的终极对决(09-22)
世界人工智能开源大赛(GOAI)总决赛 9 月 22-23 日在杭州云谷中心举行:赛事自 7 月启动以来吸引全球 90 余个国家和地区 12279 支队伍、超 1.4 万名开发者参与,70 支顶尖团队从近 3000 份初赛作品中脱颖而出,角逐"新智基座、无界应用、前沿探索、具身未来"四大赛道冠军及百万全场大奖。与云栖大会同城同期举办,杭州本周成了全球 AI 开源的中心会场。
三、X 大 V 动态(近 30 天精选)
1. 陶哲轩(菲尔兹奖得主):不依附大厂,启动"开放数学模型计划"(09-18)
继 9 月 11 日联合 25 位菲尔兹奖得主发表《人工智能在数学中的严重错位》声明后,陶哲轩在自己的博客宣布:由他参与创立的 SAIR 基金会正式启动"开放数学模型计划"(Open Math Model Initiative),联合数学界与科研机构研发面向数学及基础科学的开源、开放权重模型。声明的矛头指向 AI 公司"把求解数学难题当基准测试竞赛"的急功近利,而开放计划则是建设性的回应——数学界不再只做批评者,而是亲自下场做自己的 AI。今天 OpenAI 成立数学顾问组,恰好接住了这份压力。
2. Yann LeCun(Meta 首席 AI 科学家):用三段工程史给"LLM 不会通向人类级 AI"加限定(09-20)
LeCun 在 Hinton 谈生存风险的旧帖线程下连发十条帖文,用蒸汽车、活塞机、火箭三段工程史为他的核心论断——"自回归 LLM 本身不会带来人类级 AI"——加上限定条件:就像活塞发动机曾被认为不可能驱动飞机,但最终起飞靠的是涡轮喷气这种全新架构。同日他公开否认曾阻止 Meta 的 LLM 研发,并列出四项证据。与 Hinton 的生存威胁论、与 Hassabis 的 Scaling 信仰的三角分歧,依然是 AI 路线之争的主轴线。
3. 吴泳铭(阿里巴巴集团 CEO):机器思考总量将达到人类的 1000 倍(09-22)
吴泳铭在云栖大会演讲中系统阐述对"机器智能"时代的思考:机器正在成为思考的主力,智能正在成为一种规模化的商品,未来机器思考总量将达到人类的 1000 倍以上。他认为 AI 模型、AI 芯片和 AI 云是机器智能时代的三大基石,阿里将坚定投入。从电商公司到 AI 基建公司,阿里用一场大会完成了自我叙事的切换——"卖货的"现在讲的是每瓦特算力的故事。
4. 刘大一恒(阿里 Qwen 大模型负责人):接棒之后,Qwen 迈向真实世界智能体(09-22)
阿里官方确认刘大一恒接替林俊旸出任 Qwen 大模型负责人,完整头衔为阿里巴巴 ATH 事业群 Token Foundry Qwen LLM 项目负责人。他今日在云栖大会登台演讲,主题为《Qwen:迈向真实世界智能体》。过去半年 Qwen 经历技术负责人离职、模型团队代管、ATH 事业群成立等波折,此次换帅明确了方向:从"会聊天的模型"转向"能干活的智能体"。Qwen 系列是目前全球下载量最大的开源模型家族,这次交接班的分量不言而喻。
5. 董炜(红杉中国投资合伙人、前耐克大中华区董事长):投资人要当企业家的"外挂大脑"(09-16)
董炜在 2026 年《财富》世界500强论坛上提出:AI 时代产品迭代周期大幅缩短、颠覆性赛道不断涌现,传统看市占、利润、成长路径的投资回报模型已难以预判企业未来五到十年的路径;投资人应当成为企业家的"外挂大脑"和"外挂肌肉",把判断重心转向三个问题——产品创新是否可持续、组织能力能否迭代、进入新市场后能否建立壁垒。她是消费产业老兵转型投资人,这番话的背景是 AI 把"五年后的公司"变成了没人算得清的题。
四、GitHub 项目精选
1. google/artemis —— Google 开源 Android 自动化框架,成功率 99%+(8.4k★,今日爆发)
Artemis 是 Google 官方开源的 Android 设备自动化项目:让智能体直接操控安卓系统的各项任务,官方标称 99% 以上的任务成功率,并原生支持 MCP 协议——意味着它可以作为一个"标准工具"被 Claude、GPT 等任何支持 MCP 的智能体直接调用。有趣之处在于它补上了 Agent 生态最缺的一块拼图:手机。当浏览器自动化已经卷成红海、电脑操作有 OSWorld 等基准,数十亿台安卓设备此前几乎没有像样的官方级自动化接口。移动端的 Agent 竞赛,可能从这里正式鸣枪。
2. amagine-ai/Amagine3D —— 说句话就生成可制造的硬件结构(5.9k★)
Amagine3D 是一个 3D 硬件设计引擎:用自然语言描述需求,直接生成可编辑的产品外壳与装配结构,并能导出 STEP/STL 等工业标准格式——也就是说,生成结果可以直接送进 CAD 软件继续改、送进 3D 打印机直接造。它有趣在跨越了"生成图片"和"生成实物"之间最深的鸿沟:AI 生成的不再是视觉概念图,而是带装配关系的工程结构。配合日益便宜的 3D 打印,独立硬件创业的"打样成本"正被压到接近零。
3. yetone/cumora —— Agent 团队聊天室,AI 是一等公民(3.8k★)
Cumora 是一个为"人 + AI 混合团队"设计的聊天应用:AI Agent 作为一等成员加入频道,支持 BYOA(自带 Agent)——你可以把 Claude Code、Codex 等自己正在用的编码 Agent 直接拉进群聊,与人类同事同屏协作、领任务、汇报进展。它解决的真实痛点是:现在多 Agent 工作流的监控界面普遍反人类,而"群聊"是所有人最熟悉的协作形态。把 Agent 管理变成聊天窗口,这个产品直觉相当漂亮。
五、今日技巧:AI 编程 Agent 插件安全三步自检(当天上手)
Plugin4Shell 漏洞告诉我们:AI 编程智能体装插件,和手机装 App 一样有供应链风险——而且这次是零点击中招。三步自检今天就能做:
- 升级到已修复版本:Claude Code 升到 2.1.179 及以上,Codex 升到 0.146.0 及以上;用官方 CLI 的
--version或设置页确认。还在用 GitHub Copilot 插件市场功能的,暂缓安装新插件,等微软补丁。 - 清点已装插件:运行
claude plugins list(或对应工具的插件管理命令),把不是刚需的第三方插件直接卸载——供应链攻击的前提是"你装过它"。 - 给 Agent 上隔离:让编程 Agent 在容器/虚拟机里跑(Docker 或 devcontainer 均可),敏感文件目录不加入工作区。即使插件作恶,爆炸半径也被限制在沙箱里。
顺手把这条转发给正在用 AI 编程工具的同事——他们大概率还不知道今天这波漏洞。
六、AI 论文精选
1. 给大模型做"测谎测试":读取模型不会透露的知识(arXiv:2609.21996)
这篇来自 StackOne Technologies 的论文提出"内部识别探针"(PIR)方法,思路借鉴法医领域的隐蔽信息测试:不问模型"你知道答案吗",而是直接读取模型内部激活状态,判断它是否持有某个隐藏的已知答案。关键区分是"不愿回答"与"不能回答"——模型嘴上说不知道,内部表征却暴露它其实知道。应用场景很硬核:审计模型是否记住了不该记的训练数据(版权/隐私),以及验证"机器遗忘"是否真的删干净了。当模型越来越会说谎和伪装,直接看它的"脑电波"成了新的审计手段。论文链接:https://arxiv.org/abs/2609.21996
2. COBRA-Skills:仅用 50 个样本,把 Agent 技能优化成本砍掉 55%(arXiv:2609.11682)
香港中文大学(深圳)等机构提出 COBRA-Skills,把 Agent 技能优化转化为"情境多臂老虎机"问题:用 LinearUCB 预判哪些技能变体有潜力、值得花预算去试,配合进化算法低成本演化,而不是盲目堆 token 暴力筛选。结果:仅用 50 个优化样本,就在 6 个跨领域基准、3 个目标模型上把优化成本降低 55%-58%,相对无技能 Agent 提升最高 26.9 个百分点。对每天烧钱跑 Agent 评测的团队来说,这是直接能抄的省钱作业——先花小钱试潜力,再花大钱养技能。论文链接:https://arxiv.org/abs/2609.11682
3. CodeMidas:小米把 3185 个真实代码库变成 Agent 训练场(arXiv:2609.22068)
小米联合北大、港大、人大提出 CodeMidas:用智能体流水线从开源代码库自动构建编码强化学习环境——基于 3185 个代码库生成 5545 个跨 23 种语言的任务,附带可自动验证的测试用例,训练后编码智能体在五项基准上全面提升。它解决的是 RL 训练环境荒:以往编码 RL 环境要么靠人工出题(量小),要么靠合成任务(失真),CodeMidas 证明"代码本身就是最好的题库"。对想自己练编码 Agent 的团队,这条流水线可以直接复用。论文链接:https://arxiv.org/abs/2609.22068
信息来源
- AITNT 全球AI新闻日报 2026.09.22(GPT-6 Astra RoboHarm 测试、OpenAI 神秘数学模型、COBRA-Skills 访谈、Grok 4.7)
- IT之家 - OpenAI 宣布成立数学与AI顾问组,神秘新模型24天攻破100道数学难题
- 新浪财经 - OpenAI成立独立数学顾问团,100+「已攻克」开放问题
- Gate 新闻 - OpenAI forms math advisory group(普林斯顿高等研究院)
- 财联社/百度百家号 - 阿里巴巴:将全力投入AI基础设施建设,2032年阿里云数据中心规模将超20GW
- 证券时报 - 吴泳铭云栖大会"机器智能"演讲
- 新浪财经 - 刘大一恒接棒林俊旸,阿里重新明确 Qwen 模型负责人
- 网络安全新闻 - Plugin4Shell Zero-Click RCE Hits Claude Code, Codex, Copilot and Gemini CLI
- 云安全联盟 - Plugin4Shell: SHA-Pinning Bypass Enables AI Coding Agent RCE
- IT之家/新浪科技 - SpaceXAI 发布 Grok 4.7
- 日经转引/百度百家号 - 中国大模型海外调用量连续20周超美国(OpenRouter 数据)
- 百度百家号 - 陶哲轩启动"开放数学模型计划"
- 百度百家号 - 25位菲尔兹奖得主联合声明
- Neodrop - AI 思想者追踪(LeCun 动态)
- 腾讯新闻 - 红杉中国投资合伙人董炜:投资人应当成为企业家的"外挂大脑"
- 百度百家号 - 港股预告:星环科技 9月21日上市
- 东方财富 - 超聚变9月21日发布桌面AI超算
- AITNT - 体验完 Livo,快看漫画 AI"仿生世界"
- 新浪 - 阿里云百炼语音系列模型降价
- 百度百家号 - 世界人工智能开源大赛(GOAI)总决赛
- UseAIWriter - GitHub AI 热门项目(artemis、Amagine3D、cumora)
- arXivDaily - 2026-09-21 论文(PIR 测谎、CodeMidas)
- arXiv - COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization
- arXiv - An Interpretable Memory Decision Controller / PIR 相关论文
- arXiv - CodeMidas: Scaling Agentic Coding RL Environments