今日 AI 圈有 4 件值得关注的事:智谱公开 GLM 推理基础设施升级细节,递归自我改进的最小闭环已经出现;华为发布《智能世界2035》,预测未来五年 AI 累计创造 27 万亿美元经济价值;Anthropic 用自家模型在 4 周内把 30 多个开源生物分子工具平均提速 4 倍;华为全联接大会在上海开幕,283 场演讲聚焦智能体时代的算力底座。
智谱 GLM 跑通递归自我改进最小闭环:两周吞吐 3 倍
智谱团队发布博文《迈向递归自我改进:GLM 如何构建自己的推理基础设施》,披露 GLM-5.3-Flash 推理系统从国产加速器上首次运行到承接全部生产流量只用了两周,端到端吞吐量提升至基线约 3 倍。唐杰在文中判断:递归自我改进的最小循环已经出现——模型优化系统,系统再服务模型。
数字锚点:10 万+ 国产加速器集群、两周投产、吞吐约 3 倍、Decode 内核重构后 1.71 倍加速(9 月 17 日)。
这条新闻最值得工程师咀嚼的不是数字,而是分工的变化。三个优化案例里,真正动手的是一个负责基础设施的智能体(Infra Agent):它从 SGLang、Flash Linear Attention、DeepGEMM 等开源项目里提炼"优化骨架",修掉了 TF32 舍入误差累积导致的精度漂移(修复已并入上游 Flash Linear Attention),把 KV Transfer 与 DeepEP 调度之间的差距从超过 20% 压到 1% 以内,还重构了重复计算 4 次的 Decode 内核。而人类工程师的价值转向设计反馈环境——正确性测试、运行日志、执行追踪如何组织,决定了 AI 能走多远。对于正在推进 AIcoding 全栈开发的企业,这里有两个直接可抄的作业:先把代码评审、测试基准、日志体系搭好,AI 才有"地面"可落;性能优化这类高度依赖专家经验的环节,正在被智能体接走一部分,相关岗位应尽早转向反馈设计。优码云在给客户做 AI 应用与软件定制开发时,已经把"给 AI 设计反馈闭环"作为工程标配。
来源:GLM-5.3-Flash 官方文档、智谱团队博文转载(网易)
华为《智能世界2035》:十大命题锚定智能体底座与 27 万亿美元
华为在深圳举办"以行动,至未来"线上发布会,正式发布《智能世界2035:从愿景到行动》与《全球数智化指数(GDII)2026》两大成果。报告首次提出通往智能世界的十大关键命题,覆盖 AGI、算力集群、存储与记忆、智能联接、芯片设计、Agent OS、终端智能、智能驾驶、AIDC 供电散热与安全隐私,系统回应智能体时代的核心挑战。
数字锚点:9 月 16 日发布;GDII 评估 90 个国家;预测未来五年 AI 累计创造 27 万亿美元经济价值;全球 Token 消耗量到 2035 年预计增长 10 万倍。
轮值董事长汪涛把智能体式 AI 称为"这场变革的核心变量",报告还给智能体操作系统(Agent OS)写了一个公式:(协同力×执行力×记忆力×连接力)^演进力。翻译成企业语言:智能体不再是聊天窗口里的助手,而是要接入业务系统、记住上下文、跨部门调度的"数字员工"。对企业 IT 决策者,有两个信号值得立即响应:其一,推理 Token 消量的爆发意味着 AI 应用的成本结构会随基础设施演进剧烈变化,选型时必须留出弹性;其二,智能体操作系统所需的记忆与协同能力,恰好是当前多数企业系统所不具备的——与其等平台成熟,不如先在 AI 编码与全栈开发的流程里把智能体落地经验攒起来。优码云的智能体落地服务覆盖从移动端到桌面端的完整链路,可以把这类能力直接嵌进客户现有业务。
Anthropic:四周优化 30 多个生物分子模型,平均提速 4 倍
Anthropic 发布研究成果:在 Claude Science 框架下,模型用不到 4 周时间优化了 30 多个开源生物分子工具,平均提速约 4 倍,精度几乎无损;在要求输出完全一致的场景下也拿到约 2 倍加速。所有优化代码已开源,团队还与瑞士公司 Adaptyv Bio 发起蛋白质设计竞赛。
数字锚点:4 周优化 30+ 模型、平均 4 倍提速;FlashPairformer 自定义内核让 triangle attention 快 2.7-2.9 倍;竞赛提供至多 100 万美元的模型调用额度与 5000+ 设计的湿实验验证(9 月 17 日)。
研究里信息量最大的一句是:监督这项工作的只有 2 名没有内核工程经验的 Anthropic 技术人员。过去这类优化需要一支内核团队逐个攻坚数周,现在被批量完成。配套的实证也不缺——Adaptyv Bio 实验室此前测过其设计的 1320 个蛋白结合剂,354 个命中靶标,平均命中率 26.8%,足以在 6 场设计竞赛里赢下 5 场。对企业研发负责人,这是"专家经验稀缺领域被 AI 平权"的最新样本:生物建模如此,金融工程、材料仿真、编译优化同样如此。你可以先从两类任务试起:让 AI 对热点函数做微架构级优化,或把单机代码改造成并行版本。如果贵司正规划 AI 应用落地,优码云的 AIcoding 团队可以把这类"AI 优化 AI 产物"的工程实践,直接搬进你的全栈开发流水线。
来源:Anthropic 研究页、Adaptyv Bio 实验报告
华为全联接大会 2026 上海开幕:汪涛主讲,283 场演讲铺开
9 月 17 日,第十一届华为全联接大会在上海世博展览馆及世博中心开幕,主题"智启新未来",定位打造智能世界的"硅基黑土地"。大会设 3 场主题演讲、20 场峰会、60 余场论坛和 200 余场开放演讲, Linux 基金会、科大讯飞、MiniMax、金山办公等生态伙伴悉数登台。
数字锚点:9 月 17-19 日举办;合计 283 场以上演讲活动;OceanStor M900 AI 记忆存储、坤灵"经纬计划"与 50 个样板点同场首发。
从大会日程就能读出行业风向。发布清单里,OceanStor M900 直指超大规模数据中心 AI 推理的记忆瓶颈,与《智能世界2035》的存储与记忆命题互为注脚;坤灵的"经纬计划"拿出 50 个行业样板点,说明智能化正在从方案走向可复制的落地单元。嘉宾席上,Linux 基金会 CEO、科大讯飞刘庆峰、MiniMax 与金山办公同台,基础软件和应用厂商已经坐在同一张桌子旁谈生态。对企业 IT 决策者,与其追大会热词,不如对照样板点找自己的场景——优码云为客户做智能体系统与 AI 应用落地时,同样坚持先锁定场景、再配基础设施,避免为技术而技术的重复建设。
今日关键数字速览
| 关键数字 | 对应事件 |
|---|---|
| 27 万亿美元 | 华为 GDII:未来五年 AI 累计创造的经济价值 |
| 10 万倍 | 全球 Token 消耗量到 2035 年的增长预期 |
| 约 3 倍 | GLM-5.3-Flash 基础设施两周升级后的吞吐提升 |
| 4 倍 | 30 多个开源生物分子模型的平均提速 |
| 283+ 场 | 全联接大会主题演讲、峰会、论坛与开放演讲总和 |
注:以上数字均出自文中各事件的官方来源页,供快速引用与核验。
我们的解读
把今天四条新闻放在一起,能看到一条清晰的主线:AI 的生产资料正在被 AI 自己接管。智谱的基础设施智能体在 10 万颗国产加速器上把推理系统性能翻了约 3 倍;Anthropic 的模型用 4 周完成了过去一支内核团队数月的工作量;华为则把 2035 年的 Token 消耗量画了 10 万倍的增长曲线。三条曲线的交汇处,站着的正是 AIcoding。
对企业决策者,我们有三点判断。第一,"用 AI 写代码"已经进入第二阶段:从生成业务代码,走向生成基础设施与优化内核,研发管理要先适应"人设计反馈、AI 干活"的新节奏。第二,智能体正从单点工具走向系统底座,未来两年企业间 AI 应用竞争比的是谁的智能体接入业务更深、反馈闭环更快,而不是谁的聊天窗口更漂亮。第三,评测与选型必须私有化——公开榜单是风向标,私有评测集才是决策依据。
优码云是深圳的 AI 软件定制开发团队,过去一年以 AI 编码驱动的全栈式交付完成了多行业的 App、Web、小程序与桌面端项目,工期较传统方式缩短约 50%。如果你正计划把 AI 引入研发管线,或需要一套能落进业务的智能体系统,欢迎和我们聊聊。
联系我们
如果你的团队正在评估 AIcoding 转型、搭建智能体系统,或需要一支能同时搞定 App、Web、小程序、桌面端的全栈开发团队,欢迎预约 30 分钟免费咨询与智能化转型评估:联系我们页面留言,我们会在一个工作日内回复。
