智谱开源旗舰对标闭源:7430 亿参数发布
智谱昨日中午发布新一代旗舰模型 GLM-5.3,总参数 7430 亿,采用 MoE 架构,基座沿用前代、能力提升全部来自后训练缩放。官方称其多项主流基准为开源第一,编程与智能体能力接近顶级闭源模型,并将在两周内开放权重。
8 月 14 日发布,7430 亿参数,两周内开放权重。
国产开源模型的编程能力正在逼近闭源第一梯队,这对企业 AIcoding 选型是直接利好:既可以用更低单价跑通代码生成、代码审查、自动化测试等环节,又不必担心被单一供应商锁死。建议技术负责人把三件事纳入下一轮评审:用企业自己的代码库重跑一遍基准、对比按 token 计费与私有化部署的三年成本、把开源权重加入合规备选清单。优码云做多模型路由的经验是,混合路线往往比单押一家更稳。
[来源](https://m.sohu.com/a/864339650_121124022)
阿里 2.4 万亿旗舰兑现开源承诺
阿里 8 月初发布总参数 2.4 万亿、激活 95B 的 Qwen3.8 系列,当时承诺一周内开放权重。本周承诺兑现,旗舰级 Qwen3.8-Max 与轻量版本均向开发者开放。
总参数 2.4 万亿,激活 95B,8 月 3 日发布、本周开源。
开源旗舰密集落地,让企业 AI 应用开发有了新的成本锚点。对于要把对话、检索、文档处理放进私有云或信创环境的企业,开放权重意味着可以同时拿到大模型的推理质量和数据不出域的主动权。需要提醒的是,参数越大单机推理的硬件门槛越高,建议先做小流量灰度,再决定是自建推理集群还是走托管接口,别一上来就按旗舰参数配算力。
[来源](https://wap.eastmoney.com/a/202608033354929503.html)
小红书开源 dots3-note:280B 长程智能体模型入局
小红书 dots 实验室昨日开源 dots3-note 预览版,总参数 280B、激活 16B,支持 512K 上下文与多模态输入,与 IMO 满分模型同系列,专攻旅行规划、婚礼筹备等长程开放任务,并同步开源配套评测基准。
8 月 14 日开源,280B/16B 激活,512K 上下文。
这批模型把优化目标从单轮问答转向长程任务执行,对智能体系统落地的意义比参数数字更大。客服、运营、供应链场景里,Agent 要连续读取几十轮上下文、跨系统调用工具、失败后自我纠错,这正是长上下文模型的用武之地。企业做智能体选型时,建议用真实任务流而非标准问答集验收,重点看它在 20 步以上的任务里能否保持状态一致。
[来源](https://m.36kr.com/p/3325904379423233)
安全警报:顶级模型推理记录被完整导出
安全研究员 can1357 公布一种提取方法,可完整导出 GPT-5.6、Fable 5 等顶级模型的推理记录,包括可能还原 API 密钥、密码与私钥的上下文内容,方法已并入其开源工具 Oh My Pi 的更新。
8 月 14 日公布,GitHub 项目约 2.4 万 Star。
这件事给所有把敏感数据喂给大模型的企业提了个醒:推理过程不是黑盒,提示词里的密钥、接口凭证、客户资料都可能被记录和提取。优码云在 AI 应用开发中反复强调三层防线——输入侧脱敏、调用侧最小权限、输出侧审计。任何要接入第三方大模型的生产系统,都应先做一轮敏感信息扫描,别把生产密钥直接写进提示词。顶级模型的能力变化我们持续在[早报](/blog/20260726-ai-opus-5fable-5etched103)里跟踪。
来源:AITNT 全球 AI 新闻日报
出海合规:三大厂商签署欧盟 AI 内容水印准则
OpenAI、Anthropic、Google 等厂商签署欧盟《AI 生成内容透明度行为准则》,承诺为 AI 生成内容添加机器可读标识。Anthropic 已自 8 月 2 日起在欧盟新 Claude 模型中启用文本水印。
行为准则本周签署,Anthropic 8 月 2 日已先行落地水印。
对把产品或营销内容投放欧盟市场的企业,这条准则意味着水印义务会沿供应链合同下传。做海外站、SaaS、电商内容的企业,应提前在产品管线里加入内容溯源字段:生成端打标、存储端记录、发布端检测,三件事缺一不可。合规成本在早期就设计进去,远比事后补审计便宜,这也是优码云给出海客户做 AI 应用改造时的默认配置。
[来源](https://blog.google/company-news/outreach-and-initiatives/public-policy/eu-ai-act-transparency-code-of-practice/)
巨头震荡:谷歌 DeepMind 重组、Gemini 延期两月
据路透报道,Gemini 旗舰发布推迟约两个月,内部测试显示其编程能力落后;联合创始人布林重回 AI 核心督战,DeepMind 完成管理层换血,原 CEO 转任董事长。
8 月 12 日披露,延期约两个月,管理层 8 月 5 日官宣调整。
头部厂商在追赶周期里暴露的问题,对国内企业恰恰是提醒:不要把生产系统押在单一模型的版本节奏上。Gemini 延期、闭源模型频繁迭代、国产模型密集发布,都说明模型能力仍有波动。优码云建议在架构上做模型无关设计——把接口层、路由层、评测层分开,模型版本切换只改配置不改业务代码,这样无论哪家模型延期或涨价,业务都不受影响。
[来源](https://www.ithome.com/0/989/384.htm)
苹果与阿里联手训练国行大模型
据智东西报道,苹果与阿里合作,联合训练面向中国市场的语言大模型;苹果 Mac 使用手册曾披露通义千问接入 Apple 智能,支持 macOS 26.6 及以上版本。
8 月 14 日报道,合作覆盖中国区 Apple 智能,macOS 26.6 起。
国行设备上的系统级 AI 正式落到国产模型身上,对做国内 App、小程序、企业应用的团队是明确信号:面向中国用户的智能体底座会越来越多跑在国产模型上。这意味着开发时要同步适配国产模型的接口与审核要求,也意味着国产模型在端侧与云侧的调用量会快速上涨。提前把应用层与模型层解耦,才能在这轮生态切换中少返工。
[来源](https://www.163.com/dy/article/L4A4HIQN051180F7.html)
开发工具:Nvidia 开源路由库,推理成本再降一档
Nvidia 本周发布 Nemotron 3.5 Lightning,30B 总参、3B 激活的 MoE 模型,并开源 NeMo Switchyard 路由库,号称以约三分之一的成本对标头部闭源模型;Cognition 已将其接入 Devin Desktop,平均成本下降约 28%。
8 月 12 日发布,成本约为 Opus 4.8 的三分之一,接入后平均成本降 28%。
路由层开源让企业多模型策略的成本门槛进一步降低:把简单任务路由给便宜模型、复杂任务路由给旗舰模型,是当前最直接的 AI 应用降本手段。对做客户支持、内容生成、代码辅助的系统团队,建议从今天起给调用加上可观测的成本标签,先摸清每一类请求实际烧掉多少 token,再谈路由和缓存优化。没有度量的优化都是拍脑袋。Nvidia 在安全与开源生态上的动作,我们也曾在[早报](/blog/20260728-ai-nvidia)里记录过。
来源:NVIDIA 官方博客及科技媒体报道
数据看板:三款国产开源旗舰参数对比
| 模型 | 总参数 | 激活参数 | 上下文 | 状态 |
|---|---|---|---|---|
| GLM-5.3(智谱) | 7430 亿 | MoE | 官方公布为准 | 8/14 发布,两周内开源 |
| Qwen3.8-Max(阿里) | 2.4 万亿 | 95B | 支持长上下文 | 本周开源 |
| dots3-note(小红书) | 280B | 16B | 512K | 8/14 开源 |
注:参数为各家官方公布口径,实测表现以模型文档与本地基准为准。
我们的解读
国产开源三连发、巨头组织调整、欧盟水印准则,这一天的信息量指向同一个判断:模型供给正在从少数闭源垄断走向多层混合,AI 应用开发的重点从选模型转向搭系统。对企业 IT 决策者,这意味着 AIcoding 全栈开发不再是少数头部公司的特权——开源权重把推理成本拉低,路由工具把多模型调度变成标准动作,合规准则把水印要求写进供应链条款,软件定制开发的门槛正在系统性下降。
优码云的建议很直接:把 AI 应用开发当作系统工程来做,用模型无关架构承接版本波动,用成本标签驱动路由优化,用内容溯源字段应对合规审计。我们服务过的项目里,App、Web、小程序、桌面端四端联动的 Agent 系统,从立项到上线普遍比传统工期缩短约 50%,核心不在模型多强,而在工程化是否扎实。接下来两到四周,国产旗舰模型会陆续交出正式版本,建议企业趁窗口期做一轮小范围试点,用真实业务流验证,而不是等所有参数尘埃落定。
延伸阅读
- 企业 AI 应用开发:90 天从传统团队到 AICoding 协同转型路线
- 8 月 13 日早报:Gemini 破 10 亿月活、AI 编程独角兽冲 400 亿美元估值
- 8 月 12 日早报:Gemini 破 10 亿月活、Cognition 洽谈高估值
- AI 模型调用成本失控:五个信号与三层控制台
- 国产开源模型梯队与多模型路由选型
- 企业 AI 项目三年 TCO 怎么算
联系我们
模型窗口期正是改造 AI 应用的好时机。如果你正在评估开源模型选型、多模型路由或 Agent 系统落地,欢迎预约 30 分钟免费咨询,我们结合你的业务场景出一份 AIcoding 全栈开发转型评估,覆盖 App、Web、小程序、桌面端。前往联系我们。
