今日 AI 圈有 7 件值得关注的事:DeepSeek V4 Pro 峰谷定价今日 0 时生效,高峰输出 27 元/百万 Token、闲时半价;IBM 与 OpenAI 达成企业级战略合作;广东首个 Token 贷落地,银行按词元消耗授信;Google 今日关停 Imagen 4 系列 API。另有:中国开源模型规模反超美国、人形机器人运动会预赛开跑、AI 配音侵权争议发酵。
DeepSeek V4 Pro 峰谷定价今日生效:词元成本进入可调度时代
DeepSeek 于 8 月 13 日发布 V4 Pro 正式版并全渠道开放,今日 0 时起 API 执行峰谷定价:工作日 9:00-12:00 与 14:00-18:00 为高峰时段,V4 Pro 输出价 27 元/百万 Token,闲时约为高峰一半。规格上,V4 Pro 提供 100 万词元上下文、38.4 万词元最大输出,思考模式分 low/high/max 三档,原生兼容 OpenAI Responses API 并适配 Codex。
峰谷定价把推理成本变成了像电价一样可以"错峰"的资源。对企业 AI 应用团队来说,夜间批处理、数据清洗、测试用例生成这类非实时任务,完全可以调度到闲时执行,成本直接减半;同时要把模型成本抽象成独立模块,避免把价格写死在业务代码里。挑选 AIcoding 服务商时,是否具备成本架构设计能力,比单纯看模型选型更值得考察。据 DeepSeek 官方定价公告。
Hugging Face 报告:中国开源模型参数规模反超美国
Hugging Face 最新观察报告显示,2026 年以来多数月份,中国公司发布的最大开源模型月度参数上限在 7540 亿至 2.78 万亿之间;美国多数月份低于 1300 亿。国内媒体 8 月 16 日集中报道了这一数据。
开源模型变强变多,企业自部署的可行路径更宽,但参数规模不等于业务效果。真正拉开差距的是针对场景的微调、推理优化与工程集成,这需要全栈开发能力做支撑。对预算有限的中小企业,私有化部署国产开源模型并配合定制开发,是可控成本的务实路线。据财联社与钛媒体 8 月 16 日报道。此前 8 月 11 日早报也记录了中国大模型调用量连续 15 周领跑的信号。
IBM 与 OpenAI 联手:企业级 AI 交付进入大厂结对阶段
13 日 IBM 官宣与 OpenAI 达成战略合作,把 GPT-5.6、Codex 与 ChatGPT Work 嵌入 IBM Consulting 的企业 AI 交付平台,双方联合开拓金融、政府、电信、零售市场,合作还涉及 OpenAI Daybreak 网络防御项目。
企业级 AI 落地正在从"买模型"转向"买交付能力",集成商的价值随之上升。这提醒国内采购方:评估任何 AI 方案时,要把模型供应商与系统集成方的绑定关系、数据主权、迁移成本一起纳入考量。架构上保留模型抽象层,未来才能在多模型之间灵活切换,避免被单一供应商锁定。据 IBM 官方新闻稿 8 月 13 日发布。AI 编程工具的市场热度在8 月 13 日早报中亦有体现。
Google 今日关停 Imagen 4 系列 API:开发者迁移窗口关闭
Google 的 Gemini API 弃用窗口今日关闭,imagen-4.0 系列与 gemini-robotics-er-1.6-preview 等模型正式停用,官方推荐迁移到 gemini-3.1-flash-image。
对正在做图像生成类 AI 应用或机器人相关产品的团队,这是一次典型的 API 生命周期提醒:模型版本会退役,产品不能把模型版本写死。应在工程上建立版本监控、灰度迁移与回归测试机制,把图像、多模态能力封装成可替换服务,降低未来任何一次停用带来的返工成本。据 Google AI for Developers 弃用公告。
广东首个 Token 贷落地:银行开始按词元消耗授信
广东首个 Token 贷上周五在广州海珠区落地,由中国银行、中信银行、广州银行共同实践,把词元消耗、平台资质与回款进度纳入授信评判;配套"词元八条",单项最高五百万元。
词元消耗被金融机构当作经营指标,意味着 AI 应用团队的每一笔推理支出都在沉淀"数字资产"。企业应尽早建立词元计量与成本核算体系,把单客成本、单任务成本算清楚——这既是降本工具,也会成为未来融资、授信时的硬材料。据新浪财经 8 月 14 日报道。
世界人形机器人运动会预赛开跑:666 支队伍进京打擂
第二届世界人形机器人运动会 8 月 22 日至 26 日将在国家速滑馆"冰丝带"举行,场景赛预赛已于 16 日启动。赛事吸引六大洲 16 国、666 支队伍、2056 台机器人,设 51 个赛项,覆盖工业、酒店、家庭、物流真实场景,并设灵巧手专项。
人形机器人是 AI Agent 向物理世界延伸的载体,落地高度依赖感知、决策、执行的软件栈与端云协同架构。对软件团队来说,具身智能带来的是 Agent 系统、边缘推理、实时调度等软件工程的增量市场,值得提前布局。据新浪财经与北京市政府官网发布。
AI 配音侵权争议发酵:授权边界被摆上台面
天猫七夕 AI 广告上线后,配音演员三石指认其中 AI 角色"段宴"声线与其高度相似且未经授权,事件 14 日引爆舆论,三石已委托律师起诉;肯德基同类纠纷(史泽鲲维权)仍在立案。
AI 生成不是免责金牌。做语音克隆、数字人、营销内容生成类 AI 应用的团队,必须把数据授权、声音与肖像权、训练数据来源合规写进产品需求与合同条款,从源头规避侵权。这属于软件定制开发中极易被忽略、却最可能引发商业风险的一环。据网易科技与 ZAKER 报道。
数据看板:DeepSeek V4 Pro 定价与规格
| 项目 | 数值 |
|---|---|
| 高峰时段 V4 Pro 输出价(9:00-12:00、14:00-18:00) | 约 27 元/百万词元 |
| 闲时输出价 | 约 13.5 元/百万词元(高峰一半) |
| 上下文窗口 | 100 万词元 |
| 单次最大输出 | 38.4 万词元 |
| 思考模式 | low / high / max 三档 |
数据来自 DeepSeek 官方定价公告。
我们的解读
今天的新闻有一个共同底色:AI 成本正在从"看不见"走向"可计量、可调度、可融资"。峰谷定价让推理像电力一样错峰计价;Token 贷让词元消耗变成授信资产;Google 停用 API 提醒所有人模型生命周期管理;开源模型参数反超则让自部署成为更现实的选项。这些变化都指向同一件事:企业缺的不再是模型,而是把模型变成业务的工程能力。
优码云的做法是把这一整套能力打包成 AIcoding 全栈开发服务:从模型选型与成本测算,到 App、Web、小程序、桌面端的多端交付,再到 Agent 系统的架构设计与落地,一条链路走完。在我们过往项目中,成熟的 AIcoding 流程通常能把工期缩短 50%,关键在于前期把成本模型、合规边界与模型抽象层想清楚,而不是先把功能堆出来再返工。今天的每条新闻,都值得企业对照自己的 AI 计划检查一遍:成本可调度了吗?API 依赖有预案吗?授权链路合规吗?如果答不上来,现在就是补齐的窗口期。把镜头拉长,昨日早报记录的收购与模型治理事件,与今天共同勾勒出 2026 年企业 AI 化的完整坐标。
延伸阅读
- 2026年08月16日 AI 早报:SpaceX 完成收购、Anthropic 公开文本水印、Databricks 估值近两千亿美元
- 2026年08月13日 AI 早报:Gemini 破 10 亿月活、AI 编程独角兽估值、Manus 恢复独立运营
- 2026年08月11日 AI 早报:Anthropic 产品停用、中国大模型调用量领跑、SpaceX 全股票收购 Cursor
联系我们
如果你的团队正在规划 AI 应用或 Agent 系统,想先算清楚成本与合规账,欢迎预约 30 分钟免费咨询:优码云的技术顾问会结合你的业务场景给出 AIcoding 转型评估与落地方案建议,覆盖 App、Web、小程序与桌面端。点击联系我们即可预约。
