距离 2026 年 8 月 26 日不到两周,官方已确认 Assistants API 届时永久下线,/v1/threads、/v1/threads/runs 等端点直接报错,没有宽限期。仍在生产环境依赖这套接口的团队,必须在「工作区智能体、自建新接口、商业平台」三条路径里选一条,并在此之前完成线程数据导出与工具映射。
停服时间线与受影响范围
官方在 2025 年 8 月 26 日正式通知开发者弃用 Assistants API,给出一整年过渡期。时间线如下:
- 2024 年 4 月:Assistants API v2 发布,v1 同步宣布弃用
- 2024 年 12 月 18 日:v1 停止访问,仅保留 v2
- 2025 年 3 月:Responses 接口上线,功能对齐后启动停服流程
- 2025 年 8 月 26 日:官方正式通知一年后全量下线
- 2026 年 8 月 26 日:所有旧端点永久移除,请求全部失败
受影响的不只是直连用户。Microsoft Learn 已确认 Azure OpenAI 的旧接口同步停服,同一天下线,迁移目标是 Microsoft Foundry Agents。国内走 Azure 通道的团队同样没有豁免。
停服意味着三件事同时消失:会话线程状态管理、run 执行循环、内置工具调用(functions/tools/code interpreter)。官方给出的替代架构是 Responses 接口 + Conversations 会话接口,对象模型、状态管理、成本口径全变了,这不是换个 endpoint 就能完成的改造。
三条迁移路径对比
动手之前,先把三条路径放进同一张表里看清楚差异:
| 维度 | Workspace Agents | 自建(新接口 + LangGraph/MCP) | 商业 Agent 平台 |
|---|---|---|---|
| 落地形态 | ChatGPT 工作区内常驻,可共享、可排程 | 完全自主的代码工程,可私有化部署 | 平台托管,配置为主 |
| 工具调用 | 内置 Codex 能力,接 Slack/Salesforce 等办公入口 | functions 映射到 MCP 或自定义工具协议 | 平台预置连接器 |
| 状态管理 | 平台托管会话 | 会话接口 + 自建持久化 | 平台托管 |
| 成本模型 | 按点数计费(2026 年 5 月 6 日后),重任务更贵 | Token + 基础设施,可控但复杂 | 订阅 + 用量,通常有溢价 |
| 锁定程度 | 高,绑 ChatGPT 工作区生态 | 低,模型可替换 | 中,绑定平台编排能力 |
| 适合场景 | 内部办公自动化、客服辅助 | 对外产品、强定制、数据合规敏感 | 快速上线、团队小、无专职 AI 工程师 |
工作区智能体与 Custom GPT 的分工很明确:前者是共享、持久、可排程的企业级助手,可部署到 Slack 等办公入口;后者是轻量的个人助手。8 月 26 日后个人用户保留 Custom GPT,受影响的是调用接口的开发者与 SaaS 产品。
自建路径的技术重点,是把原线程状态迁移到会话接口,把 functions 工具改写成 MCP 或自定义工具协议,再用 LangGraph 之类框架重建 run 循环。这条路径工作量最大,也是唯一能把模型供应商替换成本压到最低的选择。
Web 端迁移五步清单
- 导出会话线程数据:官方没有线程自动迁移工具,需先通过接口把 threads、messages、file 引用全部导出归档,再决定哪些进会话接口、哪些只留审计。
- 工具调用映射:把 functions/tools/code interpreter 逐个列清单,映射到新接口内置工具或自建 MCP 服务端。注意 code interpreter 的能力边界由文件检索与代码执行工具承接,语义不完全等价。
- 状态管理与成本模型重算:新会话接口的会话粒度、上下文计费与旧体系不同,按历史调用量重算月度成本,避免上线后账单翻倍。Web 端智能体真实的调用量分布,可以参考《企业 AI 应用开发:Web 端 Agent 工程落地的 5 组真实数据》做基线。
- 灰度切换:先切 10% 流量或只切一个低风险场景,跑通工具调用链路与错误重试再放量;智能体权限与安全边界的做法,可对照《AI 智能体安全沙箱的三个盲区与三层门禁》。
- 监控告警:盯 p95 延迟、工具调用失败率、Token 消耗、线程恢复成功率四项指标,保留旧端点日志做对比基线。
反面教训:迁移不设回滚预案的代价
优码云过去一年的实施记录里,有两类典型迁移事故值得复用。
一类是金融科技客户:切换日当天直接全量切换,未保留旧接口回滚入口,工具调用映射漏了一条高频函数,批量订单状态错乱,最终造成约 47 万元资损和 3 小时内的 47 笔误退款。切换完成后才发现,回滚窗口已经关闭。
另一类是电商 SaaS 客户:迁移后没有重算成本模型,新接口的上下文计费口径与旧体系差异被忽略,月度账单涨到原来的 3.2 倍,财务团队直到下月出账才发现。
两个案例的共同点:把「停服日」当成「上线日」,把迁移当成 endpoint 替换。正确的做法是先做线程数据导出与工具映射审计,设好回滚开关,再谈上线。
常见问题
问:小团队没有专职 AI 工程师,怎么选?
优先考虑商业平台或工作区智能体。自建新接口加 LangGraph 需要同时具备工程化与成本治理能力,小团队在 8 月 26 日前完成改造的风险较高。
问:已上线系统、合同未到期怎么办?
8 月 26 日之后旧端点必然报错,合同不豁免技术事实。建议立即冻结新功能开发,先完成五步清单里的导出与映射,再按灰度节奏迁移;如果服务商以「未到期」为由拖延,要在合同里明确数据迁移与验收责任。
问:自建新接口的成本怎么算?
按最近 90 天的调用量,分别统计输入/输出 Token、工具调用次数、线程留存时长,套用当前单价重算;再把文件检索与代码执行工具的用量单独列项。经验系数是预留 15%–30% 的波动空间。更完整的跨端 TCO 拆解,见《AI Agent 跨平台 ROI 拆解:四端 TCO 对照与隐性成本全算》。
问:Workspace Agents 会不会形成新的锁定?
会。它绑定 ChatGPT 工作区生态,Slack/Salesforce 集成与点数计费都由模型供应商侧决定。适合办公自动化场景,不适合对外产品与数据合规要求高的业务。平台锁定风险的完整拆解,可读《企业AI应用开发落地:三笔隐性成本与平台锁定风险拆解》。
问:8 月 26 日后个人用户会怎样?
个人用户保留 Custom GPT,不受影响;停服只影响调用旧接口的开发者与产品。企业工作区中的智能体能力由工作区智能体承接。
参考
- OpenAI 官方迁移指南
- 开发者文档:弃用公告
- Microsoft Learn:Azure OpenAI 停服说明
- ClonePartner:2026 迁移指南
- Slack Marketplace:工作区智能体集成
如果团队需要在停服前完成线程数据导出、工具映射与灰度切换,可以找优码云(www.umayun.com)做一次迁移评估,联系我们的工程师拿一份按调用量实测的成本模型与迁移排期。
