AMR 生产发布影响报告

生成时间:2026-09-11 11:15 CST;分析对象:origin/main @ 15de6f1(fix(admin): stop patrol alerts and reports duplicating across replicas #1928)。每个 workflow 以自己最近一次成功运行的 head SHA 为发布点;下表维度只列其发布点之后的变更。

当前生产发布点(各 workflow 独立计算)

「commit 数」是 workflow 的完整 compare 范围;Catalog 仅把其中触及 data/jsondb/seeds 的提交视为可 apply 的 catalog 变更。

deploy-web-eks-prod.yml
最近成功:2026-09-10 15:37:55Z
发布点:ae4b84f
本次新增:1 commit;无 Web 代码
deploy-api-eks-prod.yml
最近成功:2026-09-09 06:28:14Z
发布点:b6a6ada
本次新增:12 commits
deploy-link-eks-prod.yml
最近成功:2026-09-09 08:47:58Z
发布点:eecb443
本次新增:7 commits;无 Link runtime 代码
deploy-admin-eks-prod.yml
最近成功:2026-09-09 08:53:10Z
发布点:eecb443
本次新增:7 commits
deploy-db-migrations-prod.yml
最近成功:2026-09-09 09:02:35Z
发布点:eecb443
本次新增:7 commits;含 4 个 migration
deploy-model-routing-catalog-prod.yml
最近成功:2026-09-10 07:39:07Z
发布点:21c79c6
本次新增:4 commits;catalog 文件 0 个

此次发布真正新增的 feature 和影响面

CMS 在 API/Admin/DB 尚待发布;最新提交新增 Patrol 可靠性和信号质量改进。Web、Link、Catalog 没有待发布的所属 runtime/catalog 改动。

Feature / Author / CommitsWebAPILinkAdminDB schema / migrationDB catalog(seed)
XXLCMS 活动内容的不可变生命周期、验收与生产推广

运营可由 GitHub 或 ZIP 创建不可变内容版本,在 Test 完成跨 host 验收后再受控推广、下线或恢复生产活动;内容以 hash/CAS 保存并保留审计、兼容性证据。Test 与推广改为共用 artifact store,安全 ZIP 目录被接受且存储失败会反馈给管理端。

Author:Caprika(PR author:alchemistklk)

已上线:CMS Web 入口已随 ae4b84f 发布;默认隐藏,仅显式验收模式可进入。新增 touchpoints API:构建、版本、Test/生产 deployment、验收、推广、恢复和审计;统一 artifact store 与 ZIP/upload 错误处理。无。范围内只有 Link E2E 测试修改,无 services/link runtime 源码。新增活动管理页及 proxy:GitHub/ZIP 导入、构建诊断、预览、Test 验收、推广、下线、恢复;上传失败本地化反馈。20260909101013_cms_content_lifecycle.sql 创建 touchpoints schema 及内容/构建/部署/验收/审计表;
20260909140436_cms_restore_host_evidence.sql 补恢复 host evidence。
无。
XLPatrol 多副本去重与每小时报告唯一化

解决两副本错峰定时任务导致 Feishu 异常告警和 Patrol 历史报告重复的问题:告警签名的最近发送时间持久化共享,报告按环境与 UTC 小时 upsert;已有重复报告会在 migration 中保留最新一条。数据库未升级时告警状态存储 fail-soft 回退到现有进程内行为。

Author:open-design-crew[bot];co-author:ivy-ting

无(该 commit 未改 apps/web)。无。无。跨 replica 共享告警去重状态;报告按小时写入;Patrol 页面和 Feishu 卡片改为更紧凑的异常呈现及严重程度标签。20260910094000_add_alert_sent_signatures.sql 新增发送签名表;
20260910094001_add_patrol_reports_hourly_key.sql 回填 UTC 小时、清理历史重复并加 (env, reported_hour) 唯一索引。
无。
LPatrol 异常信号降噪与订阅额度巡检

合并同一 tier 的大规模额度超限、按状态汇总已退役模型,抬高低基线 spend spike 门槛;新增按订阅期授予额度的超限/近限巡检,并修复升级时重叠 grants 被重复计算、不同 limit-policy selector 互相掩盖的问题。Patrol 模型表转向实际服务状态,补充供应商有效单价观察数据。

Author:open-design-crew[bot];co-author:ivy-ting

无。无。无。Patrol 运营面板、异常分类与 Feishu 内容改进;影响巡检展示和告警触发质量,不改用户请求路径。复用上一行的两个 Patrol migration;没有额外 schema 文件。无。

已在生产生效(发布点之前,本次不重复发布)

发布建议

  1. 先跑 Migration:运行 deploy-db-migrations-prod.yml,需 apply 4 个 migration:2 个 CMS + 2 个 Patrol。Patrol 的报告 migration 会清理历史重复行后才加唯一索引。
  2. 服务顺序:DB(7 commits / 4 migrations)→ API(12 commits,CMS runtime)→ Admin(7 commits,CMS 与 Patrol)。Link(7 commits)无 runtime 差异;Web(1 commit)无 Web 源码差异;Catalog(4 commits)无 seed/data 差异,均无需为本次功能重发。
  3. Catalog:deploy-model-routing-catalog-prod.yml 的本次范围没有可 apply 的 catalog 文件,不需要运行。
  4. 发布后观测:检查 Atlas 状态与 Patrol migration 的重复报告清理 notice;确认两个 Admin replica 每小时只产生一个 report、同一异常只发一次 Feishu;走 CMS ZIP/GitHub 导入→Test 验收→推广/恢复,并观察 API artifact-store/worker 错误。

每个 compare 链接都基于对应 workflow 的 BASE,不以最旧发布点代替。