← 返回博客

我不盯着 AI 干活,但每天 9 点它得交一份日报

2026-09-14 · 11 分钟阅读
AI 自动化可观测性工程实践Claude Code独立开发

这是「一个人的 AI 营销部门」系列第 7 篇。前六篇讲了这套系统 长什么样一条流水线怎么跑看板规则怎么定发布权怎么交出去出过哪三次事故定了哪四条不许编的红线

这一篇讲一个在把活交出去之后立刻会遇到、但几乎没人提前想的问题:

我不在场的那 23 小时里,它到底在干什么?

第 4 篇和第 6 篇解决的是"它会不会闯祸"。这篇解决的是另一件事——它会不会假装在干活, 以及更常见的情况:它真的停了,而我半天没发现

自动化系统最典型的死法不是炸掉,是悄无声息地停摆,然后你在两周后才意识到 "好像有一阵子没收到东西了"。

三条汇报线,各管一件事

我给这套系统装了三条固定的汇报线,全部走企业微信群机器人,全部由 crontab 触发:

0  9 * * *   daily-report.py       每天 9 点:昨天完成了什么,今天要做什么
5  9 * * 0   weekly-metrics.py     每周日 9:05:这一周的营销数字
10 9 * * 1   weekly-focus.sh       每周一 9:10:本周聚焦三张卡 + 你必须亲自做的 top 3

为什么要分三条,而不是塞进一条"每日大汇报"里?因为它们回答的是不同时间尺度的问题, 混在一起的结果是每天都在看一遍周指标,然后每天都对那些数字麻木。

  • 日报回答的是"它今天动了没有"——看的是动作
  • 周指标回答的是"这些动作换来钱了没有"——看的是结果
  • 周一聚焦回答的是"这周该往哪使劲"——看的是方向

日报天天看,周指标一周看一次,方向一周定一次。这个频率不是随便定的:定聚焦是一周一次的 决策动作,早期我把它塞进每半点跑一次的扫描里,结果 agent 每一轮都想重排聚焦列, 卡片被来回搬。拆成独立一条线之后就安静了。

设计一:日报不许 AI 自己写

这是整套汇报机制里最重要的一条。

daily-report.py 从头到尾没有调用任何模型。它做的事是:调 Trello 的 actions 接口 拉昨天的动作记录,按类型分桶——移进"✅ 完成"列表的是完成,新建的是新建,移动的是流转—— 然后把卡片名原样贴出来。

for a in actions:
    if a["type"] == "createCard":
        created.append(cname)
    elif a["type"] == "updateCard":
        after = d.get("listAfter", {}).get("name")
        if after and "完成" in after:
            done_names.append(cname)
        elif after:
            moved.append(f"{cname} → {after}")

就这么笨。没有润色,没有归纳,没有"今天是富有成效的一天"。

为什么不让 AI 写:让一个 agent 总结自己昨天的工作,它写出来的东西永远是正面的。 这不是模型坏,是任务设定本身有问题——你让一个执行者给自己写述职报告,还指望它客观。 它会把"调研了一下"写成"完成了技术选型",把"改了个错别字"和"上线了一个功能"用同样的 句式并列。你看三天就不再相信这份日报,看一周就不再点开了。

日报的可信度必须来自数据源,不能来自写它的人。 卡片有没有移进完成列表是个客观事实—— 移了就是移了,没移就是没移,AI 想美化也没有下笔的地方。它想让日报好看,唯一的办法是 真的去把活干完。

这条规则可以直接搬到任何一套 AI 自动化里:凡是用来评价 AI 的东西,都不要让 AI 生成。

设计二:日报最后一行是"赚钱维度"

每份日报的结尾固定有这么一行:

赚钱维度:💰 17 张 (100%) / 🔧 0 张

看板上每张卡必须带 💰 直接赚钱🔧 不赚钱 之一的标签,日报每天统计一次两者的比例, 低于 40% 就把这行字染成警告色。

这一行是我加的所有指标里最有用的一个,因为它防的是自动化最容易犯的那个错:一直在忙, 但忙的全是不赚钱的事。

AI 特别容易往 🔧 里钻,而且钻得理直气壮。重构、补测试、统一代码风格、优化目录结构—— 这些任务的共同特点是定义清晰、验收明确、做起来舒服,而赚钱的任务几乎全是反面: 写内容没有标准答案,谈客户会被拒绝,改转化漏斗要等数据。一个按"能不能干净利落地做完" 排序的 agent,永远会挑 🔧 干。

光靠标签还不够,所以规则文件里还写死了一条硬约束:

同一优先级里只要还有 💰 没做完,就绝不动 🔧。 🔧 只有三种情况允许做:① 安全债 ② 它阻塞了某张 💰 卡 ③ 衡量 💰 效果所需的埋点。 不符合的 🔧 宁可不做,也不要拿它填工作位——做完一堆 🔧 等于原地踏步。

日报里那个百分比,就是这条规则有没有被遵守的体温计。它连续几天往下掉,我就知道 该去看看 agent 最近在忙什么了。

设计三:取不到的数字,标"未配置",不许猜

周指标那份表里有九个数字:注册数、订阅数、MRR、CN 付费数和收入、发文数、 搜索展现和点击……不是每个都总能取到——cookie 会过期,API key 可能没配, Search Console 的授权可能掉了。

脚本对这种情况的处理写在文件开头的设计原则里:

能自动取的字段直接取;取不到的字段明确标「未配置」而不是瞎猜或报错退出, 这样脚本可以在凭证不全的情况下先跑起来,跑出来的表格里能看出还缺什么。

两个反面做法,我都试过:

报错退出——一个字段取不到,整份周报发不出来。结果是最不重要的那个字段挂了, 最重要的 MRR 我也看不到了。

用旧值或估算值填上——这个更糟,因为它让一份坏掉的报表看起来是好的。你盯着一个 上周的数字以为是本周的,做出的判断全是错的。这正是第 6 篇那四条红线 在讲的同一件事:一个标着"未配置"的空格,比一个来路不明的数字有价值得多。

表里现在就有一个长期"未配置"的字段:注册用户里非中国用户的占比。原因写在脚本注释里—— 用户表里根本没有存国家字段,分析后台也没有对应的转化事件,两条路都拿不到, 需要先加埋点。这个空格每周提醒我一次这件事还没做,比我在某个文档里写一行 TODO 管用。

设计四:什么都没做的时候,必须闭嘴

这套系统里的定时 agent 每半小时醒一次。如果它每次醒来都汇报一句"本轮无事可做", 一天就是 48 条。

连续看三天这种消息,你的大脑会自动把这个群标记为噪音。而它下一次发的可能是 "支付回调挂了"。

所以规则文件里有这么一条:

  • 真的改了代码 / 完成了任务 / 新标记了人工事项 / 回复了人的提问 → 发通知
  • 什么都没做 → 不发通知,直接退出
  • trello-done.pytrello-flag.py 自带通知,不要再重复发一条

最后那一句是踩过的坑:完成任务的脚本本身就会发通知,agent 完成之后又"总结性地" 发一条,同一件事在群里出现两遍。两遍比一遍更烦,因为你得读完第二条才能确认它是重复的。

通知的价值和它的数量成反比。 一天 3 条、条条都要看,好过一天 48 条、条条都跳过。 "这一轮什么都没做"是一个完全正常的结果,正常的结果不需要广播。

设计五:但是"完全没有消息"必须告警

上面那条反过来就是个陷阱:如果沉默是正常的,那系统彻底死了的时候,我看到的也是沉默。

这套系统真的这么死过一次,而且死得非常安静。

两条定时线各自有一把锁,防止上一轮没跑完时下一轮又进来。有一次 claude -p 卡住了, 进程不退出、锁不释放,之后每一轮启动都被挡在门外,日志里只留下一行:

上一次仍在进行中,跳过

这行日志属于正常路径。 它每天都会出现几次——真有长任务在跑的时候本来就该这样。 所以没有任何监控会对它报警,而我不主动去翻日志,根本不会发现"跳过"这两个字 已经连着出现了几百次。

修法是给两条线都套上 timeout(评论线 30 分钟,扫描线 45 分钟),超时进程被杀、 锁释放,timeout 按退出码 124 返回,脚本捕获这个码之后主动发一条告警到群里

这就补上了最后一个窟窿:系统正常时安静,系统死掉时出声。

顺带说一句,这两个超时值都做成了可以用环境变量覆盖的(COMMENT_WATCH_TIMEOUT / DAILY_AGENT_TIMEOUT)。不是为了灵活,是为了以后真需要跑一个长任务时, 我不用去改脚本——改脚本容易顺手改坏别的。

把五条规则收成一句话

如果只能留一句,我会留这句:

让汇报这件事本身,不依赖被汇报的那个 AI 的诚实。

日报的内容来自看板的客观记录,不来自 agent 的自我总结;指标取不到就空着, 不许填;沉默有明确的语义,而彻底的沉默会被超时机制变成响声。

这些加起来的效果是:我每天早上花两分钟看一眼群消息,就能知道这套系统昨天动没动、 动的是不是赚钱的事。剩下的时间我不需要想着它。

这种"不需要想着它"的状态,才是把活交给 AI 真正的收益。 如果你得每天登进去 看看它有没有在跑,那你只是把一份工作换成了另一份。

下一篇打算写这套系统在内容这一块的完整流水线:从选题排期到成稿、配图、发布、 回填数据,中间人到底还剩几个动作。

想给自己的团队搭一套?

这套系统是我给自己 12 个产品用的。现在我把同一套东西搭进别人的公司:

  • 一块属于你自己的看板:AI 在里面领任务、写稿、配图、发布、汇报,进度你随时能看
  • 一套它不会闯祸的规则:谁能发、发之前过几道闸、出问题多久告警,全部写死在规则文件里
  • 每周 30 分钟的你:审方向、点发布。剩下的活它自己干
  • 按月交付内容和数据:不是「给你一个会写字的 AI」,是内容条数、搜索展现、转化数据一起交

价格:启动包 ¥3,000 起(搭板 + 规则 + 跑通第一轮),月度方案 ¥5,000 起(持续产出 + 数据复盘)。 首批 3 个创始客户 8 折,我会按你的行业把规则调到能用为止。

下一步:到 bumo.cc/issue 找我——微信客服、在线客服、 商务邮箱都在那一页,挑你顺手的那个,说一句「想聊 AI 自动化交付」就行。 20 分钟聊完你至少能带走一张「你的内容流水线该长什么样」的一页纸,不合适也不亏。

想先自己动手也完全可以。这套流水线调用的模型能力全部来自 不墨 AI——一个订阅同时用 GPT / Claude / Gemini / DeepSeek / Kimi, 写稿、起标题、做摘要这些活它都能接。