把 DeepSeek 和 Kimi K3 当私人助理用了 7 天:每天让它干了什么、哪天翻车了、第 7 天还留下来的是哪几件事——一份不美化的日记
先说结论,免得你被标题骗到最后:7 天下来,AI 真的替我省了时间的事有 6 件,明显浪费时间的有 5 件,剩下的算打平。 它不是「改变生活」,更像一个反应很快、记性很差、偶尔一本正经胡说的实习生。
下面按天写。用的是不墨 AI 助手里的 DeepSeek V4.1 和 Kimi K3——前者用来「想」,后者用来「读」——没有额外装任何东西。每天记三栏:扔给它的事、结果、我的评分。
周一:让它接管我的日程
扔给它的事:把我这周所有要做的事口述一遍(大概 20 条,混着工作和家里的),让它排成一张按天的表。
提示词就是一段乱糟糟的口述:
下面是我这周要干的事,顺序随便说的,请帮我整理成周一到周日的表格,每天不超过 5 件,固定时间的排在前面,能批量的合并,并标出哪几件你觉得可以不做或者可以往后拖:
[口述的 20 条]
结果:表排出来了,30 秒。它把三件「找人」的事合到了同一天下午,把「续车险」标成「可拖到下周」——这个判断是对的,车险还有 12 天到期。
翻车点:它把周三的「家长会」排在了晚上 7 点,但我原话说的是「周三家长会」没说时间,它自己补了一个。AI 补细节的时候不会告诉你这是它补的。 我后来回学校群一查,是下午 4 点半。
评分:省了大概 20 分钟;但要养成「凡是它填的具体时间、金额、人名,都回原始信息核一遍」的习惯。
周二:让它替我回邮件和消息
扔给它的事:4 封需要回复的邮件(2 封工作、1 封物业、1 封给孩子老师),还有家庭群里一条要转发的通知。
结果:
- 工作邮件两封:粘进去原邮件,让它「按我平时的语气回,不超过 5 句,先答问题再说下一步」。改了两个词就发了。这是全周最省时间的一项。
- 物业那封:让它写「反映楼道灯坏了、要求 3 天内修好」,它写得像律师函,太硬。改成「语气正常一点,就是邻居跟物业说话」之后才能用。
- 给老师那封:这封我没让它写。写到一半觉得不对,老师能一眼看出来是 AI 写的,这种关系里的信不值得省这 3 分钟。
- 家庭群通知:让它把 300 字的居委会通知压成 3 行,转发给家里老人。这个很好,老人反而看懂了。
评分:工作邮件和压缩通知强烈推荐;涉及人情关系的信自己写。
周三:让它管买菜和做饭
扔给它的事:冰箱里有什么拍下来口述给它,让它安排三天晚饭并生成购物清单。
结果:它列了 3 天 6 道菜,购物清单按「菜/肉/调料」分好类。问题在于它不知道我家的口味:第一版有两道菜家里没人吃。加了一句「不吃香菜、孩子不吃辣、老人不吃海鲜」之后,第二版可以直接用。
翻车点:清单里有「鸡胸肉 300 克」,做的菜是给 4 个人的。让它复核,它承认「应为 600 克」。AI 做数量估算的时候经常偏小,凡是有数量的,问它一句「按 4 个人的量够吗」。
评分:值得。前提是第一次就把家里的忌口告诉它,之后每次开头粘同一段。
周四:让它读一份 40 页的保险合同
扔给它的事:给孩子买的一份医疗险,PDF 40 页,我想知道「哪些情况不赔」和「等待期多久」。
结果:这是 Kimi K3 的活。上传 PDF,问:
请只回答两个问题,每个答案都注明在第几页第几条:
1. 免责条款里明确列出的不赔情况有哪些?
2. 等待期是多少天,哪些情况不受等待期限制?
3 分钟内答完,共 11 条免责、等待期 90 天、意外不受等待期限制,全部标了页码。我按页码翻了 4 条,都对。
翻车点:它漏了一条藏在「释义」章节里的免责(关于既往症的定义)。AI 读合同抓「明确列出的」很稳,但「通过定义间接排除的」经常漏。 补一句「释义章节里有没有影响赔付范围的定义」才把它挖出来。
评分:全周最有价值的一天。不是替我省了时间,是我自己根本不会去读那 40 页。
周五:让它写周报和陪孩子写作业
扔给它的事:上午把这周做的事列 8 条让它写周报;晚上孩子有道数学题不会。
结果:
周报:粘 8 条流水,让它「按结果/进展/下周计划分三段,每段不超过 3 句,别用成语」。可以直接发。这个用法我之前就在AI 写周报里写过,不重复。
作业:翻车了。 一道四年级的鸡兔同笼,我让 DeepSeek「用四年级能懂的方法讲」,它上来就设未知数解方程。改了两次提示词才让它用「假设全是鸡」的方法。辅导作业这件事,AI 默认按最省它自己力气的方法讲,而不是按孩子的年级讲。 提示词里要明确「不能用方程」「只能用加减乘除」。
评分:周报 5 分;作业 3 分,能用但每次要纠。
周六:让它做一次家庭开支复盘
扔给它的事:把这个月的银行流水(导出的 CSV,大概 200 行)传给它,让它按类别汇总,并指出哪类花超了。
结果:汇总是对的(我用 Excel 抽查了 3 个类别的合计),「外卖比上月多 40%」这个结论也对。
翻车点:它把「转账给我妈」归进了「餐饮」,因为备注里写的是「买菜钱」。这种分类错误只有你自己能看出来,AI 不知道你家的钱怎么流。让它「把分类结果列成表,每类列出金额最大的 5 笔」之后我才发现。
评分:4 分。汇总和趋势可信,分类必须人工抽查。更完整的做法在家庭预算和记账里。
周日:让它规划下周,并回顾这周
扔给它的事:把这周日记里的所有「翻车点」粘给它,问它「下周我该怎么用你,才能少犯这些错」。
结果:它总结了 4 条,我认可其中 3 条:
- 凡是它补的具体信息(时间、数量、人名),一律回原始材料核
- 第一次就把长期不变的背景(忌口、家庭成员、公司习惯)写成一段,之后每次开头粘
- 涉及数量的答案,追问一句「按 X 人 / X 天的量够吗」
- (它自己建议的)「把所有事都交给我」——这条我不认可,见下面放弃的 5 件
评分:这种「让 AI 复盘自己」的用法出乎意料地有用,它比我更清楚它自己错在哪一类。
第 7 天还留下来的 6 件事
这 6 件是一周之后我还在每天用的,按省时间多少排:
| 事 | 用哪个 | 每次省多少 | 关键前提 |
|---|---|---|---|
| 回工作邮件 | DeepSeek | 5-10 分钟/封 | 粘原邮件 + 说明语气 |
| 读长合同 / 长文档 | Kimi K3 | 1-2 小时/份 | 要求标页码 + 追问「释义」 |
| 压缩通知转发给老人 | DeepSeek | 3 分钟/条 | 「3 行以内、不用专业词」 |
| 排周计划 | DeepSeek | 20 分钟/周 | 它填的时间全部核 |
| 写周报 | DeepSeek | 15 分钟/周 | 给它流水,不给它「感想」 |
| 月度开支汇总 | DeepSeek | 30 分钟/月 | 分类必须抽查 |
已经放弃的 5 件事
这 5 件试过,一周之后不再用了:
- 写给有人情关系的人的信(老师、亲戚、老朋友)。对方看得出来,省的 3 分钟不值。
- 辅导作业的第一遍讲解。它讲的方法经常超纲,孩子听完更乱。现在只用它出「同类型的练习题」,讲解还是自己来。
- 让它「主动提醒」。它没有这个能力,聊天窗口关了它就什么都不记得。提醒还是用手机自带的。
- 让它替我做决定。周三问它「这两个课外班选哪个」,它给了一篇四平八稳的对比,最后一句是「取决于您的具体需求」。它擅长列选项,不擅长替你选。
- 口述式记账。每天跟它说「今天花了 xx」,它记不住,第二天就没了。它没有长期记忆,这种事要用真正的记账 App。
如果你也想试一周
三条建议:
第一,先写一段「我的背景」存好。 家里几口人、忌口、公司的汇报习惯、你常用的语气,写成 200 字。每次开新对话先粘这段。我周一没做这件事,周三才补上,前两天的很多翻车都是因为它不知道这些。
第二,把「它填的」和「你给的」分开看。 AI 回答里所有你没提供过的具体信息——时间、数字、人名、页码——都是它补的,都要核。这一周 5 次翻车里 4 次是这个原因。
第三,读文档类的事用 Kimi K3,想事情、写东西用 DeepSeek。 前者上传文件能力更稳,长文档实测在Kimi K3 长文档实战里写过;后者推理和写作更顺,看DeepSeek R1 推理实战。两个在同一个页面里切换,不用来回跳。
不用装软件,不用会员,打开不墨 AI 助手就能开始你的周一。