← 返回博客

把 DeepSeek 和 Kimi K3 当私人助理用了 7 天:每天让它干了什么、哪天翻车了、第 7 天还留下来的是哪几件事——一份不美化的日记

2026-09-27 · 10 分钟阅读
DeepSeekKimi K3私人助理一周体验日记效率工具日程管理提示词翻车免费国产模型

先说结论,免得你被标题骗到最后:7 天下来,AI 真的替我省了时间的事有 6 件,明显浪费时间的有 5 件,剩下的算打平。 它不是「改变生活」,更像一个反应很快、记性很差、偶尔一本正经胡说的实习生。

下面按天写。用的是不墨 AI 助手里的 DeepSeek V4.1 和 Kimi K3——前者用来「想」,后者用来「读」——没有额外装任何东西。每天记三栏:扔给它的事、结果、我的评分。

周一:让它接管我的日程

扔给它的事:把我这周所有要做的事口述一遍(大概 20 条,混着工作和家里的),让它排成一张按天的表。

提示词就是一段乱糟糟的口述:

下面是我这周要干的事,顺序随便说的,请帮我整理成周一到周日的表格,每天不超过 5 件,固定时间的排在前面,能批量的合并,并标出哪几件你觉得可以不做或者可以往后拖:
[口述的 20 条]

结果:表排出来了,30 秒。它把三件「找人」的事合到了同一天下午,把「续车险」标成「可拖到下周」——这个判断是对的,车险还有 12 天到期。

翻车点:它把周三的「家长会」排在了晚上 7 点,但我原话说的是「周三家长会」没说时间,它自己补了一个。AI 补细节的时候不会告诉你这是它补的。 我后来回学校群一查,是下午 4 点半。

评分:省了大概 20 分钟;但要养成「凡是它填的具体时间、金额、人名,都回原始信息核一遍」的习惯。

周二:让它替我回邮件和消息

扔给它的事:4 封需要回复的邮件(2 封工作、1 封物业、1 封给孩子老师),还有家庭群里一条要转发的通知。

结果:

  • 工作邮件两封:粘进去原邮件,让它「按我平时的语气回,不超过 5 句,先答问题再说下一步」。改了两个词就发了。这是全周最省时间的一项。
  • 物业那封:让它写「反映楼道灯坏了、要求 3 天内修好」,它写得像律师函,太硬。改成「语气正常一点,就是邻居跟物业说话」之后才能用。
  • 给老师那封:这封我没让它写。写到一半觉得不对,老师能一眼看出来是 AI 写的,这种关系里的信不值得省这 3 分钟。
  • 家庭群通知:让它把 300 字的居委会通知压成 3 行,转发给家里老人。这个很好,老人反而看懂了。

评分:工作邮件和压缩通知强烈推荐;涉及人情关系的信自己写。

周三:让它管买菜和做饭

扔给它的事:冰箱里有什么拍下来口述给它,让它安排三天晚饭并生成购物清单。

结果:它列了 3 天 6 道菜,购物清单按「菜/肉/调料」分好类。问题在于它不知道我家的口味:第一版有两道菜家里没人吃。加了一句「不吃香菜、孩子不吃辣、老人不吃海鲜」之后,第二版可以直接用。

翻车点:清单里有「鸡胸肉 300 克」,做的菜是给 4 个人的。让它复核,它承认「应为 600 克」。AI 做数量估算的时候经常偏小,凡是有数量的,问它一句「按 4 个人的量够吗」。

评分:值得。前提是第一次就把家里的忌口告诉它,之后每次开头粘同一段。

周四:让它读一份 40 页的保险合同

扔给它的事:给孩子买的一份医疗险,PDF 40 页,我想知道「哪些情况不赔」和「等待期多久」。

结果:这是 Kimi K3 的活。上传 PDF,问:

请只回答两个问题,每个答案都注明在第几页第几条:
1. 免责条款里明确列出的不赔情况有哪些?
2. 等待期是多少天,哪些情况不受等待期限制?

3 分钟内答完,共 11 条免责、等待期 90 天、意外不受等待期限制,全部标了页码。我按页码翻了 4 条,都对。

翻车点:它漏了一条藏在「释义」章节里的免责(关于既往症的定义)。AI 读合同抓「明确列出的」很稳,但「通过定义间接排除的」经常漏。 补一句「释义章节里有没有影响赔付范围的定义」才把它挖出来。

评分:全周最有价值的一天。不是替我省了时间,是我自己根本不会去读那 40 页。

周五:让它写周报和陪孩子写作业

扔给它的事:上午把这周做的事列 8 条让它写周报;晚上孩子有道数学题不会。

结果:

周报:粘 8 条流水,让它「按结果/进展/下周计划分三段,每段不超过 3 句,别用成语」。可以直接发。这个用法我之前就在AI 写周报里写过,不重复。

作业:翻车了。 一道四年级的鸡兔同笼,我让 DeepSeek「用四年级能懂的方法讲」,它上来就设未知数解方程。改了两次提示词才让它用「假设全是鸡」的方法。辅导作业这件事,AI 默认按最省它自己力气的方法讲,而不是按孩子的年级讲。 提示词里要明确「不能用方程」「只能用加减乘除」。

评分:周报 5 分;作业 3 分,能用但每次要纠。

周六:让它做一次家庭开支复盘

扔给它的事:把这个月的银行流水(导出的 CSV,大概 200 行)传给它,让它按类别汇总,并指出哪类花超了。

结果:汇总是对的(我用 Excel 抽查了 3 个类别的合计),「外卖比上月多 40%」这个结论也对。

翻车点:它把「转账给我妈」归进了「餐饮」,因为备注里写的是「买菜钱」。这种分类错误只有你自己能看出来,AI 不知道你家的钱怎么流。让它「把分类结果列成表,每类列出金额最大的 5 笔」之后我才发现。

评分:4 分。汇总和趋势可信,分类必须人工抽查。更完整的做法在家庭预算和记账里。

周日:让它规划下周,并回顾这周

扔给它的事:把这周日记里的所有「翻车点」粘给它,问它「下周我该怎么用你,才能少犯这些错」。

结果:它总结了 4 条,我认可其中 3 条:

  1. 凡是它补的具体信息(时间、数量、人名),一律回原始材料核
  2. 第一次就把长期不变的背景(忌口、家庭成员、公司习惯)写成一段,之后每次开头粘
  3. 涉及数量的答案,追问一句「按 X 人 / X 天的量够吗」
  4. (它自己建议的)「把所有事都交给我」——这条我不认可,见下面放弃的 5 件

评分:这种「让 AI 复盘自己」的用法出乎意料地有用,它比我更清楚它自己错在哪一类。

第 7 天还留下来的 6 件事

这 6 件是一周之后我还在每天用的,按省时间多少排:

事用哪个每次省多少关键前提
回工作邮件DeepSeek5-10 分钟/封粘原邮件 + 说明语气
读长合同 / 长文档Kimi K31-2 小时/份要求标页码 + 追问「释义」
压缩通知转发给老人DeepSeek3 分钟/条「3 行以内、不用专业词」
排周计划DeepSeek20 分钟/周它填的时间全部核
写周报DeepSeek15 分钟/周给它流水,不给它「感想」
月度开支汇总DeepSeek30 分钟/月分类必须抽查

已经放弃的 5 件事

这 5 件试过,一周之后不再用了:

  1. 写给有人情关系的人的信(老师、亲戚、老朋友)。对方看得出来,省的 3 分钟不值。
  2. 辅导作业的第一遍讲解。它讲的方法经常超纲,孩子听完更乱。现在只用它出「同类型的练习题」,讲解还是自己来。
  3. 让它「主动提醒」。它没有这个能力,聊天窗口关了它就什么都不记得。提醒还是用手机自带的。
  4. 让它替我做决定。周三问它「这两个课外班选哪个」,它给了一篇四平八稳的对比,最后一句是「取决于您的具体需求」。它擅长列选项,不擅长替你选。
  5. 口述式记账。每天跟它说「今天花了 xx」,它记不住,第二天就没了。它没有长期记忆,这种事要用真正的记账 App。

如果你也想试一周

三条建议:

第一,先写一段「我的背景」存好。 家里几口人、忌口、公司的汇报习惯、你常用的语气,写成 200 字。每次开新对话先粘这段。我周一没做这件事,周三才补上,前两天的很多翻车都是因为它不知道这些。

第二,把「它填的」和「你给的」分开看。 AI 回答里所有你没提供过的具体信息——时间、数字、人名、页码——都是它补的,都要核。这一周 5 次翻车里 4 次是这个原因。

第三,读文档类的事用 Kimi K3,想事情、写东西用 DeepSeek。 前者上传文件能力更稳,长文档实测在Kimi K3 长文档实战里写过;后者推理和写作更顺,看DeepSeek R1 推理实战。两个在同一个页面里切换,不用来回跳。

不用装软件,不用会员,打开不墨 AI 助手就能开始你的周一。