10 道题测你会不会用国产 AI:每题一个真实场景、四个选项,附答案和解析——做完就知道自己卡在哪一层
先说规则:每题只选一个,选完再看解析,别先翻答案。 10 题大约 8 分钟。题目里的场景都是我和身边人真实遇到过的,选项里的错误答案也都是真有人选过的。
做题用的模型不限,DeepSeek V4.1、Kimi K3、通义千问、GLM-5.1 的用法在这 10 题上基本一致;如果你还没定用哪个,国产大模型怎么选里有按任务分的表。
第 1 题:周报
周五下午,你要交一份周报。这周你做了五件事,其中两件没做完。你打开 AI,第一句话应该是:
- A. 「帮我写一份周报」
- B. 「帮我写一份周报,我是做运营的」
- C. 「帮我写周报。这周做了:①②③④⑤(各一句话),其中④⑤没做完,原因是……。格式按:本周完成 / 未完成及原因 / 下周计划。语气平实,不要用『赋能』『抓手』这类词。」
- D. 先问它「你觉得周报应该怎么写」,再让它写
答案:C
解析:A 和 B 得到的都是模板,你还得往里填内容,等于没省事。D 是浪费一轮。C 的关键不是长,是把「素材、格式、语气」三样一次给全。 尤其是「哪两件没做完、为什么」——这是周报里最难写的部分,也是 AI 最能帮你措辞的部分,但你不说它不知道。周报的完整写法在用 AI 写周报、月报、工作总结。
第 2 题:查数据
你想知道「今年上半年新能源车的销量是多少」。正确的做法是:
- A. 直接问 AI,它给多少就是多少
- B. 问 AI,然后让它「给出数据来源」
- C. 开联网搜索再问,看它引用的是哪个网页,点进去核一遍
- D. AI 不能查数据,只能自己去搜
答案:C
解析:A 是最常见的翻车方式——不开联网时它给的数字是「看起来合理的编造」。B 更危险:你让它给来源,它会给你一个看起来像真的来源(某协会某月发布),但那个来源可能不存在。D 太绝对,开了联网它能搜到,只是你要点进去看原文。 联网怎么开、什么时候该开,见DeepSeek 联网搜索怎么用。
第 3 题:算账
你要算一笔账:年终奖 3.6 万,单独计税和并入综合所得哪个划算。你会:
- A. 直接问它「哪个划算」,信它的结论
- B. 让它「列出两种算法的每一步公式和中间结果」,自己顺着核一遍
- C. 这种问题 AI 算不了,自己查税率表
- D. 让它算三遍,三次答案一样就信
答案:B
解析:多步带条件的计算是国产模型的共同弱项,它会在某一步用错一个数然后自信地给你结论。D 看起来聪明,但它三次都可能犯同一个错——尤其是年终奖临界点这种题。C 太保守,它列公式是靠谱的,错的是代数。让它出过程、你核数字,是所有涉及钱的问题的标准做法。 四个模型在这类题上的实际表现,看5 道生活算术题横评。
第 4 题:改文案
你写了一段 300 字的活动通知,觉得太生硬,想让它改得亲切一点。你会说:
- A. 「帮我改一下」
- B. 「改得亲切一点」
- C. 「改得亲切一点,保留所有时间地点和报名方式不变,字数不超过原文,不要加感叹号和表情」
- D. 「你觉得这段话有什么问题?」
答案:C
解析:A 和 B 的结果是:它把你的通知改成了一篇 500 字的小作文,时间地点还给你改了措辞。改写类任务的关键是说清「什么不能动」,不然它默认全都可以动。「不加感叹号和表情」是因为国产模型一听「亲切」就往那个方向跑。D 有用,但是下一步,不是第一步。改写题的横评在5 道改写润色题横评。
第 5 题:读合同
房东给你一份 12 页的租房合同,你想让 AI 帮你看看有没有坑。你会:
- A. 拍 12 张照片传上去
- B. 把合同 PDF 或 Word 原文件传上去,问「这份合同对租客有哪些不利条款,逐条列出原文和页码」
- C. 把合同 PDF 传上去,问「这份合同能签吗」
- D. 手动把重点条款打字输进去
答案:B
解析:A 的问题是图片识别对数字、金额、日期的错误率高,「押二付一」识别成「押一付一」你根本发现不了。C 是把判断权交给它,它会回你一段「总体来说风险可控,建议注意以下几点」的车轱辘话。B 的关键有两个:传原文件不传截图;要「原文 + 页码」而不是要「结论」,这样你能回到合同里逐条核对。 D 太累,而且你会漏掉自己没注意的条款。传文件的方法在DeepSeek 上传文件读 PDF/Word/Excel,审合同的完整问法在用 AI 审合同。
第 6 题:它答错了
你问它一个问题,它答得很笃定,但你确定它答错了。你会:
- A. 说「你错了」,让它重答
- B. 说「你错了,正确答案是 X」,然后继续问下一个问题
- C. 说「你错了」,它道歉后给了另一个答案,你就信第二个
- D. 关掉对话,开一个新对话重新问,这次把你知道的正确信息放进问题里
答案:D
解析:A 和 C 是同一个坑——你说它错了,它一定会道歉并换一个答案,但换的那个不一定对,它只是在迎合你。 B 好一点,但错误信息还留在对话历史里,后面的回答可能被污染。D 是最干净的:错了就换个对话,把正确的前提写进第一句。 这一条大多数人不知道,也是「越聊越乱」的根源,在用国产 AI 最常犯的 12 个错误里排第 3。
第 7 题:长文档
你有一份 80 页的行业报告要读,只想知道「里面关于华东市场的部分说了什么」。你会:
- A. 让它「总结这份报告」
- B. 传上去,问「这份报告里所有提到华东市场的段落,原文摘出来,标页码」
- C. 传上去,问「华东市场怎么样」
- D. 自己 Ctrl+F 搜「华东」
答案:B
解析:A 得到的是全文摘要,华东可能只占一句话。C 得到的是它「基于报告的理解」,你不知道哪句是报告说的、哪句是它补的。B 要的是「原文 + 页码」——和第 5 题一样的逻辑:凡是要拿来用的,都要它指回原文。 D 其实不差,但报告里可能写的是「江浙沪」「长三角」而不是「华东」,AI 能理解同义,Ctrl+F 不能。80 页这种长度 Kimi K3 处理起来最稳,见Kimi K3 的 100 万上下文到底能干什么。
第 8 题:让它像你
你要给一个熟客发一条微信,想让 AI 帮你写,但不想让对方看出是 AI 写的。你会:
- A. 让它写,然后告诉它「写得像人一点」
- B. 把你之前给这个客户发过的三条微信粘给它,说「模仿这个语气,写一条关于 X 的」,然后自己再删掉多余的客气话
- C. 让它写三个版本,选最短的那个
- D. 熟客的微信自己写,不用 AI
答案:B(D 也算对)
解析:A 没用,「像人一点」对它来说没有可操作的含义。C 短不等于像人。B 是唯一能让它「像你」的办法:给样本。三条足够,一条不够。 写完自己删一遍,因为它总比你多 10% 的客套。D 也对——给熟人的东西自己写是最省事的,AI 只用来「帮我想三个开头」。这道题的深层逻辑是「国产 AI 写不出像你的东西」,在国产 AI 做不好的 10 件事里排第 8。
第 9 题:多轮对话
你在一个对话里已经跟它聊了 40 多轮,从「帮我写个方案」聊到「改第三段」再到「把预算表也做了」。现在你发现它开始忘记最开始定的方案目标。你会:
- A. 提醒它「别忘了我们最开始说的目标是 X」,继续聊
- B. 骂它一句「你怎么记性这么差」
- C. 开新对话,第一句把「目标 + 目前已定的结论 + 现在要做的事」写成一段 200 字,粘进去
- D. 把前面 40 轮全部复制到新对话里
答案:C
解析:A 短期有效,但对话越长它忘得越快,你会不停地提醒。D 把一堆已经没用的中间过程也带进去了,新对话很快又会满。C 是唯一可持续的做法:每聊到一个阶段,就把「结论」提炼成一段,开新对话从那段开始。 这个习惯我在一周私人助理日记里翻了两天车才学会。
第 10 题:要不要信
它给了你一段回答,里面有一个具体的法条号、一个百分比、一个人名。你会:
- A. 都信,它说得这么具体,不可能编
- B. 都不信,AI 说的都不能用
- C. 凡是它给的、你没提供过的「具体信息」(编号、数字、人名、日期、书名),全部标记为待核实,核完再用
- D. 只核法条号,数字和人名一般不会错
答案:C
解析:A 是所有翻车里最惨的那种——具体不等于真实,它编的东西和真的一样具体。 B 走向另一个极端,那你就没法用它了。D 的分类是错的:它编数字和人名的概率不比编法条号低。C 就是一条铁律:它回答里所有「你没告诉过它」的具体信息,都当成待核实的。 核实的成本远低于信错的成本。这条铁律在国产 AI 新手 30 问里也讲过。
对答案:你在哪一层
每题 1 分(第 8 题选 D 也给分),算一下总分:
0–3 分:还在「搜索引擎层」
你把 AI 当成一个会说话的百度:问一句、拿一个答案、信或不信。这一层最常见的问题是第 2、3、10 题——不知道它会编,或者知道但没有核实的习惯。下一步只补一件事:养成「它给的具体信息都要核」的习惯。 先读用国产 AI 最常犯的 12 个错误。
4–6 分:到了「模板层」
你知道要把素材给全、知道要说清格式,但对「它什么时候不靠谱」还没有直觉。典型是第 1、4 题对了,第 6、9 题错了——会问,但不会处理「它答错了」和「它忘了」这两种情况。下一步补的是:错了换对话、长了开新篇、要过程不要结论。 读DeepSeek 提示词怎么写。
7–8 分:「工具层」
你能稳定地从它那里拿到能用的东西,也知道它的边界。差的那两三题多半是第 5、7 题(没养成「要原文要页码」的习惯)或第 8 题(没试过给样本)。下一步是把它用进你的具体工作流——按你的职业找对应的文章:程序员、HR、销售、老师、财务。
9–10 分:「同事层」
你已经把它当成一个「需要交代清楚、需要核对产出、但确实能省时间」的同事在用。这一层没什么要补的,剩下的是选对模型:不同任务用不同模型,见Kimi K3 和 DeepSeek 哪个好、通义千问和 DeepSeek 哪个好。
这 10 题背后其实只有 4 条规则
回头看,10 道题的正确答案都落在 4 条规则上:
- 素材给全、格式说清、什么不能动说明白(第 1、4 题)
- 要过程、要原文、要页码,不要结论(第 3、5、7 题)
- 它编的东西和真的一样具体,没告诉过它的都要核(第 2、10 题)
- 错了换对话、长了开新篇、要像你就给样本(第 6、8、9 题)
这 4 条记住了,模型换哪个都一样能用。四个模型在不墨 AI 助手里可以直接切换,免费在线,不用装软件——做完题正好拿第 1 题的周报去试一遍。