国产 AI 用不了、答非所问、文件读不出来?13 种症状的排错手册:每种症状按「先查什么 → 再查什么 → 还不行换什么」走一遍
写过很多「怎么把国产 AI 用好」,今天反过来写一篇「为什么用不了」。
后台的求助消息里,真正的产品 bug 其实不多,大多数是「症状」和「原因」之间隔了一层,用户看到的是症状,解决办法却在另一个地方。 比如「答非所问」,一半是提示词的问题,三成是模型选错了,剩下的才是模型本身的能力边界。
所以这篇按修电脑的方式写:每种症状给一条排查路径,从最可能、最好查的原因开始,一步一步往下走。 你不需要读完全文,对着目录找自己的症状就行。
先说一下我们的立场:这篇里提到「换一个模型试试」的地方,是因为我们做的聚合平台本身就是在一个窗口里切模型的,所以这一步对我们的用户是零成本。但排查思路本身是通用的,你在各家官网上也能照着做。
一、打不开 / 一直转圈 / 白屏
先查:是不是所有网站都慢。 打开一个别的网站对比。如果都慢,是你的网络,不是 AI 的问题。
再查:换个浏览器或者无痕模式。 白屏最常见的原因是浏览器插件(尤其是广告拦截、翻译类插件)拦了页面脚本。无痕模式下插件默认关闭,能打开就是插件的问题。
再查:是不是在公司网络。 不少公司的网络会拦截 AI 类域名,换手机热点试一下就知道。
还不行: 看看那家的官方公告或者社交账号,大的服务中断一般会有说明。如果只是某一家挂了,换一家用,别死等。
二、「服务器繁忙,请稍后再试」
这条在 DeepSeek 官网上出现得最多,尤其是工作日上午 9 点到 11 点和晚上 8 点到 10 点这两个高峰。
先查:现在是不是高峰时段。 是的话,要么等 20 分钟,要么换时间。
再查:你的问题是不是很长。 长问题(比如贴了几千字让它处理)在高峰期更容易被拒。可以先发一个短的试试能不能通,再发长的。
还不行: 我在DeepSeek 服务器繁忙怎么办里专门写过 5 个办法,包括用第三方平台接入的满血版——负载和官网不是一条线,官网繁忙的时候第三方往往是通的。
一个常见误区: 「繁忙」不等于「模型变笨了」。有人在高峰期好不容易发出去一条,得到的答案不满意,就归因为「高峰期回答质量下降」——不是的,答案质量和排队没关系,是你那条问题本身的问题,去看第四节。
三、回答到一半突然断了
先查:是不是触发了输出长度上限。 每家模型单次回答都有字数上限,让它「写一篇 5000 字的文章」大概率写到一半就停。解决办法是分段: 先要大纲,再一节一节要。
再查:是不是网络抖了一下。 刷新页面,看回答有没有保存下来。大多数平台会保存已经生成的部分。
再查:是不是你自己点了停止。 手机上误触很常见。
接上的方法: 直接说「继续」或者「从「XXX」这句话接着往下写」,一般都能接上。但接上的部分和前面的风格可能有一点点不一致,重要的文档接完之后通读一遍。
四、答非所问
这是最大的一类,也是最容易被误判成「模型不行」的一类。按下面顺序查:
先查:你的问题里有没有「模糊词」。 「帮我优化一下」「写得好一点」「弄个方案」——这些词对人是有上下文的,对模型是没有的。改法:把「好」换成具体标准。 「优化一下」改成「压缩到 200 字以内,去掉所有形容词,保留数据」。我在12 个常见错误里第 1 到第 4 条都是这个问题的变体。
再查:你是不是在一个很长的对话里问的。 对话越长,模型越容易被前面的内容带偏。改法:新开一个对话,把这个问题单独问一遍。 如果新对话里答对了,说明是前文干扰,不是模型不行。
再查:你是不是用错了模型。 每家模型都有自己擅长和不擅长的,让擅长写作的模型算账、让推理模型写文案,都会给你「看起来在回答但没答到点上」的输出。对照一下国产大模型怎么选里的分工表。
还不行: 把问题原样换一个模型问。如果两个模型都答非所问,问题大概率在你的提问上;如果只有一个答错,那就是那个模型的短板,记下来以后绕开。
五、文件传了,它说「没有收到文件」或者答的和文件内容对不上
先查:文件格式。 PDF、Word、Excel、TXT 这几种基本都支持;但扫描版 PDF(本质是图片)很多模型读不了文字,需要先 OCR。判断方法:用 PDF 阅读器打开,能不能选中文字。选不中就是扫描版。
再查:文件大小和页数。 每家有各自的上限,超了不一定报错,有时候是静默截断——它只读了前面一部分,后面的内容根本没进去,然后基于前半部分回答你。解决办法: 问它「这份文件最后一段讲的是什么」,如果答不出来,就是截断了。长文件优先用 Kimi K3,见Kimi K3 长文档实战。
再查:你是不是在传完文件之后又开了新对话。 文件只在当前对话里有效。
再查:Excel 里是不是有合并单元格、多个 sheet。 合并单元格会让表格结构错乱,多 sheet 的话模型可能只读了第一个。把要分析的 sheet 单独另存一份再传。
还不行: 把文件里最关键的部分复制成文字贴进对话框,绕过文件解析。这是最土但最可靠的办法。更多细节在DeepSeek 上传文件读不了。
六、让它联网查,它说「我无法访问互联网」或者查到的是旧信息
先查:联网功能开了没有。 大多数平台的联网是一个要手动打开的开关,默认关着。找一下输入框附近有没有「联网」「搜索」之类的按钮。
再查:你的问题里有没有明确要求它查。 有的模型开了联网也不一定每次都查,要在问题里说「请联网搜索最新的……」。
再查:它查到的来源是什么。 让它「列出你参考的网页链接」。如果给不出链接,或者链接打不开,那这次「联网」很可能是编的。
还不行: 换一个模型查同一个问题,比对两边给的来源。联网的坑我在DeepSeek 联网搜索怎么用里写得更细。
七、中英文混着答,或者莫名其妙开始说英文
先查:你的问题里有没有英文。 只要问题里出现了英文单词(哪怕是一个产品名),有些模型就会往英文那边偏。改法:在问题末尾加一句「请全程用中文回答」。
再查:是不是让它处理英文材料。 让它总结一篇英文文章,它用英文总结是「顺手」的。同样加一句「用中文总结」。
再查:是不是在长对话里。 对话中途切换语言之后,后面会一直混。新开对话。
特别提醒: 代码类问题里出现英文注释是正常的,不算症状。
八、老是说「我不能」「作为 AI 我无法」
先查:你要它做的事是不是真的在红线上。 医疗诊断、法律判决、投资建议这类,模型会拒绝给「确定性结论」,但会给「参考信息」。改法:不要问「我该吃什么药」,问「这种症状一般有哪些可能的原因,去医院应该挂什么科」。
再查:你的措辞是不是太像在「让它替你做决定」。 「帮我决定」「你说了算」这类表述容易触发拒绝。改成「列出各选项的优缺点,我自己决定」。
再查:换个说法再问一遍。 同一件事,换个角度问,通过率差很多。比如「写一封投诉信」可能被视为对抗性内容,「写一封反映问题的信,语气克制」就通了。
还不行: 换一个模型。各家的边界不一样,同一个问题有的拒有的不拒。这不是钻空子——你要做的事本身是正当的,只是某一家的拦截规则误伤了。
九、算错数,而且很自信
先查:你用的是不是推理模型。 这是最有效的一招。普通对话模型算多步的数(比如房贷月供、复利、个税分档)错误率明显高;推理模型(比如 DeepSeek R1)会一步一步算,准确率高很多。我在5 道生活算术题横评里对比过。
再查:让它把每一步列出来。 在问题里加「请写出每一步的计算过程」。你能看到它在哪一步算错,而且列步骤本身就能降低错误率。
再查:涉及到规则的数(比如个税、社保),规则是不是给它了。 模型记的规则可能是旧的。把当前的税率表、公式贴给它,让它按你给的算。
还不行: 让它写一段代码算,然后运行。或者最简单的——让它列出公式,你自己用计算器按一遍。 涉及到钱的数,永远自己再算一遍。
十、忘了前面说的,或者把前面的内容记错了
先查:对话有多长了。 每个模型能「记住」的对话长度有限,超过之后最早的内容会被挤出去。长对话(超过 30 轮或者贴了很多材料)之后出现这个症状很正常。
解决办法:定期「存档」。 每隔一段就让它「把到目前为止我们确定的要点总结成一份清单」,然后新开一个对话,把清单贴进去作为开头。这样你手里始终有一份干净的上下文。
再查:是不是你在前面改过口。 你第 5 轮说「用正式语气」,第 12 轮说「随意一点」,第 20 轮又抱怨它不正式——它并没有记错,是你的要求前后矛盾了。
还不行: 需要处理超长材料的,换 Kimi K3,它的上下文比其他家长得多。
十一、同一个问题,每次答案都不一样
先判断:这是不是一个「本来就应该有确定答案」的问题。 「北京到上海多少公里」应该稳定;「给我的产品起 5 个名字」不稳定才正常。
如果是应该稳定的问题却不稳定:
- 问题里是不是有多种理解?让它「先复述一遍你理解的问题,再回答」
- 是不是用了普通对话模型算复杂的东西?换推理模型
- 多问几遍,取多数答案。我在稳定性实验里专门测过哪些类型的问题必须多问
如果是创意类问题: 这不是故障,是功能。你要的就是每次不一样。
十二、答案明明是错的,它还说得很笃定
这是 AI 最让人恼火的一种症状,也是最没法「修」的一种——它是模型本身的特性,只能防。
防法一:要求它标注置信度。 在问题里加「对不确定的部分请明确说「我不确定」」。效果不是 100%,但会明显减少瞎编。
防法二:要求来源。 「这个数据的来源是什么」——编的内容往往给不出来源,或者给出的来源一查就不存在。
防法三:反问。 得到答案之后,再问一句「你上面的回答里有没有可能出错的地方」。模型在被反问时自我纠错的概率比第一次回答高。
防法四:分模型交叉验证。 重要的事实性问题,两个模型各问一遍,答案一致才信。
再提醒一次: 涉及钱、健康、法律、合同的,AI 的答案是「起点」不是「终点」。流传最广的 14 个说法里有几条就是关于「AI 说的一定对吗」的。
十三、回答很「水」——大而全但没有一句有用的
先查:你是不是没给背景。 「怎么提高销售额」得到的一定是教科书式的回答;「我开的是社区水果店,客单价 30,复购率 20%,怎么提高销售额」得到的才是能用的。背景信息越具体,答案越具体。
再查:你有没有限制输出形式。 加上「不要总述,直接给 3 条可以明天就做的动作」,水分会少一半。
再查:有没有让它「站在某个角色上」。 「你是一个做了 10 年社区零售的老板」比不加角色的回答实在得多。
还不行: 把它给的「水」答案贴回去,说「这些太泛了,我要的是……」,让它基于第一版改。第二版通常明显好。
排查顺序总表
把上面 13 条压成一张表,遇到问题对着查:
| 症状 | 第一步查 | 第二步查 | 最后换什么 |
|---|---|---|---|
| 打不开 / 白屏 | 网络 | 浏览器插件 / 无痕 | 换一家 |
| 服务器繁忙 | 是否高峰期 | 问题是否太长 | 换第三方接入 |
| 答一半断了 | 输出上限 → 分段 | 网络 / 误触 | 说「继续」 |
| 答非所问 | 问题里的模糊词 | 对话是否太长 → 新开 | 换模型对比 |
| 文件读不出 | 格式(扫描版?) | 大小 / 截断 / sheet | 复制文字贴进去 |
| 联网查不到 | 开关开了没 | 是否明确要求查 | 换模型比对来源 |
| 中英混答 | 问题里有英文 | 材料是英文 | 加「全程中文」 |
| 老说「我不能」 | 是否真在红线上 | 换措辞 | 换模型 |
| 算错数 | 是否用了推理模型 | 要求列步骤 | 自己再算一遍 |
| 忘了前文 | 对话长度 | 自己是否改过口 | 存档 + 新开 |
| 每次不一样 | 是否本该有定解 | 是否多义 | 多问取多数 |
| 错得很自信 | 要求标置信度 | 要求来源 / 反问 | 交叉验证 |
| 回答很水 | 给背景 | 限制形式 / 给角色 | 拿第一版让它改 |
最后说一句:上面 13 种症状里,至少 9 种的第一步都在「你这边」而不是「模型那边」。 这不是甩锅,是好消息——你这边的问题,改一句话就能解决;模型那边的问题,只能等它更新。
排查到最后一步「换一个模型」的时候,如果你觉得在几个官网之间来回登录太麻烦,不墨 AI 助手是我们做的聚合平台,DeepSeek V4.1、Kimi K3、通义千问、GLM-5.1、文心一言在一个窗口里切,同一个问题换模型只要点一下。用不到的话,上面的排查思路你在任何地方都能用。