让 DeepSeek、Kimi K3、通义千问、GLM-5.1 同做 5 道生活算术题:房贷月供、年终奖个税、双十一叠加优惠、信用卡分期真实利率、旅行 AA 分账——谁算得对、谁算错了还很自信
上一篇5 道生活文书横评比的是「写得像不像人」,评论里有人说:文书写错了顶多丢脸,算错了是丢钱,你比比算数。
有道理。所以这篇挑了 5 道普通人一年里真会算的题——不是「鸡兔同笼」,是房贷、年终奖、购物节凑单、信用卡分期、旅行分账。每道题用完全相同的提示词,在不墨 AI 助手里切换 DeepSeek、Kimi K3、通义千问、GLM-5.1 四个模型,看第一次回答,不追问、不纠正。
评判很简单:我先用计算器和 Excel 算出标准答案,再看谁对。 对的还要看过程讲得清不清楚——因为算这种题你最终要能核对它,而不是信它。
先放总表:
| 题目 | 标准答案 | DeepSeek | Kimi K3 | 通义千问 | GLM-5.1 |
|---|---|---|---|---|---|
| 1. 房贷月供(100 万、30 年、3.1%、等额本息) | 4270.16 元 | ✅ | ✅ | ✅ | ✅ |
| 2. 年终奖 38000 vs 36000 到手谁多 | 36000 多拿 510 元 | ✅ | ✅ | ❌ 说 38000 多 | ⚠️ 结论对,税率查错 |
| 3. 双十一叠加优惠实付 | 483.55 元 | ✅ | ⚠️ 顺序算反 | ✅ | ✅ |
| 4. 分 12 期手续费 0.6%/期,真实年化 | 约 13.0% | ✅ | ✅ | ❌ 说 7.2% | ⚠️ 说「约 13%~14%」没给算法 |
| 5. 四人旅行 AA 分账 | B→A 450、D→A 700、D→C 50 | ✅ | ✅ | ✅ | ✅ 但给了 5 笔转账 |
下面逐题讲,重点讲错的为什么错。
第 1 题:房贷月供
提示词:
我贷款 100 万,30 年,年利率 3.1%,等额本息。
1. 每月还多少?
2. 30 年一共还多少利息?
3. 如果换成等额本金,第一个月还多少?
请给出计算过程,结果保留两位小数。
标准答案:月供 4270.16 元,总利息 537259.04 元,等额本金首月 5361.11 元。
四个模型全对。 这道题是所有模型的必考题,公式固定,训练数据里见过无数遍。
区别在过程。DeepSeek 和 GLM-5.1 都把月利率 0.031/12 ≈ 0.002583 写出来了,再套公式,你能一步一步跟着按计算器。通义千问 直接给结果,过程只写了公式名。Kimi K3 最详细,还多补了一句「等额本金首月比等额本息多还约 1091 元,但总利息少约 7.1 万」——这句我没问,但正是买房人下一个要问的,而且数字是对的。
小结:房贷这类题随便找哪个都行,想看过程找 DeepSeek 或 Kimi。
第 2 题:年终奖多发 2000,到手反而少?
提示词:
我 2025 年的年终奖公司说可以在 36000 和 38000 之间定。年终奖单独计税。
两种情况分别交多少个税、到手多少?哪个到手更多?
标准答案:年终奖单独计税是把年终奖除以 12 查月度税率表。36000÷12=3000,适用 3%,税 1080,到手 34920。38000÷12≈3167,落到 10% 一档,税 38000×10%−210=3590,到手 34410。36000 到手反而多 510 元。 这是著名的「年终奖临界点」。
DeepSeek:两档都算对了,最后一句「建议和公司商量定在 36000,或者把多出的 2000 并入工资发」。这一句是真正有用的建议。全对。
Kimi K3:全对,还把 36001 元的极端情况也算了一遍(税 3390.1 元,到手比 36000 少 2309 元),说明临界点有多陡。
通义千问:这是本篇最值得警惕的错误。它算 36000 那档是对的,算 38000 时用了 3% 的税率,得出税 1140、到手 36860,然后自信地下结论「38000 到手更多,建议选 38000」。它没有做「除以 12 查表」这一步,直接沿用了上一档的税率。如果你信了它,会少拿 510 块。
GLM-5.1:结论是对的(选 36000),但它把 38000 那档的速算扣除数写成了 2520——那是综合所得年度税率表的数字,不是月度表的 210。于是税算成 1280,到手 36720,比 36000 那档多。等于结论对了,但过程是错的,两个错误正好抵消。你要是拿它的过程去核,会核不上。
这道题暴露的问题很典型:税务类计算里模型最容易错的不是加减乘除,是「该查哪张表」。 你问的时候最好把规则也一起喂进去,比如加一句「年终奖单独计税:除以 12 后按月度税率表查税率和速算扣除数」,四个模型就都能对。
第 3 题:双十一叠加优惠到底付多少
提示词:
一件商品标价 599 元。可用优惠有三个,按这个顺序叠加:
1. 店铺券:满 300 减 40
2. 平台跨店满减:每满 300 减 50,按店铺券之后的价格算
3. 88VIP 折扣:前两步之后再打 95 折
最后实付多少?请写出每一步的金额。
标准答案:599−40=559 → 559 只够一档满 300,减 50 → 509 → ×0.95 = 483.55 元。
DeepSeek、通义千问、GLM-5.1 都按我给的顺序一步一步算,结果 483.55。过程都清楚。
Kimi K3 算成了 479.05 元。倒回去看它的过程:它先把 95 折算在了原价 599 上(569.05),再减店铺券 40(529.05),最后减跨店满减 50,得 479.05。三个优惠一个没漏,顺序却和我写的正好相反——它没有按我明确写的顺序走,而是按它「以为的平台规则」走。
平心而论,各平台的叠加顺序确实不一样,Kimi 的顺序在某些平台上是对的。但题目里已经把顺序写死了,它还是按自己的来,这在算钱的场景里比算错更麻烦——你不知道它什么时候会替你改规则。
一个实用建议:凑单算优惠这种题,让 AI 列表格,每一行写「这一步用了哪个优惠、之前多少、之后多少」,任何一步和你理解的不一样都能立刻看见。
第 4 题:分 12 期「手续费 0.6%」的真实年化是多少
提示词:
信用卡账单 12000 元分 12 期,每期手续费率 0.6%,每月还本金 1000 元 + 手续费 72 元,共还 12 个月。
1. 一共多付多少手续费?
2. 银行说的「年化 7.2%」是怎么来的?
3. 真实的年化利率(IRR)是多少?为什么和 7.2% 差这么多?
标准答案:手续费共 864 元。7.2% 是 0.6%×12 的名义费率。真实 IRR 约每月 1.086%,年化约 13.0%(单利口径),差距的原因是你每个月都在还本金,但手续费一直按 12000 的全额收。
DeepSeek:三问全对。IRR 它算出 13.03%,并解释「本金逐月减少,但手续费按初始全额计,相当于平均只占用了一半的钱却付了全额的利息,所以真实利率约为名义的两倍」。这是四个里唯一把「为什么差一倍」说透的。
Kimi K3:全对,IRR 给的是 13.0%,多补了一句「可以用 Excel 的 IRR 函数或 RATE(12, -1072, 12000) 验证」。这句很值——你自己就能核。
通义千问:前两问对,第三问它说真实年化就是 7.2%,理由是「12 期手续费总和 864 除以本金 12000 等于 7.2%」。这是把总费率当成了年化利率,正好是银行希望你这么理解的算法。错了,而且错得很有说服力。
GLM-5.1:说「真实年化约在 13%~14% 之间」,方向对,但没给算法也没给确定的数。追问一句「怎么算的」它能补上,但第一稿只能算半对。
这道题的意义:所有「每期费率 x%」的分期,真实年化都约等于 2x%。 记住这个口诀比记哪个模型算得对更重要。
第 5 题:四个人旅行 AA,谁该转谁多少
提示词:
四个人 A、B、C、D 一起旅行,费用平摊。
A 付了酒店 2400 元,B 付了租车 800 元,C 付了吃饭 1300 元,D 付了门票 500 元。
1. 每人应分摊多少?
2. 谁该给谁转多少钱?请给出转账笔数最少的方案。
标准答案:总计 5000,每人 1250。A 应收 1150,C 应收 50,B 应付 450,D 应付 750。最少 3 笔:B→A 450,D→A 700,D→C 50。
DeepSeek、Kimi K3、通义千问 都给出了这个 3 笔方案,过程都是先算净额再配对。
GLM-5.1 数字全对,但给的方案是 5 笔:B、C、D 各转给 A 一笔,再由 A 转给 C 一笔……它是先「所有人先把钱给 A」再让 A 分。算是对的,只是没满足「笔数最少」这个要求。旅行分账这种事多两笔转账不是大问题,但它说明 GLM 在「优化类」的要求上容易只满足第一层。
四个模型在算钱这件事上的性格
DeepSeek:5 道全对,而且每道都能把「为什么」说清楚——年终奖为什么有临界点、分期为什么真实利率翻倍。算钱这类题,它是第一选择。它的弱点在上一篇文书横评里说过(信息不够时会自己补),但算术题信息是给足的,这个弱点不触发。
Kimi K3:4 道全对,唯一的失误是双十一那题用自己的规则覆盖了题目的规则。它的优势是喜欢多补一步「你下一个会问的」和「怎么自己验证」。适合作为 DeepSeek 的对照。
通义千问:错了 2 道,而且都是在最该小心的地方(税、利率)给出自信的错误答案。它在文书类是四个里最自然的,但算钱不要单独用它,至少要和另一个模型对一遍。
GLM-5.1:没有硬错,但有 3 道「结论对过程错」「方向对没给数」「对了但不是最优」。它像一个大概知道答案但没耐心算完的人。
怎么用这个结论
- 算钱找 DeepSeek,再用 Kimi K3 核一遍。 两个都在不墨 AI 助手同一页面里,同一段提示词切换一下模型就行,两个结果一致再信。
- 涉及税、费率、规则的题,把规则写进提示词。 「年终奖除以 12 查月度表」「优惠按这个顺序叠加」——你多写一句,四个模型的正确率都会上去;不写,模型就会用它「记得」的规则,而那套规则可能是别的年份、别的平台的。
- 要求列步骤或表格,不要只要结果。 通义千问的两处错误、Kimi 的顺序错误,都是看过程才发现的。只看结论你会以为它们都对。
- 记两个口诀比记模型强:年终奖临界点 36000 / 144000 / 300000;分期真实年化 ≈ 每期费率 × 2 × 12。
要算更复杂的家庭账本(收支、储蓄率、几年能攒够首付),看用 AI 做家庭预算和理财规划;房贷之外买房全流程的账(总价、税费、月供压力线)看用 AI 买房算账。手里有一堆 Excel 要让 AI 直接算的,看国产模型做 Excel 数据分析。