你敢把钱包交给一个十句话里错六句的朋友吗?
反正数百万人已经这么干了。
英国有家科技公司叫 Saturn,干了件挺轴的事。
他们找来 ChatGPT、Claude、Gemini、Copilot、Grok 这些市面上最风光的聊天机器人,前前后后十八款,免费付费都算,往它们嘴里塞了一百多个财务问题,同一个问题还翻来覆去问好几遍,累计问了一万多次。
结果相当难看。
平均下来,这些模型 57%的时间在给你错误答案。赶上复杂一点的题,比如要连算好几步的那种,错误率直接冲到 88%。
个别选手更绝,难题错到 99%,基本等于闭着眼答题。
错在哪儿呢?
有的算错数,有的漏掉了马上就要落地的税制变化,还有的干脆自己编规定。这个最吓人。
你问它学生贷款的事,Claude 张口就来,说毕业生要是移居海外,就可以停止还款。
听着挺人性化吧?这条规定根本不存在,是它现编的。
真金白银的代价摆在那儿。
Claude 去年出的免费模型 Haiku 4.5,在养老金税收规定上犯了一个错,照着做的储户,可能被英国税务海关总署追收 1.75 万英镑。
你想想看,人家就是图省事问了一句,回头税局敲门,一万七千五百镑,这学费交得冤不冤。
有人会说,那我花钱买好的总行了吧。
研究倒也承认,付费的比免费的准,新的比旧的强。
全场考得最好的,是开了推理模式的 Claude Opus 5。可这位状元,错题率 39%。
也就是说,你把养老钱押在最顶尖的 AI 身上,它照样十次里错四次。
这事儿有意思的地方在这儿。
大家普遍觉得,AI 答不上来也就是胡说两句,顶多闹个笑话。可财务这个领域跟聊天不一样,它有一条很残酷的规矩:
答案只有两个状态,对,或者赔钱。
没有中间地带。
AI 偏偏长着一张什么都懂的脸,语气永远那么稳,那么自信,错得理直气壮。
投资平台 AJ Bell 的理财主管萨拉·科尔斯就碰到过,顾问找上门来,说客户照着 AI 的建议干了些让人看不懂的操作,顾问得赶紧核实拦下。
她说得很客气,寻求支持的人需要的是合格的建议,可不是一台赌运气的机器。
再往深处看一层,真正的坑其实不在准确率,在责任。
你找个真人理财顾问,他给你出了馊主意,你能投诉,能索赔,有一整套监管兜底。
AI 呢?
乔利有句话说得很冷:AI 财务建议眼下不受任何监管,消费者拿不到人工顾问那套保障,包括赔偿。
说穿了,你听了真人的话亏钱,有人赔;听了 AI 的话亏钱,只能自认倒霉。机器说得越多越错,错得越狠越不用负责,天下还有比这更划算的买卖吗?
偏偏信任还在涨。
英国财务行为监管局发现,五个英国成年人里就有一个,愿意让 AI 替自己做决定,越是债务、养老金、投资这种要命的复杂选择,需求越旺。
年轻投资者更信 AI,胜过信理财网红和电视节目,三分之二的人打算明年用得更多。这就形成了一个挺荒诞的画面:
工具越错,用的人越多;用的人越多,亏得越集体化。
要我说句公道话,AI 也不是一无是处。
科尔斯自己都承认,拿它做做预算、理理开支,看看自己哪儿花超了,挺好使。问题的根子是人们把实习生当成了会计师。
AI 在财务上真正的身份,就是个口齿伶俐但记性很差的实习生,打打下手可以,签字画押的事,轮不到它。
往后怎么走?
监管局已经盯上这事了,乔利催他们动作快点。
我猜接下来一两年,各国都会给 AI 理财建议套笼子,标注免责也好,划清红线也罢,早晚的事。
在那之前,记住一句老话就够用:免费的东西最贵,自信的声音最可疑。
钱是自己的,错了没人替你哭,对吧。
