英国金融科技公司 Saturn 发布研究报告称,主流 AI 模型在个人财务问题上的回答错误率达到 57%。
这项研究向 ChatGPT、Gemini、Claude 和 Copilot 等 18 款免费及付费模型提出了 121 个问题,合计生成超过 1 万条答案。报告提到的错误类型包括事实错误、遗漏关键信息或必要警告。
在难度较高的多步骤问题上,模型错误率升至 88%。免费模型表现最差,错误率达到 63%。表现最好的 Claude Opus 5 即使在推理模式下,错误率仍为 39%,相关问题包括计算失误、忽略税收变化,以及引用并不存在的规则。
Saturn CEO Amal Jolly 表示,数百万人依赖 AI 获取财务建议,但错误答案可能导致资金损失。
与此同时,用户对 AI 的信任度仍在上升。安永一项全球调查显示,49% 的消费者曾使用 AI 辅助储蓄和投资决策。英国金融行为监管局的报告称,五分之四的投资新手使用过 AI 工具,其中 56% 表示信任 AI,这一比例高于电视和广播的 47%。
上述消息由 BeInCrypto 报道,Techub 进行了转载。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

