Techub News 消息,英國金融科技公司 Saturn 發佈研究報告稱,主流 AI 模型在個人財務問題上的回答錯誤率達 57%。該研究向 ChatGPT、Gemini、Claude 和 Copilot 等 18 款免費及付費模型提出了 121 個問題,生成超 1 萬條答案,錯誤包括事實錯誤、遺漏關鍵信息或必要警告。 在較難的多步驟問題上,模型錯誤率升至 88%,免費模型表現最差,錯誤率達 63%。表現最佳的 Claude Opus 5 在推理模式下仍有 39% 的錯誤率,錯誤涉及計算失誤、忽略稅收變化及引用不存在的規則。Saturn CEO Amal Jolly 表示,數百萬人依賴 AI 獲取財務建議,但錯誤答案可能導致資金損失。 與此同時,用戶對 AI 的信任度仍在攀升。安永一項全球調查顯示,49% 的消費者曾使用 AI 輔助儲蓄和投資決策。英國金融行為監管局報告稱,五分之四的投資新手使用過 AI 工具,其中 56% 表示信任 AI,高於電視和廣播的 47%。(BeInCrypto)

内容來源:TECHUB NEWS
更多精彩內容,請登陸
財華香港網 (https://www.finet.hk/)
現代電視 (http://www.fintv.com)