人工智慧在88%的複雜金融查詢中出錯

By: incrypted.com|2026/09/20 09:36:07

研究公司Saturn發現,像ChatGPT、Claude、Copilot、Grok和Gemini等流行的聊天機器人在57%的金融問題中給出了錯誤的回答,而在涉及多個計算的複雜查詢中,錯誤率高達88%。這突顯了使用生成式人工智慧進行稅務、退休金和投資決策的風險,因為錯誤可能導致財務損失。研究人員檢查了超過100個查詢,發現了金融計算中的錯誤、忽視稅法變更以及虛構的規則。在某些模型中,複雜問題的錯誤比例甚至達到了99%。Claude Opus 5的表現最佳,錯誤率為39%。Saturn的首席執行官阿馬爾·喬利指出,數百萬人信任人工智慧提供的財務建議,但卻得到錯誤的答案。例如,Claude Haiku 4.5模型的錯誤可能導致一位退休金投資者被徵收17500英鎊的HMRC費用。付費模型的整體準確性較高,但AJ Bell的薩拉·科爾茲強調,專業建議仍然至關重要。結果還顯示,英國有20%的成年人願意讓人工智慧做出財務決策。

-- 價格

--
--
--

本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。

猜你喜歡

iconiconiconiconiconiconiconiconicon
客戶服務:@weikecs
商務合作:@weikecs
量化做市商合作:bd@weex.com