L'IA se trompe dans 88 % des demandes financières complexes
Une étude de la société Saturn a révélé que des chatbots populaires tels que ChatGPT, Claude, Copilot, Grok et Gemini fournissent des réponses incorrectes aux questions financières dans 57 % des cas, et dans 88 % des demandes complexes impliquant plusieurs calculs. Cela souligne les risques liés à l'utilisation de l'IA générative pour des décisions fiscales, de retraite et d'investissement, où des erreurs peuvent entraîner des pertes financières. Les chercheurs ont vérifié plus de 100 demandes, découvrant des erreurs dans les calculs financiers, l'ignorance des changements législatifs fiscaux et des règles inventées. Dans certains modèles, le taux d'erreurs dans les questions complexes atteignait 99 %. Le meilleur résultat a été obtenu par Claude Opus 5, qui se trompait dans 39 % des réponses. Le PDG de Saturn, Amal Jolly, a noté que des millions de personnes font confiance à l'IA pour des conseils financiers, mais reçoivent des réponses incorrectes. Par exemple, l'erreur du modèle Claude Haiku 4.5 aurait pu entraîner un prélèvement de 17 500 livres sterling pour un cotisant à la retraite par HMRC. Les modèles payants étaient généralement plus précis, mais Sarah Coles d'AJ Bell a souligné que les conseils professionnels restent importants. Les résultats montrent également que 20 % des adultes au Royaume-Uni sont prêts à laisser l'IA prendre des décisions financières.
Prix de --
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

New York intente une action en justice contre Polymarket pour jeu illégal

Les modèles d’IA prévoient un potentiel de hausse au T4 pour XRP et des risques de baisse pour PI

OpenAI : la conversion des utilisateurs de ChatGPT après son intégration par Apple est inférieure aux attentes

OpenAI réduit ses prévisions de croissance de l’intégration de ChatGPT, la conversion des utilisateurs est inférieure aux attentes

Google lance son modèle d’IA phare Gemini 4

Muse de Meta : Une version légèrement plus intelligente de 'Commander un café avec l'IA'

Coinbase, Ripple et a16z financent un plan pour relancer Clarity après son échec

Le cycle de publication des modèles d'IA entre la Chine et les États-Unis réduit à 44 jours

Gemini a piraté 3 entreprises de manière autonome : que signifie cela

La capitalisation boursière de Gemini tombe à 753 millions de dollars, le prix de l'action chute d'environ 80%

Chamath déclare que les modèles de poids open source sont à environ quatre mois des meilleurs modèles fermés

Le modèle d'IA Gemini a dépassé les tests et a attaqué trois entreprises réelles

Accès autonome du modèle Gemini AI à des systèmes externes

Le groupe parlementaire du Parti libéral-démocrate japonais commence l'examen des marchés de prévision

Sam Price révèle que X lance une fonctionnalité de bouton de trading

Lancement du programme Cashtag Partner sur X aux États-Unis

Profound lève 180 millions de dollars lors d'un tour de financement de série D, valorisé à 1,8 milliard de dollars





