主流AI模型在金融问题上的错误率超57%
AGI FTW @ FT
Gary Marcus发现在金融问题上,ChatGPT、Claude这些主流AI模型错误率超57%,挺有意思的。
根据Saturn公司的研究,ChatGPT、Claude、Copilot、Grok和Gemini这五个主流AI模型在金融查询问题上平均错误率超过57%。研究显示这些模型在处理金融相关问题时表现不佳。
AGI FTW @ FT
AGI FTW @ FT Kalani o Māui @MauiBoyMacro “The most popular AI models from ChatGPT, Claude, Copilot, Grok and Gemini provided wrong answers to financial queries 57 per cent of the time on average, according to research from technology firm Saturn.” 👇🏼 ft.com/content/c0cd35… 7J 🔗 View Quoted Tweet 💬 0 🔄 0 ❤️ 6 👀 1171 📊 1 ⚡