上海财大发布金融领域大模型评测榜单，理财AI“蚂小财”底座模型排名第一|界面新闻，上海财大发布金融领域AI模型评测，理财AI蚂小财模型夺冠

bingwei 2025-06-24 2025热门 15 次浏览 0个评论

上海财经大学发布金融领域大模型评测榜单，理财AI“蚂小财”底座模型在评测中排名第一，彰显其在金融领域的强大能力。

随着我国“人工智能+”战略的深入推进，大模型技术在金融领域的应用不断深入，为了全面衡量金融领域大模型的专业性和可靠性，上海财经大学近期发布了国内首个金融领域大模型评估基准——FinEval 6.0版本，并在其中增加了金融严谨性等评估维度，同时发布了首份评测报告，F(xiàn)inEval 6.0对国内外主流大模型的评测结果显示，蚂蚁集团旗下的理财AI“蚂小财”在金融严谨性等多个维度上表现突出，位居第一，超越了众多通用大模型。

上海财大发布金融领域大模型评测榜单，理财AI“蚂小财”底座模型排名第一|界面新闻，上海财大发布金融领域AI模型评测，理财AI蚂小财模型夺冠 — 金融领域大模型应用评测榜单，上海财经大学

公开资料显示，上海财经大学是国内最早开展金融领域大模型测评工作的高等学府，并在2024年参与了《金融大模型应用测评指南》的制定，这是全国首个以金融业务能力为核心的团体标准，此次，上海财经大学结合对AI企业、金融机构的调研以及投资者洞察，对FinEval 6.0的严谨性评测样本进行了重点完善，从金融学术知识、金融行业理解、金融严谨性测试、金融安全认知、金融智能体应用等关键维度，全面评估大模型在复杂金融业务场景中的表现。

FinEval 6.0对国内外9款具有代表性的大模型进行了评测，包括DeepSeek-R1、GPT-4o等通用基础模型，以及金融垂直领域模型，评测报告显示，参评模型在金融学术知识方面的表现整体优秀，但在金融严谨性、金融行业理解等适配复杂场景的能力上表现参差不齐，理财AI“蚂小财”的模型底座、蚂蚁自研Finix大模型整体表现较好，总分超越通用大模型，特别是在金融严谨性上，行业均值为70.27分，而“蚂小财”超出均值17分，显著领先。

官方数据显示，“蚂小财”是蚂蚁集团旗下的AI理财管家，连接了蚂蚁财富平台生态内200多家基金公司、券商和财经媒体的内容与服务，在通用大模型的基础上，“蚂小财”技术团队还构建了一套金融智能增强的技术体系，实现了金融场景内专业功能和交互体验的全面提升。

“金融领域是国内AI技术应用的焦点场景之一，它对AI的专业性、严谨性等能力提出了更高的标准，目前国内AI在金融领域的表现正逐步提升，正从‘博闻强识’向‘专业审慎’转变，为下一阶段的大规模应用奠定了坚实基础。”测评团队负责人、上海财经大学教授张立文表示，这些“AI+金融场景”的积极探索，有助于我国在国际AI产业竞争中保持领先地位，也将开启我国数字金融、普惠金融建设的新篇章。

转载请注明来自山东轻强建材有限公司，本文标题：《上海财大发布金融领域大模型评测榜单，理财AI“蚂小财”底座模型排名第一|界面新闻，上海财大发布金融领域AI模型评测，理财AI蚂小财模型夺冠》