金融领域最新AI评测榜出炉!理财AI“蚂小财”金融专业表现排名第一

随着我国“人工智能+”行动计划的加速推进,大模型技术在金融行业的落地应用不断深化。为全面衡量金融领域大模型的专业性与可靠性,近日,上海财经大学发布了国内首个专注于金融行业的大模型评估基准fineval 6.0,并推出了首份评测报告。此次升级新增了“金融严谨性”等评估维度,进一步提升了测评的全面性和专业性。根据评测结果,蚂蚁集团旗下的理财ai产品“蚂小财”的模型底座在金融严谨性等多项指标中表现优异,位居榜首,超越众多通用大模型。
(金融领域大模型应用评测榜单,上财)
公开资料显示,上海财经大学是国内最早开展金融大模型评估研究的高校之一,并于2024年参与制定了《金融大模型应用测评指南》,该指南是全国首个以金融业务能力为核心的技术标准。此次FinEval 6.0的更新基于对AI企业、金融机构及投资者的深入调研,重点优化了金融严谨性方面的测试样本,从金融学术知识、行业理解、严谨性测试、安全认知以及智能体应用等多个关键维度,系统评估大模型在复杂金融场景下的综合表现。
本次FinEval 6.0评测覆盖了包括DeepSeek-R1、GPT-4o等在内的9个国内外主流大模型,既有通用型基础模型,也涵盖金融垂直领域的专用模型。评测结果显示,参评模型在金融学术知识方面普遍表现良好,但在应对复杂金融场景的能力上存在明显差异。其中,蚂蚁集团旗下“蚂小财”的模型底座和其自研的Finix大模型整体得分领先,尤其在金融严谨性方面,得分远超行业平均值(70.27分),高出17分,展现出强劲的竞争力。
(金融领域大模型应用严谨性评测排名,上财)
最新信息显示,“蚂小财”作为蚂蚁集团推出的AI理财助手,已连接蚂蚁财富平台内超过200家基金公司、券商及财经媒体,整合了丰富的金融服务资源。在通用大模型基础上,“蚂小财”团队构建了一套金融智能增强体系,显著提升了金融场景下的功能专业性与交互体验。
“金融行业是国内AI技术应用的重要战场,但同时也对AI的专业性、严谨性提出了更高要求。” 上海财经大学教授、测评项目负责人张立文表示,“目前中国AI在金融领域的表现正逐步提升,正由‘广泛认知’迈向‘专业审慎’阶段,为下一阶段的大规模落地奠定基础。”他指出,这些在“AI+金融”场景中的积极探索,不仅有助于我国在全球AI产业竞争中占据有利位置,也将推动数字金融与普惠金融迈向新的发展阶段。
免责声明
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
雷军引领小米五年逆袭:从低谷到破局的蜕变之路
北京国家会议中心内,雷军完成了第六场年度公开演讲,主题定为“改变”。这场持续超过两小时的分享,不仅回顾了小米过去五年的战略转型,更通过芯片研发、汽车业务突破等案例,展现了这家科技企业从“顺势而为”到
全球存储峰会探讨AI应用创新,驱动产业发展新方向
近日,由深圳市存储器行业协会与北京大学集成电路学院联合主办、爱集微协办的第四届GMIF全球存储器行业创新峰会在深圳成功举办。本届峰会以“AI应用,创新赋能”为主题,吸引了全球存储产业链上下游企业代表
富士康郑州园区如何满足数十万员工餐饮需求
全球最大的智能终端生产基地——富士康郑州综保园区,正以独特的“美食密码”激活数十万员工的生产力。当记者走进这座超级工厂,扑面而来的是跨越南北的烟火气:9大餐厅、200余个档口构成的美食矩阵,将河南烩
高通推骁龙X2 Elite与8至尊版芯片,AI性能再升级
高通在芯片领域再掀波澜,一口气推出两款堪称“全球最快”的处理器——面向PC端的骁龙X2 Elite系列,以及面向移动端的第五代骁龙8至尊版移动平台。这两款新品不仅在性能上实现跨越式突破,更将智能体A
真我GT8 Pro首发京东方2K 144Hz屏,骁龙8至尊版十月登场
realme 真我品牌近日动作频频,旗下即将发布的 GT8 Pro 手机引发市场高度关注。根据最新披露的信息,这款新机将率先搭载第五代骁龙 8 至尊版处理器,并配备电竞独显芯片 R1,性能表现值得期
相关攻略
热门教程
更多- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程


















