金融领域最新AI评测榜出炉!理财AI“蚂小财”金融专业表现排名第一
随着我国“人工智能+”行动加速推进,蚂小财大模型技术在金融领域的金融I金应用持续落地。为全面评估金融领域大模型的领域炉理专业、可靠程度,最新近日,评测上海财经大学推出的榜出国内首个金融领域大模型评估基准升级为FinEval 6.0,新增了金融严谨性等维度并发布首份评测报告。融专FinEval 6.0对国内外主流大模型的业表评测显示,蚂蚁集团旗下理财AI“蚂小财”的现排模型底座在金融严谨性等维度表现突出排名第一,跑赢了众多通用大模型。名第

(金融领域大模型应用评测榜单,上财)
公开资料显示,领域炉理上海财经大学是最新国内最早开展金融领域大模型测评工作的高校,并在2024年参与制定了《金融大模型应用测评指南》,评测这是全国首个以金融业务能力为核心的团体标准。此次,上海财经大学结合对AI企业、金融机构的调研与投资者洞察,重点完善了FinEval 6.0的严谨性评测样本,从金融学术知识、金融行业理解、金融严谨性测试、金融安全认知、金融智能体应用等关键维度,全面评估大模型在复杂金融业务场景中的表现。
同时,FinEval 6.0对国内外9款有代表性的大模型进行评测,包括DeepSeek-R1、GPT- 4o等通用基础模型,以及金融垂直领域模型。评测报告结果显示,参评模型在金融学术知识方面的表现整体优异,但在金融严谨性、金融行业理解等适配复杂场景的能力上表现各异。其中,理财AI“蚂小财”的模型底座、蚂蚁自研Finix大模型整体表现较好,总分跑赢了通用大模型。尤其在金融严谨性上,行业均值为70.27分,蚂小财超出均值17分显著领先。

(金融领域大模型应用严谨性评测排名,上财)
官方数据显示,“蚂小财”是蚂蚁集团旗下的AI理财管家,连接了蚂蚁财富平台生态内200多家基金公司、券商和财经媒体的内容与服务。在通用大模型的基础上,“蚂小财”技术团队还搭建了一套金融智能增强的技术体系,实现了金融场景内专业功能、交互体验的全面增强。
“金融领域是国内AI技术应用的焦点场景之一,但天然也对AI的专业性、严谨性等能力提出更高标准。 目前国内AI在金融领域的表现逐渐提升,不断从“博闻强识”走向“专业审慎”,为下一阶段大规模应用打好了基本盘。”测评团队负责人、上海财经大学教授张立文表示,这些“AI+金融场景”的积极稳妥探索,有助于在国际AI产业竞争中保持领先身位,也将打开我国数字金融、普惠金融建设的新局面。
- ·郴州发布双节消费提示: 倡导本地市民“让行”
- ·火箭湖人冲突事件始末曝光 火箭湖人冲突动图回顾谁的过错?
- ·中国涂料十大品牌的环保建设需从内部做起
- ·好医保和意外险,好医保和意外险冲突么?
- ·女子曝杨子直播间卖的被子里全是头发:给孩子盖的
- ·女排世锦赛最新消息:中国女排2:3意大利淘汰 2018女排世锦赛直播
- ·保罗隆多互殴致火箭湖人冲突 保罗隆多互殴导火索却是哈登?
- ·2018男乒世界杯樊振东夺冠 能否领跑东京奥运?
- ·燃放孔明灯有四大安全隐患 提醒:元宵节请不要放了
- ·学生意外险赔付范围,学生意外险赔付流程
- ·伍兹晒巡回锦标赛冠军礼物 名宿推杆象征义特别
- ·保险要不要买意外险,买保险要买意外险吗
- ·官网“隐身”背后:一生中意为何死守慧择保险网等第三方阵地?
- ·给员工购买意外险的好处,给员工购买意外险需要带什么东西?
- ·梅西骨折怎么回事?梅西骨折要休息多久会错过哪些比赛?
- ·2018男乒世界杯樊振东夺冠 能否领跑东京奥运?
