人人澡人人爽 人妻斩_日本一区二区三区四区视频_亚洲妇乱亚洲妇乱无码_亚洲国产欧美一区二区三区_无码一区二区三区巨免费
上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠

上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠

hongzheyu 2025-06-25 网易新闻 9 次浏览 0个评论
上海财经大学发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型位居榜首。该榜单评估了多个AI模型在金融领域的表现,为金融行业AI应用提供参考。

随着我国“人工智能+”战略的稳步推进,大模型技术在金融领域的应用日益深入,为全面评估金融领域大模型的专业性和可靠性,上海财经大学发布了国内首个金融领域大模型评估基准——FinEval 6.0,并对其进行了升级,新增了金融严谨性等维度,同时发布了首份评测报告,F(xiàn)inEval 6.0对国内外主流大模型的评测结果显示,蚂蚁集团旗下的理财AI“蚂小财”在金融严谨性等维度表现突出,位居第一,超越了许多通用大模型。

上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠
金融领域大模型应用评测榜单,上海财经大学

据公开资料显示,上海财经大学是国内最早开展金融领域大模型测评工作的高校,并在2024年参与制定了《金融大模型应用测评指南》,这是全国首个以金融业务能力为核心的团体标准,此次,上海财经大学结合对AI企业、金融机构的深入调研与投资者洞察,对FinEval 6.0的严谨性评测样本进行了重点完善,从金融学术知识、金融行业理解、金融严谨性测试、金融安全认知、金融智能体应用等关键维度,全面评估大模型在复杂金融业务场景中的表现。

上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠

FinEval 6.0对国内外9款有代表性的大模型进行了评测,包括DeepSeek-R1、GPT-4o等通用基础模型,以及金融垂直领域模型,评测报告结果显示,参评模型在金融学术知识方面的表现整体优异,但在金融严谨性、金融行业理解等适配复杂场景的能力上表现各异,理财AI“蚂小财”的模型底座、蚂蚁自研Finix大模型整体表现较好,总分跑赢了通用大模型,尤其在金融严谨性上,行业均值为70.27分,蚂小财超出均值17分,显著领先。

上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠
金融领域大模型应用严谨性评测排名,上海财经大学

官方数据显示,“蚂小财”是蚂蚁集团旗下的AI理财管家,连接了蚂蚁财富平台生态内200多家基金公司、券商和财经媒体的内容与服务,在通用大模型的基础上,“蚂小财”技术团队还搭建了一套金融智能增强的技术体系,实现了金融场景内专业功能、交互体验的全面增强。

“金融领域是国内AI技术应用的焦点场景之一,但同时也对AI的专业性、严谨性等能力提出了更高的标准,目前国内AI在金融领域的表现正逐渐提升,从‘博闻强识’走向‘专业审慎’,为下一阶段的大规模应用奠定了坚实基础?!?#27979;评团队负责人、上海财经大学教授张立文表示,这些“AI+金融场景”的积极稳妥探索,有助于我国在国际AI产业竞争中保持领先地位,也将开启我国数字金融、普惠金融建设的新篇章。

转载请注明来自山东轻强建材有限公司,本文标题:《上海财大发布金融领域大模型评测榜单,理财AI“蚂小财”底座模型排名第一|界面新闻,上海财大发布金融领域大模型评测,理财AI蚂小财夺冠》

百度分享代码,如果开启HTTPS请参考李洋个人博客
每一天,每一秒,你所做的决定都会改变你的人生!

发表评论

快捷回复:

评论列表 (暂无评论,9人围观)参与讨论

还没有评论,来说两句吧...

Top