惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
量子位
Recent Announcements
Recent Announcements
T
The Blog of Author Tim Ferriss
美团技术团队
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Blog — PlanetScale
Blog — PlanetScale
H
Help Net Security
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园 - Franky
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
宝玉的分享
宝玉的分享
大猫的无限游戏
大猫的无限游戏
V
Visual Studio Blog
博客园 - 聂微东
aimingoo的专栏
aimingoo的专栏
Microsoft Security Blog
Microsoft Security Blog
U
Unit 42
J
Java Code Geeks
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
IT之家
IT之家
Hugging Face - Blog
Hugging Face - Blog
腾讯CDC
L
LangChain Blog

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
蚂蚁数科发布Agentar-Fin-R1:金融推理大模型,8B/32B参数赋...
站外新闻 · 2026-06-25 · via Prompt 语宙

💡 站外导读:当前金融行业正面临数据爆炸、监管趋严与客户服务个性化需求激增的挑战。传统模型在复杂推理、合规性及风险识别上存在短板。蚂蚁数科推出的Agentar-Fin-R1金融推理大模型,正是为解决这些痛点而生。它基于Qwen3开发,专攻金融场景,通过多维可信保障和两阶段训练,旨在提升决策支持、智能客服与风险管理的精度与效率,代表了垂直领域大模型落地的关键一步。

Agentar-Fin-R1 是蚂蚁数科推出的专门面向金融领域的大型语言模型,提升金融场景中的推理能力、可信度和领域专长。模型基于 Qwen3 基础模型开发,提供 8B 和 32B 参数版本,通过精细化的金融任务标签体系和多层可信度保障框架进行优化。在数据构造上采用标签驱动的三级流水线,确保数据来源可信、合成可信和治理可信。模型在金融基准测试(如 Fineva、FinEval、FinanceIQ)和通用推理任务(如 MATH-500、GPQA-diamond)上均表现出色,证明了其在金融领域的卓越性能和通用推理能力。

  • Agentar-Fin-R1是什么
  • Agentar-Fin-R1的主要功能
  • Agentar-Fin-R1的技术原理
  • Agentar-Fin-R1的项目地址
  • Agentar-Fin-R1的应用场景
      • 📝 站长洞察 (Editor’s Insight)

Agentar-Fin-R1

Agentar-Fin-R1的主要功能

  • 复杂推理能力:Agentar-Fin-R1 能处理涉及多步骤分析、风险评估和战略规划的复杂金融任务。

  • 决策支持:通过深度推理和数据分析,为金融机构提供精准的决策支持,帮助在复杂多变的金融市场中做出更明智的选择。

  • 意图识别:精准识别用户在金融场景中的意图,例如投资咨询、产品询问、风险评估等,为用户提供个性化的服务。

  • 槽位识别与信息抽取:能准确识别和结构化金融文本中的关键信息,如基金名称、保险产品、股票代码等,为后续分析和处理提供基础。

  • 工具规划与推荐:根据用户需求推荐合适的金融工具,如投资组合分析工具、市场比较工具等,提升用户体验和工作效率。

  • 表达生成:生成准确、可靠且符合监管要求的专业金融表达,确保信息的透明性和合规性。

  • 安全风险识别:识别和防范恶意输入、数据泄露、系统滥用等安全威胁,确保金融系统的稳定运行。

  • 合规性验证:深度理解并严格遵守反洗钱法规、数据隐私保护、投资者保护和风险披露等监管要求,确保模型输出符合法律和伦理标准。

Agentar-Fin-R1的技术原理

  • 精细化的金融任务标签体系:Agentar-Fin-R1 构建了一个精细化的金融任务标签系统,将金融领域分解为多个精确定义的类别,包括不同的业务场景(如银行、证券、保险等)和任务类型(如意图识别、槽位识别、风险评估等)。指导数据处理和训练工作流,实现了系统化的任务导向优化,确保金融推理场景的全面覆盖。
  • 多维度可信度保障:为了确保数据的高质量和可信度,Agentar-Fin-R1 采用了多维度的可信度保障框架:
    • 源头可信:从权威金融机构和监管文件中获取数据,并通过知识工程处理确保数据的真实性和相关性。

    • 合成可信:引入多智能体协作框架,通过智能体之间的相互讨论和审核来生成高质量的合成数据。

    • 治理可信:通过人工抽样标注、去重、去毒和基于自研奖励模型的过滤,确保数据的安全性和质量。

  • 加权训练框架:Agentar-Fin-R1 采用动态加权训练框架,根据任务的难度动态调整样本权重。具体来说:
    • 难度感知加权:通过计算每个任务的 pass@k 分数,动态调整任务的权重,确保模型在复杂任务上投入更多资源。

    • 指数平滑和下限裁剪:通过指数平滑机制和权重下限裁剪,确保训练过程的稳定性和收敛性。

  • 两阶段训练策略:Agentar-Fin-R1 采用两阶段训练策略,平衡金融知识的全面注入和复杂任务的优化:
    • 第一阶段:通过大规模监督微调(SFT)注入金融知识,确保模型具备全面的金融领域知识。

    • 第二阶段:结合强化学习(GRPO)和针对性微调,进一步提升模型在复杂任务上的表现。

  • 归因循环:Agentar-Fin-R1 引入了归因循环机制,通过错误归因和针对性改进,优化模型性能:
    • 错误归因:通过二维标签框架对预测错误进行分类,找出性能洼地。

    • 动态资源分配:根据性能差距和学习效率,动态分配训练资源,确保模型在关键任务上的持续优化。

  • 创新的评估基准 Finova:为了全面评估模型在真实金融场景中的表现,Agentar-Fin-R1 提出了一个新的评估基准 Finova,涵盖以下三个关键维度:
    • 智能体能力:评估金融意图识别、槽位识别、工具规划和表达生成等核心能力。

    • 复杂推理能力:结合金融数学、代码理解和多步骤推理,模拟真实金融决策场景。

    • 安全与合规:评估模型在安全风险识别和监管合规方面的表现。

  • 高效的数据合成与验证:Agentar-Fin-R1 采用了双轨数据合成策略,结合任务导向的知识引导生成和指令进化机制,生成高质量的推理三元组。通过多模型一致性验证和人工抽样标注,确保数据的准确性和可靠性。

Agentar-Fin-R1的项目地址

  • arXiv技术论文:https://arxiv.org/pdf/2507.16802

Agentar-Fin-R1的应用场景

  • 金融智能客服:通过多轮对话管理,Agentar-Fin-R1 可以持续理解用户需求,逐步引导用户完成复杂的金融操作,如开户、转账、理财咨询等。

  • 风险评估与管理:模型能评估投资组合的风险水平,提供风险预警和管理建议,帮助投资者做出更明智的决策。

  • 市场趋势分析:Agentar-Fin-R1 可以分析市场数据,识别趋势和模式,为金融机构提供市场动态的实时分析。

  • 财务报表分析:通过自然语言处理技术,Agentar-Fin-R1 能解析和分析财务报表,提供详细的财务分析报告,帮助分析师快速获取关键信息。

  • 个性化推荐:Agentar-Fin-R1 能根据用户的历史数据和偏好,推荐适合的金融产品,如基金、保险、理财产品等。

📝 站长洞察 (Editor’s Insight)

Agentar-Fin-R1的发布,标志着金融大模型从通用能力竞争转向‘深度垂直+可信工程’的新阶段。其核心创新不在于单纯参数规模,而在于构建了‘数据可信(源头-合成-治理)-训练可信(加权-归因)-评估可信(Finova基准)’的全栈可信闭环。这呼应了AI在金融等高风险领域落地的终极需求:不仅要‘能力强’,更要‘结果可信、过程可审计’。结合动态资源分配与两阶段策略,该模型展现了‘领域知识注入’与‘复杂推理优化’的精准平衡思路。未来,此类深度嵌入业务逻辑、并具备内置合规安全框架的模型,或将成为金融机构智能化的‘标配引擎’,推动AIGC从辅助工具真正升级为可信赖的决策伙伴。