惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

C
Check Point Blog
美团技术团队
Jina AI
Jina AI
人人都是产品经理
人人都是产品经理
The Cloudflare Blog
V
Visual Studio Blog
Google DeepMind News
Google DeepMind News
Hugging Face - Blog
Hugging Face - Blog
云风的 BLOG
云风的 BLOG
有赞技术团队
有赞技术团队
T
The Blog of Author Tim Ferriss
WordPress大学
WordPress大学
月光博客
月光博客
宝玉的分享
宝玉的分享
小众软件
小众软件
MongoDB | Blog
MongoDB | Blog
Apple Machine Learning Research
Apple Machine Learning Research
A
About on SuperTechFans
J
Java Code Geeks
博客园_首页
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
N
Netflix TechBlog - Medium
Vercel News
Vercel News
博客园 - 聂微东

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
上交大小红书联手打造LoopTool:自动化数据进化框架,显著提...
站外新闻 · 2026-06-17 · via Prompt 语宙

💡 站外导读:随着AI Agent和工具调用成为大模型落地的核心能力,高质量训练数据的生成与优化成为关键瓶颈。传统静态数据集难以动态适配模型演进,导致训练效率低下、模型泛化能力不足。LoopTool应运而生,它构建了一个自动化的数据进化闭环,从种子数据生成到迭代优化,持续提升模型在复杂工具调用场景下的表现,为解决大模型数据瓶颈提供了全新思路。

LoopTool 是上海交通大学和小红书团队推出的自动化、模型感知、迭代式的数据进化框架,能提升大语言模型(LLM)在工具调用任务上的性能。框架通过闭环优化,将数据生成、标签修正与模型训练紧密结合,形成动态反馈机制。LoopTool 包括种子数据构建和迭代优化两大阶段,后者涵盖贪婪能力探测、判别引导标签校验和错误驱动数据扩展等核心模块,能够动态调整训练数据,精准优化模型薄弱环节。实验表明,LoopTool 显著提升了模型在工具调用任务上的表现,在多个公开榜单上达到开源模型的最佳成绩。

  • LoopTool是什么
  • LoopTool的主要功能
  • LoopTool的技术原理
  • LoopTool的项目地址
  • LoopTool的应用场景
      • 📝 站长洞察 (Editor’s Insight)

LoopTool

  • 自动化数据生成:构建高质量的种子数据集,支持多智能体对话生成,确保数据多样性和一致性。

  • 动态数据优化:根据模型表现,自动识别、优化模型的薄弱环节,生成更具挑战性的训练样本。

  • 标签校验与修正:通过开源模型比较预测与标签,修正错误标签,减少噪声数据对训练的影响。

  • 模型性能提升:在多个基准测试中显著提升模型的工具调用能力,同时增强模型的泛化推理能力。

  • 自动化工具增强数据构建(Seed Generation):用语义树和约束树合成符合功能意图和结构规范的API定义。通过多智能体对话生成流程(包括Planner Agent、User Agent、Assistant Agent和Tool Agent)构建高质量种子数据集。
  • 基于闭环迭代的模型训练与数据演化
    • GRPO强化学习训练:通过二值奖励函数优化模型的工具调用能力。
    • 贪婪能力探测(GCP):识别模型已掌握、失败和边界样本,保留高困惑度样本用在下一轮训练。
    • 判别引导标签校验(JGLV):使用开源模型比较预测与原标签,修正错误标签。
    • 错误驱动数据扩展(EDDE):基于错误样本生成结构相似但情境多样的新样本,增强模型对难点样本的学习能力。
  • 闭环迭代更新:每轮训练数据由高困惑度样本、修正后的错误样本、新生成样本和未使用的子样本组成,形成“训练-测评-修正-扩展”的完整闭环。
  • GitHub仓库:https://github.com/Rednote-DeepExperience/LoopTool
  • HuggingFace模型库:https://huggingface.co/papers/2511.09148
  • arXiv技术论文:https://arxiv.org/pdf/2511.09148
  • API 调用:LoopTool适用智能客服、自动化任务等场景,帮助模型高效完成查询和数据交互。

  • 多轮任务规划:LoopTool 优化模型在多轮对话中的任务规划能力,使其适应复杂任务的逐步执行,如智能助手的多步骤任务处理。

  • 知识检索:提升问答系统中信息获取的准确性和效率,帮助模型更好地理解用户需求。

  • 代码生成与执行:提高模型生成代码并调用执行工具的准确性,适用编程辅助和教育平台,减少代码错误。

  • 多模态任务:优化模型调用多模态工具的能力,提升智能安防、图像识别等场景中多模态数据处理的性能。

📝 站长洞察 (Editor’s Insight)

LoopTool的出现标志着数据工程在大模型训练中的范式转移——从“静态投喂”迈向“动态共生”。其闭环迭代机制不仅解决了数据噪声和标签错误的老大难问题,更关键的是实现了数据与模型能力的协同进化。这在AI Agent时代尤为重要,因为工具调用能力直接决定了大模型能否可靠地执行复杂任务、接入真实世界系统。上交大与小红书的合作也颇具深意:学术前沿研究与工业场景数据的结合,正成为推动AI落地的新范式。未来,我们或将看到更多类似LoopTool的“数据智能”框架,它们将与模型架构创新同等重要,共同定义下一代AI系统的能力边界。