惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

人人都是产品经理
人人都是产品经理
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
宝玉的分享
宝玉的分享
月光博客
月光博客
爱范儿
爱范儿
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
WordPress大学
WordPress大学
有赞技术团队
有赞技术团队
阮一峰的网络日志
阮一峰的网络日志
博客园_首页
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 三生石上(FineUI控件)
博客园 - 聂微东
小众软件
小众软件
量子位
MongoDB | Blog
MongoDB | Blog
Blog — PlanetScale
Blog — PlanetScale
The Cloudflare Blog
Stack Overflow Blog
Stack Overflow Blog
U
Unit 42
Hugging Face - Blog
Hugging Face - Blog
T
The Blog of Author Tim Ferriss
H
Help Net Security
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
19. 大模型输出乱成渣?3个解析器轻松转成标准列表!
老陈说编程 · 2026-05-19 · via 博客园_首页

做AI应用开发最头疼的事之一,就是大模型的输出永远不按你想要的格式来。明明要求返回一个列表,结果它要么加一堆无关的开场白和结束语,要么格式五花八门,手动写正则处理不仅麻烦,还经常漏各种边界情况。

其实 LangChain 早就为我们准备好了现成的解决方案 ——ListOutputParser 系列解析器,能直接把大模型的自然语言输出,精准转换成程序能直接处理的标准字符串列表。下面这三个最常用的解析器,覆盖了绝大多数列表格式的需求。

视频在这里《19. 大模型输出乱成渣?3个解析器轻松转成标准列表!》

1. CommaSeparatedListOutputParser:简单逗号分隔列表

这是最基础也最常用的解析器,专门处理用英文逗号分隔的连续文本,会自动拆分并去除多余空格,输出干净的字符串列表。适合只需要纯文本条目、不需要额外说明的简单场景。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import CommaSeparatedListOutputParser

# 定义通用提示词模板
prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建逗号分隔列表解析器
parser = CommaSeparatedListOutputParser()
# 获取解析器自带的格式指令,自动告诉大模型该怎么输出
format_instructions = parser.get_format_instructions()

# 传入参数生成完整提示词
prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出5种热门的编程语言。"
    }
)

# 调用大模型并解析结果
res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)
print(result)
# 输出示例:['Python', 'JavaScript', 'Java', 'C++', 'Go']

2. MarkdownListOutputParser:带说明的无序列表

如果你的需求不只是纯文本条目,还需要每个条目附带简短说明,那 MarkdownListOutputParser 会更合适。它能自动识别以+、-、*开头的 Markdown 无序列表项,提取内容后还支持保留冒号分隔的键值对格式。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import MarkdownListOutputParser

prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建Markdown无序列表解析器
parser = MarkdownListOutputParser()
format_instructions = parser.get_format_instructions()

prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出5种热门的编程语言,并简要说明每种的特点。"
    }
)

res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)
print(result)
# 输出示例:
# [
#   'Python: 语法简洁,生态丰富,适合AI、数据分析和后端开发',
#   'JavaScript: 前端开发必备,也可通过Node.js做后端',
#   'Java: 跨平台性好,广泛用于企业级应用开发',
#   'C++: 性能极高,适合游戏引擎、操作系统等底层开发',
#   'Go: 天生支持并发,部署简单,适合云原生应用'
# ]

3. NumberedListOutputParser:有序步骤列表

对于需要按顺序呈现的内容,比如操作步骤、流程说明,NumberedListOutputParser 是最佳选择。它会精准匹配以 “阿拉伯数字 + 英文句点” 开头的有序列表,自动剥离编号前缀,同时严格保持原有的顺序不变。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import NumberedListOutputParser

prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建有序列表解析器
parser = NumberedListOutputParser()
format_instructions = parser.get_format_instructions()

prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出程序员从早上到公司到下班离开的完整上班步骤"
    }
)

res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)

# 可以重新编号输出,也可以直接用列表做后续逻辑处理
for step_num, step_content in enumerate(result, 1):
    print(f"{step_num}. {step_content}")

这三个解析器的核心优势在于,它们会自动生成标准化的格式指令传给大模型,同时内置了完善的容错处理,能应对大模型输出的各种小偏差。不用再写冗长复杂的正则表达式,也不用反复调整提示词去约束输出格式,几行代码就能让大模型的输出直接接入业务逻辑,大幅提升开发效率。