惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

GbyAI
GbyAI
阮一峰的网络日志
阮一峰的网络日志
G
Google Developers Blog
J
Java Code Geeks
Blog — PlanetScale
Blog — PlanetScale
大猫的无限游戏
大猫的无限游戏
云风的 BLOG
云风的 BLOG
Vercel News
Vercel News
L
LangChain Blog
Hugging Face - Blog
Hugging Face - Blog
T
The Blog of Author Tim Ferriss
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Stack Overflow Blog
Stack Overflow Blog
P
Proofpoint News Feed
腾讯CDC
博客园_首页
博客园 - 聂微东
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
M
MIT News - Artificial intelligence
WordPress大学
WordPress大学
D
DataBreaches.Net
Microsoft Security Blog
Microsoft Security Blog
有赞技术团队
有赞技术团队
博客园 - 叶小钗

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解
19. 大模型输出乱成渣?3个解析器轻松转成标准列表!
老陈说编程 · 2026-05-19 · via 博客园_首页

做AI应用开发最头疼的事之一,就是大模型的输出永远不按你想要的格式来。明明要求返回一个列表,结果它要么加一堆无关的开场白和结束语,要么格式五花八门,手动写正则处理不仅麻烦,还经常漏各种边界情况。

其实 LangChain 早就为我们准备好了现成的解决方案 ——ListOutputParser 系列解析器,能直接把大模型的自然语言输出,精准转换成程序能直接处理的标准字符串列表。下面这三个最常用的解析器,覆盖了绝大多数列表格式的需求。

视频在这里《19. 大模型输出乱成渣?3个解析器轻松转成标准列表!》

1. CommaSeparatedListOutputParser:简单逗号分隔列表

这是最基础也最常用的解析器,专门处理用英文逗号分隔的连续文本,会自动拆分并去除多余空格,输出干净的字符串列表。适合只需要纯文本条目、不需要额外说明的简单场景。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import CommaSeparatedListOutputParser

# 定义通用提示词模板
prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建逗号分隔列表解析器
parser = CommaSeparatedListOutputParser()
# 获取解析器自带的格式指令,自动告诉大模型该怎么输出
format_instructions = parser.get_format_instructions()

# 传入参数生成完整提示词
prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出5种热门的编程语言。"
    }
)

# 调用大模型并解析结果
res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)
print(result)
# 输出示例:['Python', 'JavaScript', 'Java', 'C++', 'Go']

2. MarkdownListOutputParser:带说明的无序列表

如果你的需求不只是纯文本条目,还需要每个条目附带简短说明,那 MarkdownListOutputParser 会更合适。它能自动识别以+、-、*开头的 Markdown 无序列表项,提取内容后还支持保留冒号分隔的键值对格式。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import MarkdownListOutputParser

prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建Markdown无序列表解析器
parser = MarkdownListOutputParser()
format_instructions = parser.get_format_instructions()

prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出5种热门的编程语言,并简要说明每种的特点。"
    }
)

res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)
print(result)
# 输出示例:
# [
#   'Python: 语法简洁,生态丰富,适合AI、数据分析和后端开发',
#   'JavaScript: 前端开发必备,也可通过Node.js做后端',
#   'Java: 跨平台性好,广泛用于企业级应用开发',
#   'C++: 性能极高,适合游戏引擎、操作系统等底层开发',
#   'Go: 天生支持并发,部署简单,适合云原生应用'
# ]

3. NumberedListOutputParser:有序步骤列表

对于需要按顺序呈现的内容,比如操作步骤、流程说明,NumberedListOutputParser 是最佳选择。它会精准匹配以 “阿拉伯数字 + 英文句点” 开头的有序列表,自动剥离编号前缀,同时严格保持原有的顺序不变。

from langchain_core.prompts import ChatPromptTemplate
from langchain_core.output_parsers import NumberedListOutputParser

prompt = ChatPromptTemplate.from_messages(
    [
        {"role": "system", "content": "你是一位有10年经验的资深软件工程师。{format_instructions}"},
        {"role": "user", "content": "{new_input}"}
    ]
)

# 创建有序列表解析器
parser = NumberedListOutputParser()
format_instructions = parser.get_format_instructions()

prompt_value = prompt.invoke(
    {
        "format_instructions": format_instructions,
        "new_input": "请列出程序员从早上到公司到下班离开的完整上班步骤"
    }
)

res = llm.invoke(prompt_value, config=config)
result = parser.invoke(res)

# 可以重新编号输出,也可以直接用列表做后续逻辑处理
for step_num, step_content in enumerate(result, 1):
    print(f"{step_num}. {step_content}")

这三个解析器的核心优势在于,它们会自动生成标准化的格式指令传给大模型,同时内置了完善的容错处理,能应对大模型输出的各种小偏差。不用再写冗长复杂的正则表达式,也不用反复调整提示词去约束输出格式,几行代码就能让大模型的输出直接接入业务逻辑,大幅提升开发效率。