惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

雷峰网
雷峰网
博客园 - 聂微东
酷 壳 – CoolShell
酷 壳 – CoolShell
宝玉的分享
宝玉的分享
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
罗磊的独立博客
Hugging Face - Blog
Hugging Face - Blog
T
Tailwind CSS Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
IT之家
IT之家
博客园_首页
博客园 - 三生石上(FineUI控件)
博客园 - 叶小钗
Apple Machine Learning Research
Apple Machine Learning Research
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
量子位
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
人人都是产品经理
人人都是产品经理
美团技术团队
小众软件
小众软件
Jina AI
Jina AI
S
SegmentFault 最新的问题
博客园 - Franky
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解
16. LangChain ChatPromptTemplate多模态应用实战
老陈说编程 · 2026-05-16 · via 博客园_首页

多模态 AI 是具备全感官交互能力的智能系统,集感知、理解、内容生成于一体,全面支持文本、图片、音频、视频等多类型信息的输入输出。

喜欢看视频的,请看《16. LangChain ChatPromptTemplate多模态应用实战》

image

 在实际开发过程中,LangChain框架为多模态交互提供了便捷的支持,其中ChatPromptTemplate组件就原生具备多模态消息格式化的能力,无需额外进行复杂的配置,就能轻松对接多类型输入,大大降低了多模态应用的开发门槛。

image

 实际使用时,我们可以以图片模态为例熟悉具体用法,需要说明的是,图片模态的调用逻辑和写法,与其他模态完全一致,掌握一种就能举一反三,无需重复学习不同模态的调用方式。

image

 该模板在参数注入上也具备很高的灵活性,支持将图片的URL链接、Base64编码,以及本地文件路径等多种形式,作为参数动态注入到模板中,适配不同的开发场景需求,无论是在线图片还是本地图片,都能轻松处理。

prompt_template = ChatPromptTemplate.from_messages([
    {"role": "system", "content": "你是专业的多模态内容分析助手"},
    {"role": "user", "content": [
        {"type": "text", "text": "用中文简短描述图片内容"},
{"type": "image_url", "image_url": {"url": "{image_url}"}}
    ]}
])
prompt_value = prompt_template.invoke(
    {
        "image_url": "图片地址"
    }
)

了解完基础用法后,就进入实战环节,我们可以通过具体的开发案例,感受多模态AI的实际应用价值,将理论知识转化为可落地的功能。

from langchain_core.prompts import ChatPromptTemplate
 
prompt_template = ChatPromptTemplate.from_messages([
    {"role": "system", "content": "你是专业的多模态内容分析助手"},
    {"role": "user", "content": [
        {"type": "text", "text": "用中文简短描述图片内容"},
{"type": "image_url", "image_url": {"url": "{image_url}"}}
    ]}
])
prompt_value = prompt_template.invoke(
    {
        "image_url": "图片地址"
    }
)
res = llm.invoke(prompt_value, config=config)
print(res.content)

在实战中,我们可以将图片识别这一核心功能,集成到基于PySide6开发的AI应用界面中,最终实现对图片中文字、链接等信息的精准识别,让应用具备更实用的交互能力,满足日常开发中的实际需求。完整代码看《16. LangChain ChatPromptTemplate多模态应用实战》