惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Y
Y Combinator Blog
有赞技术团队
有赞技术团队
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
美团技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Hugging Face - Blog
Hugging Face - Blog
人人都是产品经理
人人都是产品经理
酷 壳 – CoolShell
酷 壳 – CoolShell
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
C
Check Point Blog
博客园 - 【当耐特】
The GitHub Blog
The GitHub Blog
Recent Announcements
Recent Announcements
The Cloudflare Blog
Microsoft Azure Blog
Microsoft Azure Blog
腾讯CDC
Vercel News
Vercel News
IT之家
IT之家
MyScale Blog
MyScale Blog
博客园_首页
Martin Fowler
Martin Fowler
WordPress大学
WordPress大学
罗磊的独立博客

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
一张图说明AI智能体的底层框架逻辑
markzou · 2025-04-29 · via 人人都是产品经理

智能体(Agent)已经成为我们生活中不可或缺的“小帮手”,从手机里的语音助手到各种自动化工具,它们通过感知环境、分析信息、做出决策并执行任务,极大地提升了我们的生活和工作效率。然而,智能体的底层框架逻辑究竟是怎样的?它如何实现从接收数据到输出结果的全过程?

AI智能体是什么,有很多解释,我们用一个简单的逻辑说明一下,

智能体 = 能干事的“小帮手”

想象你有一个小助手,它能帮你完成任务,而且自己会动脑子!它可能是:

  • a、🤖 机器人(比如扫地机器人,看到垃圾就吸走)。
  • b、📱 手机里的软件(比如天气预报App,自动告诉你明天要不要带伞)。
  • c、🎮 游戏里的角色(比如《我的世界》的村民,自己种地、买卖东西)。

智能体能够感知环境、分析信息、做出决策并执行任务。它可以是虚拟助手、聊天机器人、自动化工具,甚至是物理机器人。智能体的核心特点是自主性和智能化,能够根据目标独立完成复杂任务。

智能体能够通过接收文字、图片、语音、视频和各种外部传感器接收数据。无论是文字、图片、语音、视频或者温度、压力、角度等都是一种数据,这些数据最终转化为计算器所能够理解的信息。

然后再进一步对数据进行分析,理解这些数据的含义

进一步的,根据算法、策略规则对这些分析后的信息制定策略、决策

最终通过执行机构比如回复消息,去控制设备,去控制APP下订单等方式做出反馈。

总结起来,智能体就是一个能够感知,分析决策,执行反馈的帮手。

那是否有一张图可以把智能体的逻辑讲清楚的呢,其实是可以的。如下图就将智能体的整体结构给说明白了。

普通人与智能体的交互其实就是一个对话界面,这个界面可能直接就是一个对话框,或者是一个数字人的分身,总之就是能够进行对话的,无论这个对话是文字,语音,还是视频,还是上传文件等方式。

然后用户给智能体的信息,会由智能体进行识别,另外再加上智能体已经预先设置的提示词(智能体Agent的人设),再加上一些内容知识库。

这些内容用大模型进行分析,如果有必要去调地图、表单、搜索引擎等就会通过API方式去调用,并进一步利用大模型分析,最终再利用生图、生视频、语音合成、3D内容合成等将语言大模型的内容进一步输出为需要的内容类型给到用户。

整个过程就是用户输入的内容+人设+知识库+三方数据给到大模型,大模型进行分析,再进一步转化为用户需要内容,最后输出给用户。输入的是文字,输出要语音,图片,视频等,就可以说是多模态。

多模态可以简单理解为输入的内容形式和输出的内容形式不一样,就是跨界了。

当然这是我们的一个简单概述,实际里面的逻辑会比较复杂,后期将对智能体及大模型原理逐步展开,并介绍市面上的各种大模型工具,探讨他们如何帮助我们提升效率和效益。

本文由人人都是产品经理作者【markzou】,微信公众号:【markzou的笔记】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。