惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 三生石上(FineUI控件)
J
Java Code Geeks
Apple Machine Learning Research
Apple Machine Learning Research
Jina AI
Jina AI
博客园_首页
C
Check Point Blog
小众软件
小众软件
博客园 - 叶小钗
Blog — PlanetScale
Blog — PlanetScale
Engineering at Meta
Engineering at Meta
美团技术团队
Martin Fowler
Martin Fowler
Vercel News
Vercel News
D
Docker
罗磊的独立博客
B
Blog RSS Feed
The Cloudflare Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 聂微东
Last Week in AI
Last Week in AI
T
Tailwind CSS Blog
雷峰网
雷峰网
博客园 - Franky

博客园 - LarkMidTable

前端微信群 LarkMidTable 2026年2月份 修改的bug记录 Doris的单机安装 1.vue的简介及常用指令 镜像源参考和使用 Langchain调用LLM Langchain的监控工具 Langchain的底层原理 Langchain是什么? 3.AI大模型私有化部署和微调 2.AI大模型项目实战 1.AI 大模型的基本概念 AI Agent的概述 DockerInsight 数据中台整体规划与建设方案 Flink读取Kafka数据下沉到HDFS 兄弟,干了这杯Flink SQL !!! 电商 实时数仓 简易架构图 美团 基于Flink 实时数仓 概述
一: AI 的一些基本概念
LarkMidTable · 2025-01-31 · via 博客园 - LarkMidTable

1.大模型的演变
机器学习 : 监督学习(人为的告知) 和 无监督学习(不进行干预) 和 强化学习(奖惩的方式) 和 深度学习(模拟人的大脑)
大模型: 卷基座,如参数;卷模型的应用,如rag工作流,agent中台;卷多模(文本,图片,视频)


2.大模型的使用与训练
大模型的使用: prompt,提示词的工程
大模型的训练的三个阶段: 预训练、SFT(监督微调)以及RLHF(基于人类反馈的强化学习)
预训练:提升底层的通用能力(3-25岁不断的学习),不管什么都要去学习。能力: 进行补全句子
SFT(监督微调): 对某一个领域进行深刻的学习,能力: 对问题进行回答
RLHF(基于人类反馈的强化学习): 不懂就问,能力:纠正SFT的回答,通过打分的机制,不断的优化输出的结果。


3.大模型的特点与分类
规模和参数量大、适应性和灵活性强
广泛数据集的预训练、计算资源需求大
分类:
大语言模型(LLM):专注于自然语言处理
多模态模型:多模态能够同时处理和理解不同感知通道。计算机视觉模型,音频处理模型

4.大模型的工作流程(IO)
4.1分词化 与 词表 映射
更具词粒度 和 字符粒度 和 子词粒度 将其分解为更小的粒度
词根的映射,就是说,将一个单词映射成一个元素的 token id,这是token的"身份证",实际上给了一串数字
然后根据概率进行补全后面的单词。
比如 lark is a __ 根据最后的概率来进行填写最后一个单词

5.大模型的应用
同义千问的官网去寻找

可以添加官方微信【LarkMidTable2021】,群为VIP群,需要赞助10元才可以添加 , 添加时备注【AI】,可以参与讨论AI啦!