惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
Vulnerabilities – Threatpost
月光博客
月光博客
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
美团技术团队
Last Week in AI
Last Week in AI
Jina AI
Jina AI
P
Privacy International News Feed
有赞技术团队
有赞技术团队
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
T
Tenable Blog
阮一峰的网络日志
阮一峰的网络日志
P
Proofpoint News Feed
T
Tailwind CSS Blog
Apple Machine Learning Research
Apple Machine Learning Research
P
Privacy & Cybersecurity Law Blog
人人都是产品经理
人人都是产品经理
S
Schneier on Security
Google DeepMind News
Google DeepMind News
爱范儿
爱范儿
C
Cisco Blogs
K
Kaspersky official blog
C
Cybersecurity and Infrastructure Security Agency CISA
Hugging Face - Blog
Hugging Face - Blog
博客园_首页
O
OpenAI News
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
IT之家
IT之家
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
酷 壳 – CoolShell
酷 壳 – CoolShell
T
Tor Project blog
博客园 - 【当耐特】
腾讯CDC
V
V2EX
A
Arctic Wolf
Webroot Blog
Webroot Blog
S
Securelist
小众软件
小众软件
大猫的无限游戏
大猫的无限游戏
D
Darknet – Hacking Tools, Hacker News & Cyber Security
博客园 - 三生石上(FineUI控件)
The GitHub Blog
The GitHub Blog
量子位
J
Java Code Geeks
博客园 - 叶小钗
S
SegmentFault 最新的问题
Project Zero
Project Zero
www.infosecurity-magazine.com
www.infosecurity-magazine.com
Scott Helme
Scott Helme
Cyberwarzone
Cyberwarzone

陈少文的网站

巨变与机遇的未来十年 Kubernetes 平台管理软件压力测试方案 使用镜像部署 Hexo 静态页面 终于等到你 - GitHub 镜像仓库服务(ghcr.io) 一起来学 Go --(6)Interface 一起来学 Go --(5)Goroutine 和 Channel 什么是函数式编程 如何在 Kubernetes 集群集成 Kata 柯里化与偏函数 使用 PyGithub 自动创建 Label 软件产品是团队能力的输出 Helm 2 、Helm 3 比较 IoT 变现 Kubernetes 中的 DNS 服务 国内的 Helm 镜像源 Harbor 使用自签证书支持 Https 访问 DevOps 工具链之 Prow 如何使用 kfctl 安装 Kubeflow VS Code 无法下载 Go 插件的工具包 工程师更应具有服务精神 你不知道的 Docker 使用技巧 使用 Docker 运行 Tensorflow 论中国 什么是左移 如何清空 Git 仓库全部历史记录 一禅小和尚 有风吹过厨房 时间的玫瑰 如何在 CentOS 安装 GPU 驱动 开发 Tips(19) 使用 Velero 备份 Kubernetes 集群 Kubernetes Cheat Sheet 开发 Tips(18) 如何构建一个 Java 工程 开发 Tips(17) KubeSpray 安装 Kubernetes 报错 ip in ansible_all_ipv4_addresses 基于 Kubernetes 和 Jenkins 搭建自动化测试系统 在 Kubernetes 上动态创建 Jenkins Slave 使用 Jenkins 进行服务拨测 开发 Tips(16) Kubernetes 签发 Ingress 证书及日常故障运维 Kubernetes 中 Deployment 的基本操作 Kubernetes 中的证书 如何使用 KubeBuilder 开发一个 Operator Kubernetes 1.6.0 安装问题汇总 镜像管理工具 -- Harbor 开发 Tips(15) Docker 如何拉取镜像 开发 Tips(14) 使用 Helm 安装 harbor 开发 Tips(13) 使用 S2I 构建云原生应用 在 Kubernetes 中使用 emptyDir、hostPath、localVolume 开发 Tips(12) 开发 Tips(11) 代码质量分析工具 SonarQube 使用 Kubeadm 安装 Kubernetes 集群 一起来学 Go --(4)常用函数 Kubernetes 中的 Ceph Kubernetes 之 Volumes Kubernetes 之 Labels、Selectors 开发 Tips(10) 开源正在重构商业模式 Kubernetes 之网络 Kubernetes 之 API 使用 Helm 和 Operator 快速部署 Prometheus Kubernetes 复杂有状态应用管理框架 -- Operator Kubernetes 的包管理器 -- Helm 一起来学 Go --(3)Go Modules 如何一步一步地优化博客方案 kubectl 实用指南 Kubernetes 中的基本概念 搭建远程 Kubernetes 开发环境 大公司和小公司的 ToB 思路 开发 Tips(9) Go 入门指南 一起来学 Go --(2)数据与逻辑结构 如何预防 Web 富文本中的 XSS 攻击 django-xss-cleaner 云工作时代 一起来学 Go --(1)背景与特点 SaaS 开发团队的不同阶段 你不知道的 Git 使用技巧 输出既服务 微服务设计 继续奔跑 开发 Tips(8) 从账户安全到二次验证 Django 性能之数据库查询优化 Django 性能之分库分表 敏捷开发之研发流程 打造一致性的团队 开发 Tips(7) Pytest 进阶学习之 Mock PaaS 部署之 buildpack Go 开发配置 领域输出才是 PaaS 的核心竞争力 Pytest 入门学习 开发 Tips(6) 如何使用 Jenkins、Docker、GitLab 搭建 Django 自动化部署流程
影响使用大模型的技术因素
微信公众号 · 2023-08-19 · via 陈少文的网站

1. 大模型到底是什么

先请两位大模型回答一下这个问题,看看他们的回答是什么。

Claude 说,大模型本质上是语言知识的概率表达,通过统计学习对语言各层次规律建模,表征语言生成的先验分布,从而具备语言预测生成能力。

ChatGPT 说,大模型本质是深度神经网络通过大量参数和数据,学习抽象表示,解决复杂任务,但需要高计算和资源投入。

根据他们的回答,大模型本质上是统计出来的知识分布。但为什么以前的统计手段没有 GPT-3.5 这种效果呢?主要原因有很多,大部分都强调的是训练数据量、算力、模型参数、Transformer 等。

但作为一个使用者,我更关注如何从输入的角度,优化对大模型的使用,提升效果。

2. 影响使用大模型的技术因素

2.1 Prompt learning - 提供一些示例、期望

Zero-shot 不使用任何训练示例,完全通过模型本身的知识去生成 prompt,然后完成下游任务。

One-shot 只使用一个很小的示例 prompt,让模型学习下游任务的格式,然后生成新的 prompt 去完成任务。

Few-shot 使用 2 到 10 个左右的示例 prompt,让模型学习下游任务的特征,然后用来生成更多 prompt。

提供的 prompt 越多,结果越好。提供样例的格式越接近下游任务,结果越好。

输入

1
2
3
4
5
6
生成一组随机浮点数 Let's think step by step

这里有一些示例

生成一组随机数 -> [1, 5, 6]
生成一组随机变量 -> [a, b, c]

会生成

1
生成一组随机浮点数 -> [2.3, 4.8, 1.5]

而输入

会生成 Python、JavaScript 生成随机数的脚本。

为了得到更好的结果,我们需要提供一些 prompt 说明大模型扮演什么角色、问题的描述、产生的背景、预期的结果,让大模型知道我们想要的结果是什么。

2.2 思维链(Chain-of-Thought)- 让大模型一步一步的思考

传统的大模型类似一个黑盒,只是输出结果,无法充分利用知识。思维链技术就是让大模型分解问题,一个一个的解决,然后得到最终结果。

为了避免大模型进入错误的知识空间,我们甚至可以提供一些解决的的思路和框架。

输入

1
玩杂耍的人有 16 个球。一半的球是高尔夫球,一半的高尔夫球是蓝色的。有多少个蓝色的高尔夫球?

会生成

1
根据题目中的描述,有 16 个球,其中一半是高尔夫球,即 8 个。而又有一半的高尔夫球是蓝色的,所以蓝色的高尔夫球数量为高尔夫球数量的一半,即 8 个。

这个答案是不对的,正确答案是 4

但如果输入之后,在每个句子后面加上一个提示【请一步一步的思考】,就会得到正确的答案。

1
玩杂耍的人有16个球。一半的球是高尔夫球,一半的高尔夫球是蓝色的。有多少个蓝色的高尔夫球? 请一步一步的思考。

会生成

 1
 2
 3
 4
 5
 6
 7
 8
 9
10
11
12
当我们一步一步思考这个问题时:

玩杂耍的人有16个球。
一半的球是高尔夫球,即8个球是高尔夫球。
一半的高尔夫球是蓝色的。
现在我们来计算有多少个蓝色的高尔夫球:

由于一半的高尔夫球是蓝色的,我们可以将高尔夫球数量除以2来得到蓝色高尔夫球的数量。

蓝色高尔夫球数量 = 高尔夫球数量的一半 = 8个球的一半 = 4个蓝色的高尔夫球。

所以,玩杂耍的人手中有4个蓝色的高尔夫球。

可以看到结果的准确性有了显著改善。这是因为,大模型在自己的引导下,进入了正确的知识空间;当然你也可以直接提供给大模型一个思考框架,让它按照你的思路去思考。

2.3 输入文本越长效果越差 - 控制输入长度

如果输入的文本超过了大模型最大 token 长度,大模型会自动截断输入、丢失上下文信息,导致结果不准确。

在不超过大模型最大 token 长度的情况下,输入文本长度的增加,也会导致大模型效果下降。

有研究表明,大模型在处理长文本时,会忽略中间部分的信息,只关注开头和结尾的信息。https://arxiv.org/pdf/2307.03172.pdf

因此,不要因为模型支持 100K 的 token 输入,就真的输入 100k 的 token,而是可以拆分为多个小段,然后分别输入,再汇总。

3. 参考