惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
G
Google Developers Blog
Hugging Face - Blog
Hugging Face - Blog
博客园 - 【当耐特】
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
博客园 - Franky
博客园_首页
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
WordPress大学
WordPress大学
有赞技术团队
有赞技术团队
月光博客
月光博客
博客园 - 聂微东
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
小众软件
小众软件
Microsoft Security Blog
Microsoft Security Blog
Last Week in AI
Last Week in AI
Vercel News
Vercel News
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
爱范儿
爱范儿
J
Java Code Geeks
博客园 - 叶小钗
Engineering at Meta
Engineering at Meta
阮一峰的网络日志
阮一峰的网络日志

陈陈菌博客

如何在 podman 容器内使用 systemd 在 podman 运行 GUI 应用的经验总结 管理 podman 容器与镜像的导入或导出 用 xdg-dbus-proxy 解决容器的文件选择器的问题 解决 VSCodium 或 Code-Server 无法安装 GitHub Copilot 问题 不可变发行版 Fedora Silverblue 的体验记录 解决 apt 或 dnf 无法 tab 补全的问题 对 (MPA) 多页面切换实现丝滑动画的探索 让服务在非 Root 权限下使用 80 或 443 端口 AppImage 应用打包快速上手 Flatpak 使用和应用打包快速上手 如何用 webSocket 实现一个实时聊天应用 Linux 内核编译 | 快速上手 | deb 使用 debootstrap 构建 Debian 系根文件系统 高度可定制的 KDE 窗口装饰器 klassy 有关 docker、podman、nspawn、bwrap 的 Linux 容器图形性能测试 创建任意 Linux 容器并支持 GUI 程序 (Docker) 创建任意 Linux 容器并支持 GUI 程序 (nspawn) 文件同步工具 rsync 的使用 玲珑 (Linyaps) 应用打包 RPM 打包指南 | 精简版 PBR 材质的各种贴图类型入门 APU | Stable-Diffusion 使用记录 如何在 Electron 上启用 WebGPU Grub 主题安装与配置 Fcitx5 主题安装与自定义 不使用 Nginx 的网站开发指南 如何自制一个简易的资源监控程序 SQL 常用 CRUD 语法记录 Debian 打包入门,与需要注意的问题
搭建一个本地轻量级聊天 Ai
GlumiStudio@ · 2023-07-21 · via 陈陈菌博客

使用消费级电脑计算,并且不需要高端显卡

2023-07-21 14:53:53

标签: 人工智能


近年来 chatGPT 热度非常高,很多不同的大语言模型也破圈出现在大家的视野,如 科大讯飞星火、清华ChatGLM、百度文心一言、华为盘古大模型等。

这些语言模型服务一般都需要大公司服务器配置高端显卡来加速计算。使得普通用户上手门槛略高,不过好在他们也开放了一些量级相对小的模型。比如可以让最低拥有 6GB 显存的机器跑 ChatGLM-6B 量化后的模型,但这对于无独显的设备仍然是一个硬件门槛。

不过博主发现了一个Github项目,chatglm-cpp https://github.com/li-plus/chatglm.cpp 可以让我的 R7-6800h - 16GB 内存的笔记本跑起来该语言模型,它由C++ 实现。它提供了命令行 cli 和 web 端的展示前端

快速上手

这里以 Linux 系统为例,首先通过 git 克隆该项目的文件

git clone --recursive https://github.com/li-plus/chatglm.cpp.git && cd chatglm.cpp

默认你的电脑已经安装了 Python,cd 进入项目文件夹,通过以下命令将语言模型文件下载至本地

python3 convert.py -i THUDM/chatglm2-6b -t q4_0 -o chatglm2-ggml.bin

随后,使用 CMake 将项目编译构建

cmake -B build
cmake --build build -j

现在你就可以使用以下命令,来玩这个语言模型啦!👇

./build/bin/main -m chatglm2-ggml.bin -p "你好"

# 你好👋!我是人工智能助手 ChatGLM-6B,很高兴见到你,欢迎问我任何问题。

当然了,这个 chatGLM-6B 只是一个小模型,回答问题的准确率也比130B要低得多(但是可以玩一玩) 如果对 chatGLM 感兴趣可以去官网 https://chatglm.cn/detail 使用官方提供服务的版本。