惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog
D
Docker
J
Java Code Geeks
腾讯CDC
Blog — PlanetScale
Blog — PlanetScale
G
Google Developers Blog
M
MIT News - Artificial intelligence
L
LangChain Blog
T
The Blog of Author Tim Ferriss
P
Proofpoint News Feed
MyScale Blog
MyScale Blog
博客园 - Franky
GbyAI
GbyAI
Hugging Face - Blog
Hugging Face - Blog
aimingoo的专栏
aimingoo的专栏
Last Week in AI
Last Week in AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 聂微东
N
Netflix TechBlog - Medium
B
Blog RSS Feed
Y
Y Combinator Blog
阮一峰的网络日志
阮一峰的网络日志
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Google DeepMind News
Google DeepMind News

liseezn'blog

ESP32 / ESP8266 物联网开发环境配置指南 – liseezn'blog Codex 接入 DeepSeek 保姆级教程| Codex++ – liseezn'blog Obsidian AI 知识库搭建终极教程:从 DeepSeek API 到本地模型、RAG 与 Agent 全攻略 – liseezn'blog 烧几亿Token搭完AI工作台SaaS平台,在上线前止损 – liseezn'blog 全栈开发Skill矩阵:从前端审美到后端运维,打造完整AI开发流水线 – liseezn'blog 全链路AI前端开发Skill指南:从审美到工程,打造无模板感的生产级代码 – liseezn'blog Windows 装机必备软件清单 – liseezn'blog 补:2025年度总结 – liseezn'blog 补:2025年度总结 – liseezn'blog 博客900天啦 – liseezn'blog 博客900天啦 – liseezn'blog 在Zeabur部署Rhex现代论坛 – liseezn'blog Rhex论坛接入DeepSeek 踩坑实录 – liseezn'blog Rhex论坛接入DeepSeek 踩坑实录 – liseezn'blog SVGcode 一键部署到 Zeabur – liseezn'blog SVGcode 一键部署到 Zeabur – liseezn'blog Edge密码危机自救:1小时的迁移双持方案 – liseezn'blog Edge密码危机自救:1小时的迁移双持方案 – liseezn'blog Token到底是什么意思 – liseezn'blog Token到底是什么意思 – liseezn'blog 使用Next.js重构主页 – liseezn'blog 使用Next.js重构主页 – liseezn'blog 入手两个4字母域名 – liseezn'blog 入手两个4字母域名 – liseezn'blog SEE~Friends 3.4.0 版本更新|从稳定可用,到好用耐用 – liseezn'blog SEE~Friends 3.4.0 版本更新|从稳定可用,到好用耐用 – liseezn'blog 解决Docker构建PHP8.2+XLoad镜像常见报错,附国内加速+GitHub推送指南 – liseezn'blog 解决Docker构建PHP8.2+XLoad镜像常见报错,附国内加速+GitHub推送指南 – liseezn'blog SEE~Friends v3.1.0 版本更新|更稳定的友链管理,体验再升级 – liseezn'blog SEE~Friends v3.1.0 版本更新|更稳定的友链管理,体验再升级 – liseezn'blog
Ollama从入门到进阶:在你的电脑上运行大模型 – liseezn'blog
liseeze · 2024-07-02 · via liseezn'blog

本文最后更新于37 天前,其中的信息可能已经过时,如有错误请发送邮件到[email protected]

日期:2024-07-05

中考结束了,终于有大把时间折腾技术。暑假第一个要玩的,就是现在最火的本地大模型工具——Ollama。它让你在自己的电脑上就能跑大模型,不需要联网、不用花钱、隐私也不会泄露。

  1. Ollama 是什么?

简单说,Ollama 是一个让你在本地电脑上运行大模型的工具。它把复杂的模型下载、环境配置、GPU 加速全都打包好了,你只需要一行命令就能和 AI 对话。

  1. 安装 Ollama

Windows 用户:
去 ollama.com 下载安装包,双击安装就行。

macOS 用户:

brew install ollama

Linux 用户:

curl -fsSL https://ollama.com/install.sh | sh

装完后打开终端(Windows 按 Win+R 输入 cmd),输入:

ollama --version

看到版本号就说明成功了。

  1. 运行第一个模型

Ollama 的模型库在 ollama.com/library,里面有几百个模型。我们先跑一个体积小、中文还不错的 Qwen(通义千问):

ollama run qwen:7b

第一次运行会自动下载模型,大概 4GB,等几分钟就好。下载完成后,终端里直接出现对话界面:

>>> 你好,介绍一下你自己

输入问题就能聊天了。想退出时按 Ctrl+D 或者输入 /bye。

  1. 常用命令
ollama list          # 查看你装了哪些模型
ollama rm qwen:7b    # 删除模型(释放硬盘空间)
ollama pull llama3   # 下载新模型但不运行
  1. 打造你自己的 AI 助手

这是最酷的部分。我们可以创建一个自定义角色,比如一个“只会用鲁迅口吻说话”的助手。

新建一个文件叫 Modelfile(没有后缀名),内容:

FROM qwen:7b
SYSTEM "你叫小鲁,回答问题必须模仿鲁迅的文风,多用犀利讽刺的语气。"
PARAMETER temperature 0.8

然后在终端里创建模型:

ollama create xiaolu -f ./Modelfile

运行它:

ollama run xiaolu
>>> 你觉得中学生该不该玩手机?

回复就会带着鲁迅式的辛辣口吻,特别好玩。

  1. 把 Ollama 接入自己的程序

Ollama 自带 API 接口(默认 localhost:11434),你可以用 Python 调用它:

import requests

response = requests.post(
    "http://localhost:11434/api/generate",
    json={
        "model": "xiaolu",
        "prompt": "写一段鼓励中学生学编程的话",
        "stream": False
    }
)
print(response.json()["response"])

这段代码会调用你刚才创建的“小鲁”,让它帮你写一段鼓励的话。

  1. 常见问题

· 下载太慢:模型比较大,第一次下载耐心等待,或者换个网速好的时间。
· 内存不够:可以试试更小的模型,比如 qwen:1.8b 或 llama3.2:1b。
· 想用中文更好的:推荐 qwen:7b、llama3.1:8b。

小结

现在你的电脑上已经有了一个完全离线的大模型助手。下一步,我们将在这个基础上接入刚发布的 Llama 3.1,试试 Meta 最新最强的开源模型有多厉害。