惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Google DeepMind News
Google DeepMind News
罗磊的独立博客
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Last Week in AI
Last Week in AI
云风的 BLOG
云风的 BLOG
T
The Blog of Author Tim Ferriss
Y
Y Combinator Blog
A
About on SuperTechFans
WordPress大学
WordPress大学
B
Blog
Martin Fowler
Martin Fowler
Jina AI
Jina AI
I
InfoQ
P
Proofpoint News Feed
小众软件
小众软件
S
SegmentFault 最新的问题
V
V2EX
B
Blog RSS Feed
量子位
大猫的无限游戏
大猫的无限游戏
aimingoo的专栏
aimingoo的专栏
博客园 - 三生石上(FineUI控件)
MongoDB | Blog
MongoDB | Blog
美团技术团队

又见苍岚

COLMAP PatchMatch Stereo 算法详解 事件驱动的状态机框架:从理论到工程实践 Git 在国内网络环境下无法 Push 的排查与修复 —— 配置 Clash 代理 分段五次多项式插值原理详解 路径插值方法深度对比研究 Claude Code 使用指南 OpenClaw 记忆管理与技能创建指南 CBS(Conflict-Based Search)算法详解 A* 算法及其变种详解 OpenClaw 配置多 Agents Windows Powershell 无法加载文件,因为在此系统上禁止运行脚本问题的解决方案 MaxClaw 安装流程 大模型 AI 名词介绍 AList 网盘聚合工具简介 Protobuf 简介与测试 Claude Code 简介以及 GLM 4.7 模型接入 Github 歌词下载工具 163MusicLyrics Python __getattr__ 懒加载 Python TypedDict 机器人仿真平台 Gazebo 安装记录 机器人仿真平台 Gazebo 简介 多机器人路径规划问题(Multi-Agent Path Finding, MAPF)简介 Python exifread 读取修改过的 jpeg 信息错误问题修复 3D 坐标系变换的理解 3D 旋转矩阵基本概念 MongoDB Compass 介绍 Python 环境管理工具 uv Flutter 开发指南 Snipaste 安装下载与黑屏问题解决方案 全局路径规划算法记录
Docker - 容器内调用 CUDA 库
Yiwei Zhang · 2025-01-02 · via 又见苍岚

Docker 需要将宿主机的 gpu 映射到容器内部,并且在容器内部需要调用 CUDA 库。

实现思路

  1. Nvidia docker 在容器内支持 nvidia 库使用
  2. 将 cuda 的库映射到容器内部
  3. 在容器内部配置环境变量

操作步骤

Nvidia docker

安装方法:https://www.zywvvd.com/notes/tools/docker/nvidia-docker-install/

容器部署配置

使用 docker compose 部署容器

1
2
3
4
5
6
7
8
9
10
11
services:
foobar:
container_name: test-container
image: ubuntu:latest
deploy:
resources:
reservations:
devices:
- driver: "nvidia"
count: "all"
capabilities: ["gpu"]

也可以指定部分 gpu 映射进容器

1
2
3
4
5
6
7
8
9
10
11
services:
foobar:
container_name: test-container
image: ubuntu:latest
deploy:
resources:
reservations:
devices:
- driver: nvidia
device_ids: ["0", "3"]
capabilities: ["gpu"]

Cuda 库映射

在宿主机安装好 cuda 与 CuDNN 库后,在创建容器时将库路径映射进去。

需要映射 dev, cuda, gnu 文件夹:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
services:
foobar:
container_name: test-container
image: ubuntu:latest
deploy:
resources:
reservations:
devices:
- driver: "nvidia"
count: "all"
capabilities: ["gpu"]
volumes:
- /usr/local/cuda:/usr/local/cuda
- /dev:/dev
- /usr/lib/x86_64-linux-gnu:/usr/lib/x86_64-linux-gnu

环境变量

增加环境变量到系统:

1
2
export PATH=/usr/local/cuda/bin:$PATH
export LD_LIBRARY_PATH=/usr/local/cuda/lib64:$LD_LIBRARY_PATH

python 中可以自动添加:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
import os
def update_env():

# 获取当前的环境变量
current_path = os.environ.get('PATH', '')
# 设置新的PATH,将CUDA的bin目录添加到当前PATH的前面
new_path = '/usr/local/cuda/bin:' + current_path
# 更新环境变量
os.environ['PATH'] = new_path
print('Updated PATH:', os.environ['PATH'])

# 获取当前的环境变量
current_path = os.environ.get('LD_LIBRARY_PATH', '')
# 设置新的PATH,将CUDA的bin目录添加到当前PATH的前面
new_path = '/usr/local/cuda/lib64:' + current_path
# 更新环境变量
os.environ['LD_LIBRARY_PATH'] = new_path
print('Updated LD_LIBRARY_PATH:', os.environ['LD_LIBRARY_PATH'])

参考资料

文章链接:
https://www.zywvvd.com/notes/tools/docker/docker-gpu-config/