惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
The GitHub Blog
The GitHub Blog
B
Blog
小众软件
小众软件
Jina AI
Jina AI
WordPress大学
WordPress大学
V
V2EX
MongoDB | Blog
MongoDB | Blog
Blog — PlanetScale
Blog — PlanetScale
P
Proofpoint News Feed
Y
Y Combinator Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
人人都是产品经理
人人都是产品经理
Microsoft Azure Blog
Microsoft Azure Blog
aimingoo的专栏
aimingoo的专栏
C
CERT Recently Published Vulnerability Notes
C
Cisco Blogs
Project Zero
Project Zero
云风的 BLOG
云风的 BLOG
K
Kaspersky official blog
Google DeepMind News
Google DeepMind News
宝玉的分享
宝玉的分享
T
Threat Research - Cisco Blogs
S
Securelist
V
Vulnerabilities – Threatpost
雷峰网
雷峰网
F
Fortinet All Blogs
D
DataBreaches.Net
I
Intezer
D
Docker
The Hacker News
The Hacker News
The Last Watchdog
The Last Watchdog
SecWiki News
SecWiki News
MyScale Blog
MyScale Blog
腾讯CDC
博客园_首页
Martin Fowler
Martin Fowler
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
Application and Cybersecurity Blog
Application and Cybersecurity Blog
H
Help Net Security
GbyAI
GbyAI
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
L
Lohrmann on Cybersecurity
I
InfoQ
H
Hacker News: Front Page
T
Threatpost
Stack Overflow Blog
Stack Overflow Blog
博客园 - 叶小钗
T
Troy Hunt's Blog
Microsoft Security Blog
Microsoft Security Blog

陈少文的网站

巨变与机遇的未来十年 Kubernetes 平台管理软件压力测试方案 使用镜像部署 Hexo 静态页面 终于等到你 - GitHub 镜像仓库服务(ghcr.io) 一起来学 Go --(6)Interface 一起来学 Go --(5)Goroutine 和 Channel 什么是函数式编程 如何在 Kubernetes 集群集成 Kata 柯里化与偏函数 使用 PyGithub 自动创建 Label 软件产品是团队能力的输出 Helm 2 、Helm 3 比较 IoT 变现 Kubernetes 中的 DNS 服务 国内的 Helm 镜像源 Harbor 使用自签证书支持 Https 访问 DevOps 工具链之 Prow 如何使用 kfctl 安装 Kubeflow VS Code 无法下载 Go 插件的工具包 工程师更应具有服务精神 你不知道的 Docker 使用技巧 使用 Docker 运行 Tensorflow 论中国 什么是左移 如何清空 Git 仓库全部历史记录 一禅小和尚 有风吹过厨房 时间的玫瑰 如何在 CentOS 安装 GPU 驱动 开发 Tips(19) 使用 Velero 备份 Kubernetes 集群 Kubernetes Cheat Sheet 开发 Tips(18) 如何构建一个 Java 工程 开发 Tips(17) KubeSpray 安装 Kubernetes 报错 ip in ansible_all_ipv4_addresses 基于 Kubernetes 和 Jenkins 搭建自动化测试系统 在 Kubernetes 上动态创建 Jenkins Slave 使用 Jenkins 进行服务拨测 开发 Tips(16) Kubernetes 签发 Ingress 证书及日常故障运维 Kubernetes 中 Deployment 的基本操作 Kubernetes 中的证书 如何使用 KubeBuilder 开发一个 Operator Kubernetes 1.6.0 安装问题汇总 镜像管理工具 -- Harbor 开发 Tips(15) Docker 如何拉取镜像 开发 Tips(14) 使用 Helm 安装 harbor 开发 Tips(13) 使用 S2I 构建云原生应用 在 Kubernetes 中使用 emptyDir、hostPath、localVolume 开发 Tips(12) 开发 Tips(11) 代码质量分析工具 SonarQube 使用 Kubeadm 安装 Kubernetes 集群 一起来学 Go --(4)常用函数 Kubernetes 中的 Ceph Kubernetes 之 Volumes Kubernetes 之 Labels、Selectors 开发 Tips(10) 开源正在重构商业模式 Kubernetes 之网络 Kubernetes 之 API 使用 Helm 和 Operator 快速部署 Prometheus Kubernetes 复杂有状态应用管理框架 -- Operator Kubernetes 的包管理器 -- Helm 一起来学 Go --(3)Go Modules 如何一步一步地优化博客方案 kubectl 实用指南 Kubernetes 中的基本概念 搭建远程 Kubernetes 开发环境 大公司和小公司的 ToB 思路 开发 Tips(9) Go 入门指南 一起来学 Go --(2)数据与逻辑结构 如何预防 Web 富文本中的 XSS 攻击 django-xss-cleaner 云工作时代 一起来学 Go --(1)背景与特点 SaaS 开发团队的不同阶段 你不知道的 Git 使用技巧 输出既服务 微服务设计 继续奔跑 开发 Tips(8) 从账户安全到二次验证 Django 性能之数据库查询优化 Django 性能之分库分表 敏捷开发之研发流程 打造一致性的团队 开发 Tips(7) Pytest 进阶学习之 Mock PaaS 部署之 buildpack Go 开发配置 领域输出才是 PaaS 的核心竞争力 Pytest 入门学习 开发 Tips(6) 如何使用 Jenkins、Docker、GitLab 搭建 Django 自动化部署流程
LiteLLM - 提供统一的模型接口格式
微信公众号 · 2026-06-24 · via 陈少文的网站

Please enable Javascript to view the contents

1. LiteLLM 是什么

LiteLLM 是开源 LLM 适配器:用 OpenAI 标准格式调用 100+ 种 API(OpenAI、Anthropic、Gemini、Bedrock、Azure、Ollama、vLLM、通义千问等)。

两种用法:

  • Python SDK — 代码内直接调用
  • AI Gateway — 团队级代理,带鉴权、计费、负载均衡和管理后台

把「每个模型一套 SDK、鉴权、请求格式」收敛成一个接口、一份配置。

2. 为什么需要它

问题没有网关有 LiteLLM
SDK 碎片化各 provider 各一套客户端统一 OpenAI 格式
密钥管理Key 散落各处网关集中保管,下游用 Virtual Key
成本追踪账单难归因按 key/team/user 统计
模型切换改 provider 要重写逻辑config.yaml 即可
高可用单点故障fallback、负载均衡、重试

3. 核心使用场景

  1. 多模型统一集成 — 一套 OpenAI 格式代码,改模型名即可切换 GPT、Claude、通义千问
  2. 故障转移 — GPT-4 限流或宕机时自动切 Claude,再切本地 Llama
  3. 负载均衡 — 多个 Key 或 Endpoint 间轮询,突破 TPM/RPM 限制
  4. 企业 AI 网关 — 统一密钥、预算配额、日志审计
  5. 成本监控 — 内置价格表,支持推送到 Prometheus、Langfuse
  6. 本地/云端切换 — 开发用 Ollama,上线换 GPT-4,代码不用改
1
2
3
4
5
from litellm import completion

response1 = completion(model="gpt-4", messages=[{"content": "你好", "role": "user"}])
response2 = completion(model="claude-3-sonnet-20240229", messages=[{"content": "你好", "role": "user"}])
response3 = completion(model="qwen/qwen-max", messages=[{"content": "你好", "role": "user"}])

做 AI 产品开发、需要多模型接入或团队密钥管理时,LiteLLM 基本是标配;偶尔用一下单模型则未必需要。

4. 两种使用模式

4.1 Python SDK

适合脚本、服务内嵌调用。模型名格式 provider/model,SDK 负责格式转换。

1
2
3
4
from litellm import completion

response = completion(model="openai/gpt-4o", messages=[{"role": "user", "content": "Hello!"}])
response = completion(model="anthropic/claude-sonnet-4-20250514", messages=[{"role": "user", "content": "Hello!"}])

4.2 AI Gateway

适合团队共享、多应用接入。客户端把 base_url 指向网关即可:

1
2
3
4
import openai

client = openai.OpenAI(api_key="sk-litellm-virtual-key", base_url="http://localhost:4000")
response = client.chat.completions.create(model="gpt-4o", messages=[{"role": "user", "content": "Hello!"}])
客户端 → LiteLLM Gateway (:4000) → 100+ Provider
           鉴权 / 路由 / 护栏 / 计费
场景推荐
个人脚本、单服务内嵌Python SDK
团队共享、Virtual Key、预算审计AI Gateway

5. 核心能力

  • 统一端点:/v1/chat/completions/v1/embeddings、图像/语音/批量推理等
  • Virtual Key:Master Key 管理,Virtual Key 绑定 budget、rate limit、model 白名单
  • 路由与 fallback:多个 deployment 映射同一 model_name,主 provider 失败自动切换
  • 护栏:PII 检测、第三方护栏服务、自定义 hook
  • 可观测性:Langfuse、OpenTelemetry、Prometheus;Admin UI 在 http://localhost:4000/ui
  • MCP:Agent 通过 MCP 调用网关管理的工具和模型

6. 快速上手

6.1 安装与启动

1
2
3
pip install litellm          # SDK
pip install 'litellm[proxy]' # Gateway
litellm --model gpt-4o       # 单模型启动,监听 :4000

6.2 多模型 config.yaml

 1
 2
 3
 4
 5
 6
 7
 8
 9
10
11
12
13
14
15
16
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude-sonnet
    litellm_params:
      model: anthropic/claude-sonnet-4-20250514
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3
      api_base: http://localhost:11434

general_settings:
  master_key: sk-litellm-master-key
1
2
3
export OPENAI_API_KEY=sk-...
export ANTHROPIC_API_KEY=sk-ant-...
litellm --config config.yaml

6.3 Docker

1
2
docker run -e OPENAI_API_KEY=$OPENAI_API_KEY -p 4000:4000 \
  ghcr.io/berriai/litellm:main-latest --model gpt-4o

生产环境建议挂载 config.yaml,并用 PostgreSQL 持久化 Virtual Key 和 spend logs。

7. 配置要点

7.1 密钥引用

1
2
litellm_params:
  api_key: os.environ/OPENAI_API_KEY

也支持 AWS Secrets Manager、Azure Key Vault 等。

7.2 创建 Virtual Key

1
2
3
4
curl -X POST http://localhost:4000/key/generate \
  -H "Authorization: Bearer sk-litellm-master-key" \
  -H "Content-Type: application/json" \
  -d '{"models": ["gpt-4o", "claude-sonnet"], "max_budget": 10.0, "duration": "30d"}'

8. LiteLLM 与 New API

LiteLLM 和 New API(One API 分支)都是流行的 LLM 中转工具,定位不同:LiteLLM 面向开发者,New API 面向管理员/中转商。

维度LiteLLMNew API
形态Python 库 + ProxyGo 服务 + Web UI
侧重fallback、负载均衡、LangChain 集成、细粒度预算用户系统、兑换码、渠道管理、倍率计费
配置YAML / 环境变量网页操作
模型国际主流更新快国内模型适配好
Python SDK
Guardrails / MCP通常无

选 LiteLLM:写 AI 应用、要高可用 fallback、对接 Prometheus/Langfuse、本地/云端切换。

选 New API:做 Key 分发中转、团队额度管理、不想写 YAML、国内模型为主。

9. CLI 常用命令

1
2
3
4
5
6
7
litellm --model gpt-4o
litellm --config config.yaml
litellm --config config.yaml --detailed_debug

litellm-proxy keys list
litellm-proxy models list
litellm-proxy spend logs

10. 小结

LiteLLM 用 OpenAI 兼容接口统一 100+ LLM,提供 SDK 和 AI Gateway 两种模式,覆盖密钥管理、成本追踪、负载均衡、fallback 和企业治理。与 New API 相比,更适合开发者做逻辑控制;New API 更适合做资源分发。

Python 网关在 1k RPS 下 P95 约 8ms,2026 年起在推进 Rust 重写以进一步降低延迟。


微信公众号