惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Apple Machine Learning Research
Apple Machine Learning Research
Jina AI
Jina AI
博客园_首页
WordPress大学
WordPress大学
罗磊的独立博客
小众软件
小众软件
Last Week in AI
Last Week in AI
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Hugging Face - Blog
Hugging Face - Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
爱范儿
爱范儿
The Cloudflare Blog
GbyAI
GbyAI
C
Check Point Blog
腾讯CDC
MyScale Blog
MyScale Blog
有赞技术团队
有赞技术团队
博客园 - 聂微东
IT之家
IT之家
雷峰网
雷峰网
H
Help Net Security
博客园 - 叶小钗
美团技术团队
D
DataBreaches.Net

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
为了”白嫖” AI API, 为自己部署简单美观的LLM API聚合服务 - ...
2026-01-31 · via 少数派

为了”白嫖” AI API, 为自己部署简单美观的LLM API聚合服务

免责声明:本文中信息来源于网络,作者不保证其绝对正确性。读者在依据本文内容做出任何决策或行动前,应自行进行充分的调查与核实。对于因使用本文内容而产生的任何直接或间接损失,作者不承担任何责任。

需求来源

小编想要基于市面上 “免费” 的大模型API服务商自己聚合一台可以负载均衡的 AI-API 服务。老话说的好”免费的是最贵的”,为了实现这个需求,我们需要一些工具

准备工具

  • 机器:服务器/小主机/vps/可以跑容器的路由器都可以,一台就够了。
  • 应用:一个可以聚合大模型 API 的应用,这里我们使用 octopus
  • API服务商:免费的大模型API服务商,这里我们使用的是 nvidia
  • 测试工具:平常的AI聊天工具都可以
nv1

部署这些工具跑通流程后,就离我们的目标”白嫖AI API” 更近一步了。我们可以添加更多的”免费”的大模型的服务商了。

实现需求

本文下来我们的基本操作步骤是

  1. 注册 NVIDIA 免费服务
  2. 本地小主机上部署 octopus
  3. 配置 octopus
  4. 测试

注册  NVIDIA 服务

注册并申请 key: https://build.nvidia.com/explore/discover

打开地址,按提示输入自己的邮箱地址,一步步填写信息完成后面的步骤。
 

nv2
nv4


完成后可以复制网站上提供的代码进行可用性测试。
 

nv3


完成后可以复制网站上提供的代码进行可用性测试。
NVIDIA 服务的 base-url 的信息,可以用OpenAI的兼容模式接入各种Agent

base-url:https://integrate.api.nvidia.com/v1

安装 OCTOPUS

小编这里基于 docker compose 在自己的小主机上一键部署。

services:
  octopus:
    image: bestrui/octopus
    ports:
      - '8080:8080'
    volumes:
      - 'aiapi_data:/app/data'
    container_name: octopus
    restart: unless-stopped
volumes:
  aiapi_data:

配置

启动服务后,重要的是配置请求的转发。

基本步骤是

  1. 添加渠道(AI 服务商)
  2. 添加分组(实现了负载均衡/故障转移)
  3. 生成一个 API key,给我们的客户端使用
nv9
nv10
nv11
nv12
nv13

测试

小编这里使用一个 chatwise 聊天工具测试,你可以使用自己熟悉的工具测试。

nv5
nv6
nv7
nv8

在 octopus 里看到请求,说明我们的服务配置好了。

使用的工具地址

  • NVIDIA https://build.nvidia.com/explore/discover
  • octopus https://github.com/bestruirui/octopus
  • chatwise https://chatwise.app/

总结

测试 NVIDIA 的服务是可以跑通的,模型支持众多,包括现在流行的 kimi2.5、minimax-2.1、智谱glm4.7等;就是有点慢。看到一些朋友说要加个代理可以加速。后面小编先自己试试。

部署这次服务主要是为了在自己的内网可以有一个代理多个AI服务商的服务,因为有些服务商因为算力的原因可能会断开服务(如之周六日的时候就不稳定。),小编试试基于这个系统,添加多个服务商能实现一个稳定使用。

希望小编文章能帮助到大家,欢迎关注本公众号;有问题留言交流。

其他

欢迎关注本公众号其他社媒平台

link_logo

点击以下链接关注我的数字名片!

https://muselink.cc/hamisay

以上,既然看到这里了,如果觉得不错,欢迎随手点个赞、在看、转发三连吧;如果想第一时间收到推送,也可以给我个⭐星标

~谢谢你看我的文章,我们,下次再见。

>/ 作者:哈米

>/ 投稿或爆料,请联系邮箱:fz420@qq.com