惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
小众软件
小众软件
Apple Machine Learning Research
Apple Machine Learning Research
Webroot Blog
Webroot Blog
T
The Blog of Author Tim Ferriss
S
Schneier on Security
罗磊的独立博客
P
Privacy & Cybersecurity Law Blog
阮一峰的网络日志
阮一峰的网络日志
F
Fortinet All Blogs
P
Palo Alto Networks Blog
月光博客
月光博客
MongoDB | Blog
MongoDB | Blog
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Simon Willison's Weblog
Simon Willison's Weblog
量子位
NISL@THU
NISL@THU
C
CERT Recently Published Vulnerability Notes
Cisco Talos Blog
Cisco Talos Blog
Stack Overflow Blog
Stack Overflow Blog
Recorded Future
Recorded Future
K
Kaspersky official blog
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
Hacker News - Newest:
Hacker News - Newest: "LLM"
L
Lohrmann on Cybersecurity
酷 壳 – CoolShell
酷 壳 – CoolShell
GbyAI
GbyAI
L
LINUX DO - 热门话题
Help Net Security
Help Net Security
B
Blog RSS Feed
www.infosecurity-magazine.com
www.infosecurity-magazine.com
I
InfoQ
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
The Cloudflare Blog
H
Heimdal Security Blog
Last Week in AI
Last Week in AI
美团技术团队
云风的 BLOG
云风的 BLOG
C
Check Point Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
W
WeLiveSecurity
V
Visual Studio Blog
G
GRAHAM CLULEY
AI
AI
Security Latest
Security Latest
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
雷峰网
雷峰网
Cyberwarzone
Cyberwarzone
Microsoft Security Blog
Microsoft Security Blog
P
Proofpoint News Feed

陈少文的网站

巨变与机遇的未来十年 Kubernetes 平台管理软件压力测试方案 使用镜像部署 Hexo 静态页面 终于等到你 - GitHub 镜像仓库服务(ghcr.io) 一起来学 Go --(6)Interface 一起来学 Go --(5)Goroutine 和 Channel 什么是函数式编程 如何在 Kubernetes 集群集成 Kata 柯里化与偏函数 使用 PyGithub 自动创建 Label 软件产品是团队能力的输出 Helm 2 、Helm 3 比较 IoT 变现 Kubernetes 中的 DNS 服务 国内的 Helm 镜像源 Harbor 使用自签证书支持 Https 访问 DevOps 工具链之 Prow 如何使用 kfctl 安装 Kubeflow VS Code 无法下载 Go 插件的工具包 工程师更应具有服务精神 你不知道的 Docker 使用技巧 使用 Docker 运行 Tensorflow 论中国 什么是左移 如何清空 Git 仓库全部历史记录 一禅小和尚 有风吹过厨房 时间的玫瑰 如何在 CentOS 安装 GPU 驱动 开发 Tips(19) 使用 Velero 备份 Kubernetes 集群 Kubernetes Cheat Sheet 开发 Tips(18) 如何构建一个 Java 工程 开发 Tips(17) KubeSpray 安装 Kubernetes 报错 ip in ansible_all_ipv4_addresses 基于 Kubernetes 和 Jenkins 搭建自动化测试系统 在 Kubernetes 上动态创建 Jenkins Slave 使用 Jenkins 进行服务拨测 开发 Tips(16) Kubernetes 签发 Ingress 证书及日常故障运维 Kubernetes 中 Deployment 的基本操作 Kubernetes 中的证书 如何使用 KubeBuilder 开发一个 Operator Kubernetes 1.6.0 安装问题汇总 镜像管理工具 -- Harbor 开发 Tips(15) Docker 如何拉取镜像 开发 Tips(14) 使用 Helm 安装 harbor 开发 Tips(13) 使用 S2I 构建云原生应用 在 Kubernetes 中使用 emptyDir、hostPath、localVolume 开发 Tips(12) 开发 Tips(11) 代码质量分析工具 SonarQube 使用 Kubeadm 安装 Kubernetes 集群 一起来学 Go --(4)常用函数 Kubernetes 中的 Ceph Kubernetes 之 Volumes Kubernetes 之 Labels、Selectors 开发 Tips(10) 开源正在重构商业模式 Kubernetes 之网络 Kubernetes 之 API 使用 Helm 和 Operator 快速部署 Prometheus Kubernetes 复杂有状态应用管理框架 -- Operator Kubernetes 的包管理器 -- Helm 一起来学 Go --(3)Go Modules 如何一步一步地优化博客方案 kubectl 实用指南 Kubernetes 中的基本概念 搭建远程 Kubernetes 开发环境 大公司和小公司的 ToB 思路 开发 Tips(9) Go 入门指南 一起来学 Go --(2)数据与逻辑结构 如何预防 Web 富文本中的 XSS 攻击 django-xss-cleaner 云工作时代 一起来学 Go --(1)背景与特点 SaaS 开发团队的不同阶段 你不知道的 Git 使用技巧 输出既服务 微服务设计 继续奔跑 开发 Tips(8) 从账户安全到二次验证 Django 性能之数据库查询优化 Django 性能之分库分表 敏捷开发之研发流程 打造一致性的团队 开发 Tips(7) Pytest 进阶学习之 Mock PaaS 部署之 buildpack Go 开发配置 领域输出才是 PaaS 的核心竞争力 Pytest 入门学习 开发 Tips(6) 如何使用 Jenkins、Docker、GitLab 搭建 Django 自动化部署流程
AI 应用开发技术栈
微信公众号 · 2025-01-12 · via 陈少文的网站

Embedding 模型

Embedding 模式将高维度的数据映射到低维度的空间,这样有利于数据的处理和分析。

文本模型

这里有一个排行榜,https://huggingface.co/spaces/mteb/leaderboard

在上面的排行榜中,会给出模型的评分,模型的参数量、内存使用、向量维度、最长 Token 等信息。下面是常用的开源模型:

  • gte-Qwen2-7B-instruct

https://huggingface.co/Alibaba-NLP/gte-Qwen2-7B-instruct

维度 3584,最大 Token 131072,内存 28 GB

  • gte-Qwen2-1.5B-instruct

https://huggingface.co/Alibaba-NLP/gte-Qwen2-1.5B-instruct

维度 1536,最大 Token 131072,内存 6 GB

图像模型

找 ViT 模型,Vision Transformer (ViT) 是基于 Transformer 的新架构。

  • clip-vit-base-patch32

https://huggingface.co/openai/clip-vit-base-patch32

维度 512

  • clip-vit-large-patch14

https://huggingface.co/openai/clip-vit-large-patch14

维度 768

向量数据库

向量数据库是专门为向量的存储和检索而设计的,在处理向量数据时,相较于传统数据库更加快速和准确。

postgresql

postgresql 从 13 版本开始,可以通过开源向量检索插件 PGVector 实现了向量检索功能。

适用于对延时要求不高、成本敏感的场景。

redis

redis 从 2.4 版本开始正式支持向量检索,在 7.2 版本中对向量检索功能进行了重大更新和优化,支持 HNSW 检索。

适用于对延时要求高,查询频繁,需要简单快速部署的场景。

elasticsearch

elasticsearch 从 7.0 版本开始增加对向量字段的支持、8.0 版本引入了原生支持 ANN 、HNSW 检索。

适用于大规模数据,需要混合文本、结构化数据和向量数据的场景。

Chroma

https://github.com/chroma-core/chroma

Chroma 是一个用 Rust 和 Python 构建的向量数据库,以其简单易用性著称。它对多媒体内容处理有很好的支持,特别适合快速原型开发和实验。

Milvus

https://github.com/milvus-io/milvus

Milvus 是用 Go 和 C++ 开发的分布式向量数据库,提供强大的通用数据处理能力,在推荐系统、语言和视觉分析等场景表现出色。

Faiss

https://github.com/facebookresearch/faiss

Faiss 是 Facebook 开源的 C++ 向量检索库,其最大特点是支持 GPU 加速,能够高效处理大规模向量搜索任务。

Weaviate

https://github.com/weaviate/weaviate

Weaviate 是一个用 Go 实现的向量搜索引擎,提供 GraphQL 接口,特别擅长知识图谱集成和复杂查询处理。

Qdrant

https://github.com/qdrant/qdrant

Qdrant 是一个用 Rust 开发的向量相似度搜索引擎,支持复杂的元数据过滤查询,在推荐系统、语义搜索和多模态搜索方面表现优异。

Agent 框架

Agent 框架能实现对任务的规划、分析、自动化执行的能力。

AutoGPT

https://github.com/Significant-Gravitas/AutoGPT

AutoGPT 是一个强大的自主 AI 代理系统,可以独立完成复杂目标,支持互联网搜索、代码生成和任务执行等功能。它采用 GPT-4 作为决策引擎,内置了丰富的工具集成。

AutoGen

https://github.com/microsoft/autogen

AutoGen 是微软开发的多智能体对话框架,支持多个 AI 代理之间的协作对话。它提供了丰富的预置智能体模板,可以实现代码生成、数学推理等复杂任务。

Langfuse

https://github.com/langfuse/langfuse

Langfuse 是一个专注于 LLM 应用开发和监控的平台,提供完整的性能分析、日志记录和版本管理功能,帮助开发者更好地构建和优化 AI 应用。

ChatDev

https://github.com/OpenBMB/ChatDev

ChatDev 是一个面向软件开发的智能体框架,通过模拟完整的开发团队角色来实现从需求到代码的自动化。它支持多种编程语言,提供全流程的项目管理。

BabyAGI

https://github.com/yoheinakajima/babyagi

BabyAGI 是一个轻量级的任务规划执行框架,采用简单的任务分解模型,适合学习和实验。它具备基础的记忆存储功能,代码结构清晰易懂。

SuperAGI

https://github.com/TransformerOptimus/SuperAGI

SuperAGI 是一个企业级的 AI 代理开发框架,提供图形化界面和完整的智能体管理功能。它支持多种工具集成,具备详细的执行日志和分析能力。

MetaGPT

https://github.com/geekan/MetaGPT

MetaGPT 是一个专注于软件工程的智能体框架,支持从需求分析到系统设计的全生命周期。它提供多种预定义角色模板,支持自动化代码生成和文档编写。

流程编排

LangChain

https://github.com/langchain-ai/langchain

LangChain 通过一系列的 Chain 将应用开发过程中可能涉及的流程串起来,同时也提供了提示词、记忆等功能,使得开发者可以更快的开发 AI 应用。

FastGPT

https://github.com/labring/FastGPT

FastGPT 是一个基于 LLM 大语言模型的知识库问答系统,提供开箱即用的数据处理、模型调用等能力。同时可以通过 Flow 可视化进行工作流编排,从而实现复杂的问答场景!

Dify

https://github.com/langgenius/dify

Dify 提供了 Workflow 功能,允许用户通过可视化的方式创建和管理任务流程。

模型部署

Ollama

https://github.com/ollama/ollama

Ollama 提供简单易用的界面,让用户能够在本地设备上轻松运行和管理大模型。

vLLM

https://github.com/vllm-project/vllm

vLLM 是一个用于大模型推理服务部署的项目,使用 PageddAttention 机制提高内存利用率。是非常适合生产环境部署模型的工具。vLLM 能适配各种硬件,包括 CPU、GPU、TPU 等。

Triton Server

https://github.com/triton-inference-server/server

Triton Server 是 NVIDIA 开源的推理服务框架,支持多种模型格式,包括 ONNX、TensorRT、PyTorch、TensorFlow 等。如果仅针对 NVIDIA GPU 硬件,Triton Server 是一个非常好的选择。

模型微调

Llama-factory

https://github.com/hiyouga/LLaMA-Factory

Llama-factory 是一个统一的 LLM 微调框架,支持多种主流模型(如 Llama、Mistral、Qwen 等)的训练。它提供了丰富的训练方法(包括 LoRA、QLoRA、全参数微调等)和多样的训练任务类型,使用简单且功能全面。

unsloth

https://github.com/unslothai/unsloth

unsloth 是一个高效的 LLM 微调工具,专注于提供更快的训练速度和更低的显存占用。它通过优化底层实现和创新的训练方法,能显著提升 LoRA 等微调技术的效率,特别适合在有限算力条件下进行模型训练。

模型训练

Pytorch

https://github.com/pytorch/pytorch

Pytorch 是 Facebook 开源的深度学习框架,非常适合大模型的训练,对用户提供了各种易于使用的机械学习库,对各种硬件、拓扑结构都有很好的支持。

Megatron-LM

https://github.com/NVIDIA/Megatron-LM

Megatron-LM 基于 PyTorch 构建,但是针对大模型训练进行了优化,支持多 GPU、多节点训练,适合大规模模型训练。

DeepSpeed

https://github.com/microsoft/DeepSpeed

DeepSpeed 是一个由微软开发的深度学习优化库,利用 ZeRO 优化优化技术可以将模型参数、梯度和优化器状态分割到多个 GPU 或节点上,从而减少内存占用,提高训练效率。