惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
B
Blog RSS Feed
The GitHub Blog
The GitHub Blog
爱范儿
爱范儿
博客园 - 司徒正美
J
Java Code Geeks
酷 壳 – CoolShell
酷 壳 – CoolShell
Engineering at Meta
Engineering at Meta
大猫的无限游戏
大猫的无限游戏
D
Docker
Blog — PlanetScale
Blog — PlanetScale
Recent Announcements
Recent Announcements
罗磊的独立博客
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 聂微东
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
人人都是产品经理
人人都是产品经理
Stack Overflow Blog
Stack Overflow Blog
M
MIT News - Artificial intelligence
腾讯CDC
T
The Blog of Author Tim Ferriss
小众软件
小众软件
U
Unit 42
T
Tailwind CSS Blog

博客园 - yi-sheng

[2026年9月]国产曦云C500双卡vllm框架本地部署qwen3.6-35B模型 [部署失败]国产曦云C500双卡sglang框架本地部署qwen3.6-35B模型 4090多卡使用sglang:v0.5.16在docker环境部署Qwen3.5-35B-A3B-20260807 短剧及算力租用平台 AMD Rademo RX 7900 48G显存 单卡环境部署Qwen3.6-35B-A3B AMD开发者中心Notebook开SSH与WEB外网访问 国产曦云C500双卡vllm框架本地部署qwen3.6-35B模型 国产曦云C500驱动安装 国产曦云C500双卡本地部署qwen3.6-35B模型 NVIDIA GeForce RTX 3080 魔改20G 运行大模型 FusionXpark_GB10救砖教程 ARM 架构NVIDIA GB10 Grace Blackwell环境中部署 Qwen3.6-35B 推理服务 Rufus的4.4制作ubuntu-24.04.4安装U盘 常用办公终端NEC 莱斯双盘位桌面存储阵列2代-LaCie 2big v2设置RAID1 常用办公终端配置信息 H3C LinSeer MegaCube灵犀MegaCube工作站使用笔记 4090多卡使用sglang推理框架docker布署qwen3.6-35B 国产曦云C500双卡本地部署qwen3.5-35B模型 国产GPU沐曦GPU系统曦云C500体验笔记 ARM 架构NVIDIA GB10 Grace Blackwell 芯片环境下安装conda FusionXpark GB10盒子开箱笔记 Python 3.11.6 + Oracle 11g​开发环境配置 MCP开发技巧:静态参数作为行为提醒(Reminder Pattern) Teachable Machine安装 Qwen2.5-1.5B + LoRA 单张显卡 微调实战 Qwen2.5-1.5B + LoRA 微调实战 大模型基建实战:使用序列猴子数据集定制 BPE Tokenizer 老年小龙虾soul.md示例 低幻觉医疗大模型Baichuan-M2-32B本地部署笔记
ROCm 环境多模态开发开源项目汇总
yi-sheng · 2026-07-21 · via 博客园 - yi-sheng

ROCm 环境多模态开发开源项目汇总

参考开源项目: 

ComfyUI:节点式 AI 图像 / 视频生成工作流

https://github.com/Comfy-Org/ComfyUI

Stable Diffusion WebUI:经典 AI 文生图 / 图生图 Web UI

https://github.com/AUTOMATIC1111/stable-diffusion-webui

Diffusers:Hugging Face 扩散模型工具库,适合自定义 AI 生成流程

https://github.com/huggingface/diffusers

Transformers:多模态模型、视觉语言模型、文本 / 视觉 / 多模态模型基础库

https://github.com/huggingface/transformers

InvokeAI:AI 图像生成与创作工作流

https://github.com/invoke-ai/InvokeAI

Fooocus:简化版 AI 图像生成工具

https://github.com/lllyasviel/Fooocus

ControlNet:可控图像生成参考

https://github.com/lllyasviel/ControlNet

InstantID:基于人脸身份保持的 AI 图像生成参考

https://github.com/InstantID/InstantID

Real-ESRGAN:AI 图像 / 视频超分辨率增强

https://github.com/xinntao/Real-ESRGAN

GFPGAN:AI 人脸修复与增强

https://github.com/TencentARC/GFPGAN

AnimateDiff:AI 图像动画 / 视频生成参考

https://github.com/guoyww/AnimateDiff

Stable Video Diffusion:AI 视频生成参考

https://github.com/Stability-AI/generative-models

See-through:单张动漫角色图像自动分层 / 补全 / PSD 输出,可参考 AI 角色素材拆分、Live2D 前处理、2.5D 创作工具方向

https://github.com/shitagaki-lab/see-through

CosyVoice:多语言 AI 语音生成 / TTS / 声音克隆参考,可用于方言绕口令、AI 配音、角色语音、有声内容创作等方向

https://github.com/FunAudioLLM/CosyVoice