惯性聚合
高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文
在惯性聚合中打开
即将跳转到惯性聚合
3
在聚合应用中查看完整内容和互动
立即跳转
取消
推荐订阅源
L
LangChain Blog
J
Java Code Geeks
P
Proofpoint News Feed
Recent Announcements
罗
罗磊的独立博客
H
Hackread – Cybersecurity News, Data Breaches, AI and More
博
博客园_首页
Hugging Face - Blog
MongoDB | Blog
人人都是产品经理
博
博客园 - 【当耐特】
雷峰网
D
DataBreaches.Net
B
Blog RSS Feed
钛媒体:引领未来商业与生活新知
博
博客园 - 聂微东
V
Visual Studio Blog
Apple Machine Learning Research
N
Netflix TechBlog - Medium
OSCHINA 社区最新新闻
Martin Fowler
有赞技术团队
Blog — PlanetScale
Engineering at Meta
Local LLM
跑本地大模型 电费要多少?
多机异构显卡组合推理
本地部署 GLM-5.2 的门槛太高了,根本玩不起!
开源了一个 LLM 推理服务监控面板
大模型小白推荐一下本地模型
GLM5.2 个人感觉有点被吹大了
有支持 6000 Ada 使用 deepseek v4 flash 推理 的框架吗
分享个自己在用的玩具
配置 kiro 的问题
买 macbook pro 笔记本,跑本地模型,怎么配置性价比比较高?
lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度
GPU 跑 LLM 也会超频吗?
DiffusionGemma
Gemma4 12b 居然比 Qwen3.5 9b 还快,意料不到
什么? Apple Watch 也能本地跑 Qwen 了?
关于低算力 gpu 推理时 prefill 在总时长中的占比问题
现在大模型主流都用哪些 nVidia GPU?
Mac book air M5 32G+1TB 能跑本地大模型?
需要购买国产显卡本地部署大模型,哪家的比较好
mac mini 跑本地模型,需要什么配置?
Gemma4 12B 如何跑在 16G 显存上?
mac 64g 能部署哪个本地大模型
消费级显卡(16G A 卡)是不是不适合运行 vllm 和 sglang,好像使用 transformer 推理都比这两个框架快,并且占用显存低
本地大模型最佳 Mac 配置选择
关于 5070ti 模型推理的速度和本地部署思考
有没有能够兼容 Win7 的离线模型工具
想折腾一个 AI 主机,请行家出手
锤子找钉子的项目分享:假想企业本地部署后不用人工洗库接入 llm 的中间层。
gemma4:31b-coding-mtp-bf16
有适合本地跑训练 AI 的电脑配置吗?
大伙有想过二次训练吗?
archxm
·
2026-04-24
·
via
Local LLM
比如我下载了一个模型。
然后再把我所有文档交给它,二次训练。
那么,是不是就没必要 RAG 了。
通过这个模型,我就能提问了嘛,毕竟,我的基因已经嵌入进去了。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。
原文来自
— 版权归原作者所有。