惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

宝玉的分享
宝玉的分享
B
Blog RSS Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
MyScale Blog
MyScale Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
S
SegmentFault 最新的问题
Y
Y Combinator Blog
月光博客
月光博客
IT之家
IT之家
T
Tailwind CSS Blog
Last Week in AI
Last Week in AI
L
LangChain Blog
博客园_首页
MongoDB | Blog
MongoDB | Blog
P
Proofpoint News Feed
博客园 - Franky
WordPress大学
WordPress大学
云风的 BLOG
云风的 BLOG
M
MIT News - Artificial intelligence
V
Visual Studio Blog
小众软件
小众软件
博客园 - 叶小钗
博客园 - 三生石上(FineUI控件)
N
Netflix TechBlog - Medium

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
写了一个免费的 LLM4Rec(大模型推荐系统)的课程,不确定 0 ...
Perchouli · 2026-05-27 · via V2EX

最近写了介绍大模型推荐系统的免费课程,面向的是对推荐系统基本没了解的读者。不讲代码和算法细节,主要是通过一些操作,让读者能感知工程上推荐系统一般在做什么,集中在特征和模型,没有 ETL 数据处理和展示层。大致是这么组织的内容:

  1. 搜广推的区别,讲目前三个系统的融合趋势,再重点讲推荐系统,推荐系统的核心是算法,是机器学习的分支。介绍召回 - 排序 的背景,DLRM 。提供一个写好的纯演示项目,模拟商品推荐,演示系统包含最基础的 ItemCF 协同算法过滤,说明这种方法的缺陷,引入整个课程的结构。
  2. 从 LLM 做特征工程的最基础的 [数据增强] 开始,就是调 LLM 接口,让它返回标签,然后用 BGE 转向量,演示语义召回。
  3. 用评论演示 RAG ,介绍 GReaT 生成评论这种数据合成方式,让推荐商品通过 RAG 能考虑评论因素。
  4. 到用户塔的操作,用 LLM 根据用户行为序列,生成自然语言的用户画像。结尾演示一个 LLM 的语义重排,说明这种点对点排序的问题,引入下一章。
  5. 生成式推荐系统,用 LLM 目前主流的架构——混合,堆叠,生成——演示返回的 SFT 数据和 DPO 数据。
  6. 可解释性问题。对话式的推荐系统,考虑历史对话。
  7. Agent (规划、记忆、工具、行动)的推荐形式
  8. 测试。

因为定位是 0 基础,预设的用途比如毕设项目找一个新的方向做参考,或者刚入行的新人能大致有个宏观的了解。

想问下对推荐系统了解不多的 V 友,会觉得有什么基础的概念遗漏的吗?