惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
量子位
Y
Y Combinator Blog
大猫的无限游戏
大猫的无限游戏
B
Blog
U
Unit 42
C
Check Point Blog
I
InfoQ
aimingoo的专栏
aimingoo的专栏
雷峰网
雷峰网
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 【当耐特】
人人都是产品经理
人人都是产品经理
The Cloudflare Blog
H
Help Net Security
MongoDB | Blog
MongoDB | Blog
博客园 - Franky
H
Hackread – Cybersecurity News, Data Breaches, AI and More
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
云风的 BLOG
云风的 BLOG
宝玉的分享
宝玉的分享
爱范儿
爱范儿

Benson's blog

Enjoy life Internship AI on academic research How AI Will Change the Mobile Ecosystem Look ahead Goodbye 2025 Hacker News to Kindle Another project How to imporve english Introduction of Fraud detection PopTranslate Last day in netease Better idea between Copilot-typed and CLI-typed assistant Gemini-cli LLM Post-Training experience Papers I readed recently about LLM application Difference between LLMs and traditional computer technology GRPO Weekly-#26 AI Application Weekly-#25 AI infra and application Weekly-#24 First week as LLM inference engineer Weekly-#23 seeking job Weekly-#22 2025 New Year AutoSwitch Translate Goodbye 2024 Weekly-#20 Breaking of glass Cross Entropy Loss of Triton Weekly-#18 Cross Entropy Loss of Triton Weekly-#17 Triton Puzzles Weekly-#16 AutoBuilder
模型解释性-PDP
Benson · 2022-06-26 · via Benson's blog

介绍

理想定义

PDP(Partial Dependence Plot) 局部依赖图,定义单特征和目标之间的关系,即函数 $\hat{f}X(x_S)$ \(\hat{f}_S(x_S)=E_{X_C}[\hat{f}(x_S,X_C)]=\int{\hat{f}(x_S,X_C)dP(X_C)}\) $x_S$ 标识当前特征 $S$ 的特征值,$X_C$ 表示出了 $S$ 以外的其他特征,$E{X_C}$ 表示给定 $X_S$ 时,模型 $\hat{f}$ 对特征 $X_C$ 的期望。

约束在特定的数据集上

求期望需要枚举 $X_C$,但枚举所有值算力消耗过高,而且某些特征取值的组合不一定有意义,因此取特定数据集中的特征值,模型 \(\hat{f}_S(X_S)=\frac{1}{n}\sum_{i=1}^n{\hat{f}(x_S, X_C^{(i)})}\) 当分析的单特征类型为类别型特征,直接看不同取值即可。 至此,就可以根据PDP对模型的单个特征做出人为可理解的解释。

单值衡量特征重要性

有了PDP的特征-结果关系函数 $\hat{y}(x)$ 之后,对数值型特征,可以将方差作为特征重要性的衡量。 对类别型特征呢?可以将 $\frac{max(f(x)) - min(f(x))}{4}$ 作为方差的近似。因为在正太分布中,95%的数据都满足 $x {\pm} 2 * var = mean$

优点

直观 容易应用 适用于任何黑盒模型

缺点

PDP只能做 <=2 个特征的解释,严格说这不是方法的缺点,而是人类的理解能力只能在 <=2 维度上 PDP依赖数据分布,可以加个散点图来解决 有特征独立的假设 某些影响可能会被隐藏:多类数据特征解释性相反,合并在一起就会变现为特征没有作用。其实和特征独立的假设是一个问题。

应用

scikit-learn.PDPBox

参考

https://christophm.github.io/interpretable-ml-book/pdp.html

Trending Tags