惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recorded Future
Recorded Future
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Forbes - Security
Forbes - Security
N
News and Events Feed by Topic
SecWiki News
SecWiki News
T
The Exploit Database - CXSecurity.com
S
Security @ Cisco Blogs
H
Heimdal Security Blog
Security Latest
Security Latest
T
Threatpost
V2EX - 技术
V2EX - 技术
C
Cybersecurity and Infrastructure Security Agency CISA
GbyAI
GbyAI
The Last Watchdog
The Last Watchdog
Recent Announcements
Recent Announcements
P
Privacy International News Feed
K
Kaspersky official blog
P
Proofpoint News Feed
L
LangChain Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
Security Archives - TechRepublic
Security Archives - TechRepublic
T
Threat Research - Cisco Blogs
博客园_首页
T
Tor Project blog
M
MIT News - Artificial intelligence
The Hacker News
The Hacker News
The GitHub Blog
The GitHub Blog
月光博客
月光博客
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
F
Full Disclosure
MyScale Blog
MyScale Blog
The Register - Security
The Register - Security
Engineering at Meta
Engineering at Meta
Y
Y Combinator Blog
Cyberwarzone
Cyberwarzone
L
LINUX DO - 最新话题
量子位
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
O
OpenAI News
T
The Blog of Author Tim Ferriss
S
Schneier on Security
小众软件
小众软件
The Cloudflare Blog
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Recent Commits to openclaw:main
Recent Commits to openclaw:main
Know Your Adversary
Know Your Adversary
Microsoft Security Blog
Microsoft Security Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
L
Lohrmann on Cybersecurity
Vercel News
Vercel News

从百草园到三味书屋

医学人工智能周刊7|医疗人工智能算法的公平性 如何阅读论文 Skip-gram模型(2) 医学人工智能周刊6|模态无关的学习方法在医学影像以及生理信号中的评测 医学人工智能周刊5|提高医疗领域AI算法研究透明性清单 医学人工智能周刊4|如何解决医学人工智能的可解释性 医学人工智能周刊 #3 医学人工智能周刊 #2 医学人工智能周刊 开刊 生存分析(一) 统计学中的假设检验 什么是科学问题? MultiBench多模态表征学习的多尺度基准 Embedding是什么? Skip-gram模型(1) 公开重症监护数据库MIMIC代码仓库介绍 公开重症监护数据库MIMIC-IV介绍 MIT 6.S91 Introduction Deep Learning Notes 《A Unified Approach to interpreting Model Predictions》论文解读 About Friends PyTorch深度学习(2) 重读XGBoost LSTM应用场景以及pytorch实例 PyTorch深度学习(1) Mathematical notation Git常用命令
ClinicalBERT: 对医学文本建模用于再入院预测
Yong · 2023-03-01 · via 从百草园到三味书屋

使用临床文本预训练BERT然后在再入院任务中微调

引言 #

非结构化、高维稀疏信息例如临床文本难以在临床机器学习模型中使用。临床文本中包含什么样的临床价值?更加丰富、详细。然而重症监护室医生在有限时间内需要做出最优决策,读大量的临床文本,增加工作量。

再入院会降低患者生活质量、增加花费。这篇文章旨在建立一个出院决策模型,根据医护人员笔记动态的赋予患者30天再入院的风险。

背景 #

临床文本会有缩写、黑话、不标准的语法结构,从临床文本中学习有用的表征具有挑战。以往的方法无法捕捉获取临床意义的文本长程依赖,介绍BERT,以及基于BERT已经开展的工作,已经有人把BERT用在临床文本了,本文在再入院任务上评估改进ClinicalBERT并且在更长的序列上进行预训练。

介绍前人在ICU再入院预测上的工作,缺点:大多数工作都只用了出院的信息,ClinicalBERT使用患者住院整个时间段信息。

该工作的重要性 #

  • 用出院信息来预测意味着减少了再入院风险的机会少了,都要出院了,此刻告诉有再入院的风险,难以采取措施;
  • 由于医院已经有很多误报警,医疗模型需要高的PPV1,该模型同其他模型相比有最高的recall2
  • 模型中attention能用于可视化解释。

方法 #

什么是BERT #

BERT是基于transformer编码器架构的深度神经网络,它用于学习文本的嵌入表达。

  • 自注意力机制
  • BERT模型通过2个无监督任务进行预训练:掩码模型和下一个句子预测。

临床文本嵌入 #

  • 先分词成token3,这里是子词粒度的tokenization4
  • ClinicalBert的token包括子词、分段嵌入、位置嵌入相加后的结果
    • 分段嵌入是当多个序列输入时,表示当前的token属于哪一段
    • 位置嵌入即在输入序列中token的位置

自注意力机制 #

用于输入token之间的关系捕捉

预训练 #

BERT是在BooksCorpus和Wikipedia中预训练的,临床文本黑话缩写,与一般文本可能语法也不一样,需要在临床文本中进行预训练。损失函数是预测掩码单词任务和预测两个句子是否连续任务损失函数之和。

微调 #

在再入院任务中微调 $$P(readmit = 1 | h_{[cls]}) = \sigma(Wh_{[cls]})$$ 式中W为参数,h为BERT模型输出。

实验 #

数据 #

MIMIC-III中2083180份去隐私化后的文本,五折每一轮其中四折预训练,最后一折微调

实证研究I #

  • 在临床语言建模中ClinicalBERT与BERT进行比较:预测掩码token以及2个句子是否连续任务中均优于BERT
  • 定性分析:专家给出相似医学概念,ClinicalBERT学习嵌入表达后,进行降维可视化,发现相近
  • 定量分析:采用相似度度量公式计算表征之前相似度,然后与专家打分的相似度进行关联分析计算pearson相关系数

实证研究II #

  • 再入院队列:34560患者,2963再入院,42358负样本,这里为啥有这么多负样本?
  • 调整后的再入院预测: $$P(readmit = 1|h_{patient}) = \frac{P^n_{max}+P^n_{mean}n/c}{1+n/c}$$
    • 有些文本是比较重要,有些文本对再入院预测不重要,所以要包括最大的概率
    • 噪声会降低性能,消除噪音的方法还是取大多数值的平均,如果序列越长,噪声出现的可能性越大,所以需要平均值的权重越大,引入了n/c作为比例因子
    • 分母则是用于概率归一化到0,1区间
  • 评估指标
    • AUROC
    • AUPRC
    • RP80:准确度为80%时候到召回率
  • 模型比较:Bag of words,BI-LSTM,BERT
  • 用出院记录来进行再入院预测
  • 用24-48小时数据预测,以及48-72小时数据预测
  • 可解释性
    • 给出一句话的self-attention权重示意图

讨论 #

建议在私有数据集上重新训练后在下游任务中使用

代码 #

思考 #

自chatgpt后,大型语言模型受到广泛关注,医学语言模型的发展似乎有多种路径,一种是直接在通用文本上预训练,一种是在医学文本中预训练,或是通用模型在领域微调,个人感觉应该是第三种效果会较好。