衡水网站建设咸阳网站建设

惠州市家家庆家庭服务有限公司 2026/09/09 19:56:53

论文网址:[1802.05695] Explainable Prediction of Medical Codes from Clinical Text

论文代码:GitHub - jamesmullenbach/caml-mimic: multilabel classification of EHR notes

目录

1. 心得

2. 论文逐段精读

2.1. Abstract

2.2. Introduction

2.3. Method

2.3.1. Convolutional architecture

2.3.2. Attention

2.3.3. Classification

2.3.4. Training

2.3.5. Embedding label descriptions

2.4. Evaluation of code prediction

2.4.1. Datasets

2.4.2. Systems

2.4.3. Evaluation Metrics

2.4.4. Results

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

2.5.2. Results

2.6. Related Work

2.7. Conclusions and Future Work

1. 心得

(1)是数据划分得很好吗?

2. 论文逐段精读

2.1. Abstract

①文本和标签之间没有直接的对间联系,使得分类很难很杂乱

2.2. Introduction

①ICD分类难点:标签空间大、写作风格不统一

②作者提出Convolutional Attention for Multi-Label classification (CAML)

taxonomy n.分类法;分类学;分类系统

2.3. Method

①ICD编码设为

②对每个标签需要去分类这个样本,其中

2.3.1. Convolutional architecture

①临床文本嵌入:,其中是文本长度

②对每个单词嵌入使用卷积

其中是选择卷积的token/words数,是输入的文本嵌入隐藏层维度,是输出的文本嵌入隐藏层维度,*是卷积操作,逐元素非线性变换,是偏置。作者padding了一下所以输出是

2.3.2. Attention

实际上是一个-gram的文本特征

②计算文本特征和标签特征的矩阵乘积:

其中是标签的特征

③归一化:

④每个标签的表示:

⑤文档级特征嵌入:

2.3.3. Classification

①对于文档级特征嵌入使用线性层分类:

其中是权重向量,是偏置标量

②模型设计:

2.3.4. Training

①交叉熵损失:

对权重使用L2正则以及使用Adam优化器

2.3.5. Embedding label descriptions

①I表示相关,HI表示高相关,CAML总是能抓住比较相关的文本:

②另一个约束项variant Description Regularized CAML(DR-CAML),让可学习向量的特征和描述文本特征(从WHO中得到)相近:

2.4. Evaluation of code prediction

2.4.1. Datasets

①MIMIC III:有8921个标签,其中6918是疾病,2003是操作

②按被试ID划分,同一个被试的多次住院不会被同时分进训练集/验证集/测试集

③数据集:MIMIC III full,MIMIC III 50,MIMIC II:

④数据预处理:移除不包含字母的文本(如500被移除但是500mg保留),将所有字母小写,⭐把整个数据集出现小于三个文档的token标记为UNK

⑤预训练文本嵌入模型word2vec CBOW,维度为

⑥所有诊断记录被截断为2500个token

addendum n.补遗;(尤指书籍的)补篇

2.4.2. Systems

①超参数设置:

调参是通过Spearmint Bayesian optimization pack age做到的

2.4.3. Evaluation Metrics

①列举一些评估指标

2.4.4. Results

①MIMIC III full上的对比实验:

②MIMIC III 50上的对比实验:

③MIMIC II full上的对比实验:

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

①描述了对于不同模型怎么提取标签对应的n-gram

2.5.2. Results

①请专家评估100次预测中标签和n-gram的对应程度:

2.6. Related Work

①列举CNN、LSTM、RNN等方法

2.7. Conclusions and Future Work

~

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈,一经查实,立即删除!

三亚网站建设湖北网站建设

Open-Sora-Plan AI视频教学工具包:5分钟快速上手终极指南【免费下载链接】Open-Sora-Plan由北大-兔展AIGC联合实验室共同发起,希望通过开源社区

2026/06/30 12:41:02

网站建设报告微信网站建设

雷递网 雷建平 1月4日红星冷链(湖南)股份有限公司(简称:“红星冷链”,股票代码为:“1641”)日

2026/06/30 12:13:29

郑州网站建设永康网站建设

在树莓派5上部署ROS2:从零搭建高性能机器人开发平台你有没有试过在树莓派上跑一个完整的机器人系统,结果刚启动几个节点就卡得动不了?或者满怀期待地输入sudo

2026/06/30 11:38:26

商洛网站建设南网站建设

颠覆性测试框架:构建下一代前后端一体化验证体系【免费下载链接】casperjsCasperJS is no longer actively maintained. Navigation

2026/06/30 11:58:58

长春网站建设网站建设的公司

PyTorch分布式训练在Miniconda环境中的配置要点在现代深度学习项目中,动辄数十亿参数的模型让单卡训练变得遥不可及。一个典型的ResNet-50训练任务,在单张A

2026/06/30 12:11:30

温州网站建设服装网站建设

comsol水声超表面反射系数与反射相位计算。打开模型树先给几何结构来点硬核配置。假设咱们设计的是锯齿状超表面单元,用AppendAxisymmetric搞个二维轴对称模型省点计算量。材

2026/06/30 14:01:08

杭州营销型网站建设免费建设网站

在当今快速迭代的开发环境中,设计到代码转换的效率直接影响项目的交付周期。通过Figma MCP工具,我们能够将设计数据无缝转换为可用的代码组件,但如何在这个流

2026/06/30 13:36:36

建设网站制作濮阳网站建设

Red Hat KVM 虚拟化实战指南1. 准备工作与 KVM 包安装在开始使用 KVM 进行虚拟化操作前,需要注意两点:一是必须拥有虚拟化授权许可证,否则无法从 Red Hat 获取更新;二是由于使

2026/06/30 12:47:03

沈阳网站建设渭南网站建设

前面介绍了软件公司的痛点,这些痛点也会影响到应用系统开发的质量、时间和费用。今天我们再来看看应用系统的用户的痛点。这里的用户是指使用应用系统的用户。用户一般分两种,一种是企

2026/06/30 12:29:01