网站建设与维护泰安网站建设

深圳博睿恒通动力技术有限公司 2026/09/09 18:41:05

论文网址:[1802.05695] Explainable Prediction of Medical Codes from Clinical Text

论文代码:GitHub - jamesmullenbach/caml-mimic: multilabel classification of EHR notes

目录

1. 心得

2. 论文逐段精读

2.1. Abstract

2.2. Introduction

2.3. Method

2.3.1. Convolutional architecture

2.3.2. Attention

2.3.3. Classification

2.3.4. Training

2.3.5. Embedding label descriptions

2.4. Evaluation of code prediction

2.4.1. Datasets

2.4.2. Systems

2.4.3. Evaluation Metrics

2.4.4. Results

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

2.5.2. Results

2.6. Related Work

2.7. Conclusions and Future Work

1. 心得

(1)是数据划分得很好吗?

2. 论文逐段精读

2.1. Abstract

①文本和标签之间没有直接的对间联系,使得分类很难很杂乱

2.2. Introduction

①ICD分类难点:标签空间大、写作风格不统一

②作者提出Convolutional Attention for Multi-Label classification (CAML)

taxonomy n.分类法;分类学;分类系统

2.3. Method

①ICD编码设为

②对每个标签需要去分类这个样本,其中

2.3.1. Convolutional architecture

①临床文本嵌入:,其中是文本长度

②对每个单词嵌入使用卷积

其中是选择卷积的token/words数,是输入的文本嵌入隐藏层维度,是输出的文本嵌入隐藏层维度,*是卷积操作,逐元素非线性变换,是偏置。作者padding了一下所以输出是

2.3.2. Attention

实际上是一个-gram的文本特征

②计算文本特征和标签特征的矩阵乘积:

其中是标签的特征

③归一化:

④每个标签的表示:

⑤文档级特征嵌入:

2.3.3. Classification

①对于文档级特征嵌入使用线性层分类:

其中是权重向量,是偏置标量

②模型设计:

2.3.4. Training

①交叉熵损失:

对权重使用L2正则以及使用Adam优化器

2.3.5. Embedding label descriptions

①I表示相关,HI表示高相关,CAML总是能抓住比较相关的文本:

②另一个约束项variant Description Regularized CAML(DR-CAML),让可学习向量的特征和描述文本特征(从WHO中得到)相近:

2.4. Evaluation of code prediction

2.4.1. Datasets

①MIMIC III:有8921个标签,其中6918是疾病,2003是操作

②按被试ID划分,同一个被试的多次住院不会被同时分进训练集/验证集/测试集

③数据集:MIMIC III full,MIMIC III 50,MIMIC II:

④数据预处理:移除不包含字母的文本(如500被移除但是500mg保留),将所有字母小写,⭐把整个数据集出现小于三个文档的token标记为UNK

⑤预训练文本嵌入模型word2vec CBOW,维度为

⑥所有诊断记录被截断为2500个token

addendum n.补遗;(尤指书籍的)补篇

2.4.2. Systems

①超参数设置:

调参是通过Spearmint Bayesian optimization pack age做到的

2.4.3. Evaluation Metrics

①列举一些评估指标

2.4.4. Results

①MIMIC III full上的对比实验:

②MIMIC III 50上的对比实验:

③MIMIC II full上的对比实验:

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

①描述了对于不同模型怎么提取标签对应的n-gram

2.5.2. Results

①请专家评估100次预测中标签和n-gram的对应程度:

2.6. Related Work

①列举CNN、LSTM、RNN等方法

2.7. Conclusions and Future Work

~

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈,一经查实,立即删除!

太原网站建设益阳网站建设

还在为大语言模型推理速度慢、内存占用高而头疼吗?😫 当你的应用需要同时处理多个用户请求时,是否经常遇到GPU内存不足或响应超时的问题?今天我要

2026/06/30 14:11:09

孝感网站建设梧州网站建设

如何用50张图片训练专属AI绘画模型?LoRA-Scripts实战教程来了在生成式AI席卷内容创作的今天,一个现实问题摆在许多设计师和开发者面前:通用的大模型

2026/06/30 13:07:34

青海网站建设荆门网站建设

Navicat密码解密工具:快速找回数据库连接密码的专业解决方案【免费下载链接】navicat_password_decrypt忘记navicat密码时,此工具可以帮您查看密码项目地址:

2026/06/30 11:05:23

网站建设流程睢宁网站建设

快速体验打开 InsCode(快马)平台 https://www.inscode.net输入框内输入如下内容:设计一个Markdown写作效率测试工具,功能包括࿱

2026/06/30 12:30:31

六安网站建设辽宁网站建设

虾米音乐重启计划或可采用该技术在数字内容高速迭代的今天,声音不再只是信息的载体,更是品牌人格的延伸。当虾米音乐传出重启消息时,许多人都在期待它能否找回当年那份

2026/06/30 11:38:26

网站建设设计网站建设规划书

大模型服务用户体验优化:首token延迟降低方案在如今的智能对话系统中,用户已经习惯了“秒回”体验。当你向语音助手提问、在客服窗口输入问题,或是使用AI写作工

2026/06/30 13:21:05

邵阳网站建设台州网站建设

Hunyuan3D-2:如何用AI快速生成高精度3D资产?【免费下载链接】Hunyuan3D-2Hunyuan3D 2.0:高分辨率三维生成系统,

2026/06/30 12:28:31

石家庄网站建设长沙市网站建设公司

在追求健康生活的时代,选择一桶优质的桶装水固然是最重要的,但是各种品牌的桶装水百花齐放,饮用水作为我们生活中不可或缺的“食物”之一,我们不仅对水

2026/06/30 14:07:09

建设部网站孝感网站建设

从设计到制造:如何用Allegro精准导出电机控制器的Gerber文件在高性能电机控制系统中,PCB不仅是电路的载体,更是决定系统可靠性、散热效率和电磁兼容性

2026/06/30 12:55:33

网站建设与管理绍兴网站建设

文章目录系统截图项目简介大数据系统开发流程主要运用技术介绍爬虫核心代码展示结论源码文档获取定制开发/同行可拿货,招校园代理 :文章底部获取博主联系方式!系统截图基于Djan

2026/06/30 13:58:38