网站建设与维护泰安网站建设

广州和恒电子商务有限公司 2026/09/09 19:17:42

论文网址:[1802.05695] Explainable Prediction of Medical Codes from Clinical Text

论文代码:GitHub - jamesmullenbach/caml-mimic: multilabel classification of EHR notes

目录

1. 心得

2. 论文逐段精读

2.1. Abstract

2.2. Introduction

2.3. Method

2.3.1. Convolutional architecture

2.3.2. Attention

2.3.3. Classification

2.3.4. Training

2.3.5. Embedding label descriptions

2.4. Evaluation of code prediction

2.4.1. Datasets

2.4.2. Systems

2.4.3. Evaluation Metrics

2.4.4. Results

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

2.5.2. Results

2.6. Related Work

2.7. Conclusions and Future Work

1. 心得

(1)是数据划分得很好吗?

2. 论文逐段精读

2.1. Abstract

①文本和标签之间没有直接的对间联系,使得分类很难很杂乱

2.2. Introduction

①ICD分类难点:标签空间大、写作风格不统一

②作者提出Convolutional Attention for Multi-Label classification (CAML)

taxonomy n.分类法;分类学;分类系统

2.3. Method

①ICD编码设为

②对每个标签需要去分类这个样本,其中

2.3.1. Convolutional architecture

①临床文本嵌入:,其中是文本长度

②对每个单词嵌入使用卷积

其中是选择卷积的token/words数,是输入的文本嵌入隐藏层维度,是输出的文本嵌入隐藏层维度,*是卷积操作,逐元素非线性变换,是偏置。作者padding了一下所以输出是

2.3.2. Attention

实际上是一个-gram的文本特征

②计算文本特征和标签特征的矩阵乘积:

其中是标签的特征

③归一化:

④每个标签的表示:

⑤文档级特征嵌入:

2.3.3. Classification

①对于文档级特征嵌入使用线性层分类:

其中是权重向量,是偏置标量

②模型设计:

2.3.4. Training

①交叉熵损失:

对权重使用L2正则以及使用Adam优化器

2.3.5. Embedding label descriptions

①I表示相关,HI表示高相关,CAML总是能抓住比较相关的文本:

②另一个约束项variant Description Regularized CAML(DR-CAML),让可学习向量的特征和描述文本特征(从WHO中得到)相近:

2.4. Evaluation of code prediction

2.4.1. Datasets

①MIMIC III:有8921个标签,其中6918是疾病,2003是操作

②按被试ID划分,同一个被试的多次住院不会被同时分进训练集/验证集/测试集

③数据集:MIMIC III full,MIMIC III 50,MIMIC II:

④数据预处理:移除不包含字母的文本(如500被移除但是500mg保留),将所有字母小写,⭐把整个数据集出现小于三个文档的token标记为UNK

⑤预训练文本嵌入模型word2vec CBOW,维度为

⑥所有诊断记录被截断为2500个token

addendum n.补遗;(尤指书籍的)补篇

2.4.2. Systems

①超参数设置:

调参是通过Spearmint Bayesian optimization pack age做到的

2.4.3. Evaluation Metrics

①列举一些评估指标

2.4.4. Results

①MIMIC III full上的对比实验:

②MIMIC III 50上的对比实验:

③MIMIC II full上的对比实验:

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

①描述了对于不同模型怎么提取标签对应的n-gram

2.5.2. Results

①请专家评估100次预测中标签和n-gram的对应程度:

2.6. Related Work

①列举CNN、LSTM、RNN等方法

2.7. Conclusions and Future Work

~

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈,一经查实,立即删除!

网站建设计划书学校网站建设

第一章:Redis键过期不触发?问题背景与影响在高并发系统中,Redis 常被用于缓存、会话管理、限流控制等场景,其键的自动过期机制࿰

2026/06/30 10:31:50

广州市网站建设安徽网站建设

游戏本地化破解研究:HunyuanOCR提取未汉化游戏内文本资源在Steam上发现一款画风惊艳的日式RPG,点开商店页面却赫然写着“不支持中文”——这种场景对国内玩家来说早

2026/06/30 10:47:52

网站建设公司哪个好江门网站建设

在做产品设计过程中,从竞品分析调研、原型设计到PRD撰写,都是必经的一套流程,只是平时被拆得比较碎。资料分散、反复整理、不断重画和重写,是很多项

2026/06/30 10:48:22

建设银行网站厦门网站建设

LobeChat 等保2.0合规实施路径在企业加速拥抱生成式AI的今天,越来越多组织选择基于开源项目快速搭建私有化AI助手平台。LobeChat 作为一款现代化的开源聊天界面࿰

2026/06/30 11:00:53

龙岗网站建设公司大庆网站建设

第一章:智谱Open-AutoGLM手机控制技术概述智谱AI推出的Open-AutoGLM是一项面向移动端的智能自动化控制技术,旨在通过大语言模型驱动手机操作系统完成复杂任

2026/06/30 12:07:59

物流网站建设广东网站建设

音乐喷泉博途v14和mcgs7.7触摸屏程序资料包2,带运行效果视频,流程图和io表最近在研究自动化控制项目时,发现了一款超有趣的资料包——音乐喷泉博途V14

2026/06/30 11:20:24

网站建设广告巴中网站建设

1.研究背景与意义随着信息技术的飞速发展,特别是互联网、大数据和人工智能技术的广泛应用,电子商务领域迎来了前所未有的发展机遇。农产品电商作为电子商务的一个重要分支ÿ

2026/06/30 11:39:26

上海外贸网站建设廊坊网站建设

第一章:智谱清言Open-AutoGLM概述智谱清言Open-AutoGLM是基于AutoGLM技术构建的开放语言模型平台,旨在为开发者与研究者提供高效、灵活的大模型应用能

2026/06/30 10:39:21

忻州网站建设建设教育网站

终极LaTeX模板指南:3小时搞定国家自然科学基金申请【免费下载链接】iNSFCAn awesome LaTeX template for NSFC proposal.项目地址: htt

2026/06/30 10:34:50

医院网站建设惠州网站建设

第一章:智谱手机端Open-AutoGLM上线智谱AI正式推出面向移动端的全新智能对话系统Open-AutoGLM,标志着其自研大模型技术在轻量化部署与跨平台兼容性方面取得

2026/06/30 13:23:35