衡水网站建设咸阳网站建设

沭阳县米伊园林绿化有限公司 2026/09/09 19:26:11

论文网址:[1802.05695] Explainable Prediction of Medical Codes from Clinical Text

论文代码:GitHub - jamesmullenbach/caml-mimic: multilabel classification of EHR notes

目录

1. 心得

2. 论文逐段精读

2.1. Abstract

2.2. Introduction

2.3. Method

2.3.1. Convolutional architecture

2.3.2. Attention

2.3.3. Classification

2.3.4. Training

2.3.5. Embedding label descriptions

2.4. Evaluation of code prediction

2.4.1. Datasets

2.4.2. Systems

2.4.3. Evaluation Metrics

2.4.4. Results

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

2.5.2. Results

2.6. Related Work

2.7. Conclusions and Future Work

1. 心得

(1)是数据划分得很好吗?

2. 论文逐段精读

2.1. Abstract

①文本和标签之间没有直接的对间联系,使得分类很难很杂乱

2.2. Introduction

①ICD分类难点:标签空间大、写作风格不统一

②作者提出Convolutional Attention for Multi-Label classification (CAML)

taxonomy n.分类法;分类学;分类系统

2.3. Method

①ICD编码设为

②对每个标签需要去分类这个样本,其中

2.3.1. Convolutional architecture

①临床文本嵌入:,其中是文本长度

②对每个单词嵌入使用卷积

其中是选择卷积的token/words数,是输入的文本嵌入隐藏层维度,是输出的文本嵌入隐藏层维度,*是卷积操作,逐元素非线性变换,是偏置。作者padding了一下所以输出是

2.3.2. Attention

实际上是一个-gram的文本特征

②计算文本特征和标签特征的矩阵乘积:

其中是标签的特征

③归一化:

④每个标签的表示:

⑤文档级特征嵌入:

2.3.3. Classification

①对于文档级特征嵌入使用线性层分类:

其中是权重向量,是偏置标量

②模型设计:

2.3.4. Training

①交叉熵损失:

对权重使用L2正则以及使用Adam优化器

2.3.5. Embedding label descriptions

①I表示相关,HI表示高相关,CAML总是能抓住比较相关的文本:

②另一个约束项variant Description Regularized CAML(DR-CAML),让可学习向量的特征和描述文本特征(从WHO中得到)相近:

2.4. Evaluation of code prediction

2.4.1. Datasets

①MIMIC III:有8921个标签,其中6918是疾病,2003是操作

②按被试ID划分,同一个被试的多次住院不会被同时分进训练集/验证集/测试集

③数据集:MIMIC III full,MIMIC III 50,MIMIC II:

④数据预处理:移除不包含字母的文本(如500被移除但是500mg保留),将所有字母小写,⭐把整个数据集出现小于三个文档的token标记为UNK

⑤预训练文本嵌入模型word2vec CBOW,维度为

⑥所有诊断记录被截断为2500个token

addendum n.补遗;(尤指书籍的)补篇

2.4.2. Systems

①超参数设置:

调参是通过Spearmint Bayesian optimization pack age做到的

2.4.3. Evaluation Metrics

①列举一些评估指标

2.4.4. Results

①MIMIC III full上的对比实验:

②MIMIC III 50上的对比实验:

③MIMIC II full上的对比实验:

2.5. Evaluation of Interpretability

2.5.1. Extracting informative text snippets

①描述了对于不同模型怎么提取标签对应的n-gram

2.5.2. Results

①请专家评估100次预测中标签和n-gram的对应程度:

2.6. Related Work

①列举CNN、LSTM、RNN等方法

2.7. Conclusions and Future Work

~

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈,一经查实,立即删除!

永州网站建设宿迁网站建设

深入解析 Exim 邮件传输代理:功能、配置与优化在当今数字化的时代,邮件作为一种重要的通信方式,其传输的稳定性和高效性至关重要。Exim 作为一款功能强大的邮件传输代理(MTA),为用户提供了丰富的

2026/06/30 13:01:34

辽宁网站建设网站建设建设

学术写作中难免遇到重复率过高的问题,现代人工智能技术为此提供了多种智能解决方案。通过对比测试发现,目前市场上有六种效果显著的智能降重系统,能够有效帮助研究者解

2026/06/30 12:10:59

重庆网站建设电器网站建设

摘要:本文聚焦定制开发开源AI智能名片S2B2C商城小程序,深入探讨产品经理在该项目中的职责与发展。通过分析产品经理在需求分析、功能设计、用户反馈处理、影响分析以及功能价值

2026/06/30 12:42:02

深圳网站建设公司品牌网站建设公司

第一章:Open-AutoGLM 睡眠质量分析Open-AutoGLM 是一款基于开源大语言模型的智能健康分析工具,专为睡眠质量评估与干预建议设计。它通过整合可穿戴设备采集

2026/06/30 12:36:32

河南网站建设公司网站建设与

10 个自考开题报告工具,AI降重免费网站推荐论文写作的困境:时间紧、任务重,降重成了最难啃的骨头对于自考学生来说,论文写作从来不是一件轻松的事

2026/06/30 10:25:50

龙岗网站建设北海网站建设

paopao-ce插件化架构终极指南:如何实现功能模块的动态加载与组合【免费下载链接】paopao-cerocboss/paopao-ce 是一个基于 Go 语言的轻量级博客系统。适合在

2026/06/30 14:18:39

机票网站建设新乡网站建设

Obsidian研究笔记模板:3步构建科研工作流的智能中枢【免费下载链接】obsidian_vault_template_for_researcherThis is an vault t

2026/06/30 12:42:32

成都网站建设php网站建设

从“大模型”到“高效能”——AI 哲学的根本性转变在过去几年里,AI 图像生成领域的主旋律一直是“越大越好”——追求模型参数的巨大和算力的无限堆砌。然而,谷歌最新发布的Na

2026/06/30 12:20:30

徐家汇网站建设银行网站建设

快速体验打开 InsCode(快马)平台 https://www.inscode.net输入框内输入如下内容:创建一个基于NOTEBOOKLM的AI笔记助手应用,能够自动识

2026/06/30 13:57:08

青海网站建设顺德网站建设

3步搞定!用Google API Python客户端构建智能物流配送系统【免费下载链接】google-api-python-client🐍 The official Py

2026/06/30 13:27:36