首页    |     本刊简介    |     征稿简则    |     征订启事    |     联系我们    |
天津科技大学学报欢迎您投稿!
 
   采编平台 /// 
 
    • 作者投稿  
    • 专家审稿  
    • 编辑办公  
 
   
 
   期刊论文 /// 
 
    • 全文浏览  
    • 论文检索  
    • 浏览排行  
 
   
 
   下载中心 /// 
 
    • 论文模板
    • 在研证明模板
    • 平台使用说明
 
   
 
 您现在的位置: 首页» 学报论文» 网络首发»  

基于强化学习和多决策偏好优化的医疗决策推荐模型

王嫄,盛梦茹,温辉,熊宁,程毅松,吴骎

摘 要:基于交互优化的强化学习能够有效模拟医生在连续时间点上对患者状态进行观察、干预与反馈。然而,目前用于医疗决策的强化学习架构只能利用显式独立的患者状态信号进行策略学习,未能建模隐式的多诊疗决策偏好复杂关联信息。这导致个体患者信息存在无法利用全局知识信息、模型行为不稳定、诊疗决策反馈不及时的问题。针对此问题,本文在强化学习框架下提出一种多决策偏好优化方法,命名为 DP-DDQN(decision preferences based on double deep Q-network),通过逆强化学习建模隐式的全局决策偏好,应用全局决策偏好更新患者状态表示,将显式的个性化诊疗偏好和隐式的全局决策偏好联合建模为奖励函数指导模型学习策略。结果表明,本文模型在脓毒症抗生素种类剂量推荐任务中可以使患者生存率提升至 84.01%,较临床提高了 17.45%,输出的治疗方案与临床实践规范高度契合,且可以合理建议药物使用剂量。



论文下载:
  • 02 基于强化学习和多决策偏好优化的医疗决策推荐模型_王嫄.pdf
  •   浏览次数:
     
     

    版权所有:《天津科技大学学报》编辑部

    网站设计与维护:天津科技大学信息化建设与管理办公室

    津科备27-1号