Mark Ma.
← 所有作品

研究 · 强化学习

Diabetes & Reinforcement Learning

基于模拟数据,探索强化学习在血糖管理中的应用。

学术项目 · 模拟环境

连续决策与变化的状态

项目将胰岛素剂量决策作为强化学习问题来探索,通过模拟器提供环境与数据,研究血糖管理策略。

方法

使用 Advantage Actor-Critic(A2C)作为建模方法,将学习智能体与模拟环境连接起来。

范围

这是学术模拟项目,不是经过临床验证的剂量决策系统。代码呈现建模思路与实验设置。

查看代码 ↗
← 回到精选作品联系我 ↗