面向闭环1型糖尿病控制的可解释语言模型
本文提出了LLM-T1D,一种结合强化学习(RL)精度与大型语言模型(LLM)人类化推理的胰岛素泵控制器。通过训练专家RL系统并蒸馏知识至微调后的LLaMA 3.1 8B和Qwen3 8B模型,开发出不仅超越RL性能且能用易懂语言解释决策的控制器。经FDA批准的UVA/Padova模拟器测试,LLM控制器实现了73.5%的血糖控制时间在目标范围内,并通过正式方法严格验证,保证对幻觉信息的安全性。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。