摘要
本发明公开了一种基于强化学习的PD‑L1检测方法和装置,该方法包括:收集患者的CT图像,并对其进行预处理,以构建训练数据集和测试数据集;构建预测模型,并使用训练数据集采用双层优化结构通过强化学习对预测模型进行训练,以获取训练好的预测模型;利用训练好的预测模型对测试数据集中待测试的CT图像进行预测,获取预测的PD‑L1状态。本发明通过引入基于强化学习的多损失函数机制,提高了PD‑L1状态的检测准确性,解决了不同损失函数在优化目标时存在的梯度冲突问题;本发明能够无创检测PD‑L1状态,减少了对患者进行手术或肿瘤标本活检的需求,降低了患者的身体负担。