摘要
一种用于人工智能服务的集群资源分配方法、装置及产品,涉及大模型、人工智能、集群技术领域。该方法包括:获取部署有人工智能服务的集群的资源使用信息,集群包括专用节点、共享节点和弹性节点,专用节点用于部署推理子服务,共享节点至少用于部署训练子服务和数据处理子服务,弹性节点至少用于部署机器学习平台子服务;根据资源使用信息,确定集群的资源状态;根据资源状态,对人工智能服务进行资源分配。不仅能够在同一集群下满足人工智能服务的数据处理、模型训练、推理服务以及机器学习平台的多种服务需求,而且能够根据集群的资源使用信息对人工智能服务进行资源的动态分配,不仅减少响应延迟,而且有效提高节点资源的利用率。