基于国产CPU和OS的LLM应用开发平台资源计算方法
申请号:CN202510926470
申请日期:2025-07-07
公开号:CN120429126B
公开日期:2025-09-19
类型:发明专利
摘要
本发明公开了基于国产CPU和OS的LLM应用开发平台资源计算方法,属于大模型分析技术领域,该方法的实现包括:国产CPU和OS的选择:选择适用于具体模型规模和用户性能需求的硬件配置,在控制成本的前提下能够平稳运行需要规模的模型;LLM应用开发平台部署:LLM应用开发平台包括前端操作平台、请求分发平台及插件调用平台,用于快速集成调用大模型;大模型分布式容器部署:初始化多个大模型容器,用于接收并发的请求;负载均衡配置:将多个大模型容器配置到nginx中,均衡分配每个大模型容器的负载。本发明能够高效利用大模型计算资源,实现在国产CPU和OS的应用下提高大模型资源分配利用。
技术关键词
资源计算方法
负载均衡配置
分布式容器
机器可读程序
模型分析技术
麒麟操作系统
占用系统资源
插件平台
页面监控
检索业务
监控机器
分类工具
语言分析
生成机器
日志级别
告警机制