week6
本周主要基调在于虚拟化GPU后端API和管理面板的开发。尽快拿出可行成果。
星期一
完成4颗卫星及其编队对中东地区重访时间的计算
星期二
为大模型运行做准备,建立带有必要的深度学习框架的镜像
下载安装vllm的wheel文件,解决pip安装的numpy版本不符合的问题
回答潘少关于之前测算的星座设计结果的疑问,以及一些轨道相关问题
星期三到星期五
完成云部署的管理API开发,能够实现指定vMem的任务划分,能够通过deployment指定pod数量部署非GPU相关任务,能够满足考核指标中的“同时运行应用数量不小于5个”的需求,能够满足考核指标中的"提供容器应用实例的全生命周期(创建、更新、重启等)管理"需求
初步确定了配合管理API的前端方案、页面结构等
通过配置Prometheus + Grafana实现整个k3s集群的CPU、内存、GPU资源监控以及炫酷的可视化界面,满足考核指标中的“具备资源管理和资源监控等功能,具备离线独立管控能力,连接状态下监控间隔小于30s”的要求。
License:
CC BY 4.0