数算岛 智 算 平 台 SSD-PAI[ Github 主仓库优先更新https://github.com/roinli/SSD-GPU-POOL ](https://github.com/roinli/SSD-GPU-POOL) | [Gitee 镜像仓库](https://github.com/roinli/SSD-GPU-POOL)产品概述智能时代一体化算力服务平台解决方案· 提供统一、灵活、易用、全面的算力资源管理与调度策略解决传统算力使用场景中算力资源碎片化、用户需求多样化、运维管理工作量大等问题。· 可整合零散、异构算力资源进行统一管理与调度实现化零为整提升算力资源整体利用率。· 为算力租户提供一个可伸缩、可定制、相对隔离且开箱即用的在线计算环境用户可通过浏览器使用平台的完整功能。· 有效支撑用户研发过程闭环提供数据准备→运行环境→训练/计算→成果归档/复用的研发全流程的环境/工具支持促进智能生态蓬勃发展。功能特点支持异构算力资源统一管理调度· 可接入校园内部各算力集群打破算力孤岛实现统一管理。· 支持对不同型号硬件设备的统一管理。· 用户可指定使用的资源类型平台进行按需调度。丰富、便捷的在线研发环境· 支持云桌面、Jupyter、SSH 1、Web IDE、Web Terminal 2、低代码“拖拉拽”流程建模等多款开箱即用的算力使用环境满足用户对不同研发环境的需求。· 支持一键导入社区开源的Docker镜像无需任何改动即可在线使用提升科研效率。· 用户可在浏览器使用平台的完整功能达到“任何人、任何时间、任何地点”均能使用本平台的效果。注1: 可针对校园机房安全策略提供直连及代理连接两种不同的SSH连接方式注2: 基于CG WebTerminal实现在浏览器中执行shell命令以使用几乎任何类型的运行环境全流程研发工具支撑· 提供数据标注、离线运行、训练记录、GPU分布式计算等工具或框架支持。· 支撑研发过程形成闭环数据准备 → 运行环境 → 模型训练 → 成果归档 → 成果复用。基于共享的资源配额管理· 管理员可为用户设置资源使用总配额及单个项目的资源上限对CPU、内存、GPU等资源使用量进行限定。· 用户组在配额限定范围内可自由申请资源及变更软件环境无需管理员干预。· 支持自动、手动、延迟等多种资源释放策略在满足用户需求同时尽快回收算力资源。· 支持灵活设置用户的项目最长运行时间倒计时结束即可强制收回项目申请的资源。基于共享的资源配额管理· 管理员可为用户设置资源使用总配额及单个项目的资源上限对CPU、内存、GPU等资源使用量进行限定。· 用户组在配额限定范围内可自由申请资源及变更软件环境无需管理员干预。· 支持自动、手动、延迟等多种资源释放策略在满足用户需求同时尽快回收算力资源。· 支持灵活设置用户的项目最长运行时间倒计时结束即可强制收回项目申请的资源。支持数据共享· 可公开各类科研成果包括模型、项目、数据集及软件环境镜像等。· 支持对各类公开科研成果进行复用加速成果转化及科研合作。多粒度GPU算力调度· VGPU技术支持:多用户同时用一张卡。· 分布式GPU算力支持:一个用户同时用多张卡。应用中心· 开发者可将开发完成的服务/应用发布到应用中心供其它用户使用促进成果交流。· 用户可在此寻找对自己有帮助的应用激发创作灵感。· 其它平台的应用可直接使用应用中心内的服务或应用提升系统研发效率。数据支持多源数据集管理支持数据在线预览支持数据在线标注算法丰富的平台预设算法支持代码片段管理模型训练辅助工具模型丰富的平台预设模型支持用户模型入库管理支持模型文件预览算力资源基于容器云架构的调度支持vGPU切分技术支持GPU分布式计算运行环境丰富的平台预设镜像灵活便捷的在线镜像定制可私有化部署的镜像仓库其它平台能力丰富的在线开发环境用户数据分享机制离线任务支持支持团队协同多粒度资源监控插件能力计费、用量管理页面风格定制能力......平台架构轻量、易用、灵活、全面、开箱即用