§3 技术规划

技术架构:浏览器仿真 + 算力训练 双入口

架构核心决策:平台以双入口承载两类核心场景。浏览器仿真训练(Web MuJoCo)在浏览器端完成仿真, 静态资源按「C端:阿里云 CDN 加速 / 学校:万兆网络 + Nginx 负载均衡」双通道分发,由资源控制与 LLM 能力支撑,统一落在仿真后端服务; 算力训练以训练主机 Notebook 为入口,经训练管控后端完成算力提供商适配、费用控制与训练资源分发, 并与各家训练主机(AutoDL 算力云、阿里云等)搭载的「训练资源代理应用」交互,控制训练主机加载的资源。

入口层
浏览器仿真训练
(Web MuJoCo)
算力训练
(云端 Notebook)
接入与分发层
静态资源分发(C端)
阿里云 CDN 加速
静态资源分发(学校)
万兆网络 + Nginx 负载均衡
训练主机 Notebook
算力训练入口 · 在线开发环境
管控与能力层
资源控制
控制用户可见哪些资源
LLM
提供大模型对话能力
训练算力提供商适配
对接 AutoDL、阿里云 等
费用控制
训练费用管控
训练资源分发
与训练资源代理应用交互,控制训练主机加载的资源
后端服务层
仿真后端服务
浏览器仿真的核心后端
训练管控后端服务
训练链路的统一管控
基础设施层
各家训练主机(AutoDL 算力云、阿里云 等)
搭载「训练资源代理应用」 · 各种训练环境
代理应用交互
入口 / 核心后端服务 功能模块 外部算力基础设施(第三方云) 训练资源分发 ⇄ 训练资源代理应用(旁路交互通道)
配置说明
本地化部署服务器硬件配置基线 · 以 30 人并发计算
应用服务器 承载仿真后端 / 训练管控后端 / 资源分发
CPU 核数
(线程数)
64 核(64 线程)
内存
128 GB
存储
(固态、机械硬盘均要求企业级)
系统及应用盘2T NVMe SSD × 2RAID 1 日志盘2T SATA 机械盘 × 4RAID 10
网卡
万兆网卡
算力服务器 承载训练主机 Notebook / 训练环境
CPU 核数
(线程数)
96 核(96 线程)
GPU
按学校购买课程所需算力
或项目参数而定(弹性选配)
内存
256 GB
存储
(固态、机械硬盘均要求企业级)
系统及应用盘2T NVMe SSD × 2RAID 1
网卡
万兆网卡
说明: ① 存储均要求企业级盘;应用服务器系统及应用盘以 RAID 1 保障冗余,日志盘以 RAID 10 兼顾写入性能与数据安全; ② 算力服务器 GPU 为弹性项,依课程算力需求 / 项目训练参数选配,可按并发规模逐步扩容; ③ 两类服务器均标配万兆网卡,与「学校:万兆网络 + Nginx 负载均衡」的静态资源分发通道匹配; ④ 以上为 30 人并发基线配置,并发规模上升时优先横向扩展算力服务器。