维普中文期刊产品整合服务

大规模异构计算集群的双层作业调度系统

查看全文 作  者:[1,2]孙震宇;[1]石京燕;[1]孙功星;[1]杜然;[1]姜晓巍;[1]邹佳恒;[1,2]谭宏楠 高影响力作者 机构地区:[1]中国科学院高能物理研究所,北京100049;[2]中国科学院大学物理科学学院,北京100049高影响力机构 出  处:《计算机工程》索引2020年第46卷第1期,共9页高影响力期刊 基  金:国家自然科学基金(11475210);国家自然科学基金青年基金(11805225) 摘  要:高能物理计算平台中的HTCondor和SLURM计算集群为多个高能物理实验提供数据处理服务,然而HTCondor并行作业调度效率较低、SLURM难以应对大量串行作业,且计算平台整体资源管理及调度策略过于简单。为满足高能物理计算集群高负荷运行的需求,在传统作业调度器上增加作业管理层,设计双层作业调度系统,通过高效调度串并行作业并兼顾实验组间资源的使用公平性,实现用户对作业的细粒度管理。测试结果表明,双层作业调度系统支持大批量高能物理作业的快速提交,并充分利用计算平台的总体资源,具有较好的作业调度性能。 关 键 词:计算集群管理 作业调度器 高通量计算 高性能计算 高能物理计算
相关文献

参考文献(26)

引证文献(7)

耦合文献(116)

网站首页 | 关于我们 | 联系我们 | 产品服务 | 客服中心 | 广告服务 | 版权声明 | 网站联盟 | 友情链接 | 售卡网点

版权所有© 渝B2-20050021-1 渝公网安备 50019002500403号 违法和不良信息举报中心

互联网出版许可证 新出网证(渝)字10号 全国400电话 - 免长途话费