首页> 中文会议>2007年全国高性能计算学术年会 >基于Lustre文件系统的MPI检查点系统实现技术与性能测试

基于Lustre文件系统的MPI检查点系统实现技术与性能测试

摘要

基于协同式检查点的回卷恢复是在大规模并行计算机系统中得到采用的一项重要容错技术,其性能开销主要为协同协议和检查点映像存储所决定。描述了一个在MPICH2中实现的应用透明的并行检查点系统,相比已有的技术,该系统有以下特点:(1)协同协议操作利用了并行应用的近邻通讯特性,通过虚连接方法减少协议的处理开销;(2)采用Lustre文件系统简化检查点映像文件管理的复杂性;(3)通过并行I/O操作提高性能,优化检查点映像的存储过程。实际应用的测试表明,该检查点系统具有较小的运行时间开销和良好的可扩展性。

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号