近日,纽约州立大学布法罗分校的生物信息卓越研究中心(Center of Excellence in Bioinformatics)宣布采用IBM提供的超级计算机系统,以提升科研计算能力。该系统由266片BladeCenter HS20刀片服务器集群和7台x345服务器组成,运行Red Hat Linux 9.0操作系统,最高性能达到每秒1.32万亿次浮点运算,显著提高了科学家们的研究效率。通过易于使用的系统管理工具,新系统减少了系统宕机时间,降低了IT管理成本,并改善了资源分配。
该研究中心主要致力于在分子水平上进行生物数据建模的高性能计算,涉及基因组、蛋白质、生物成像和药物科学等领域。中心管理层希望提高计算速度、增加存储容量并提升系统可靠性,同时寻求高性价比的超级计算解决方案,并要求供应商在提供优异支持和可靠系统集成方面拥有良好声誉。
中心主任Jeffrey Skolnick教授及其评估团队向8家供应商征求方案,包括IBM、Sun、Dell和HP。尽管预算有限,但中心不仅关注成本,还重视可靠性和供应商的响应速度。Skolnick教授解释说:“我们需要一家能够负责修复任何集群故障的供应商。IBM为我们提供了单点联络并实现了他们的承诺。”经过广泛的基准测试和评估,中心最终选择了IBM的方案,由266个BladeCenter HS20存储服务器组成集群,运行Red Hat Linux操作系统。该方案在测试期间的完美运行是IBM脱颖而出的主要原因。IBM在3周内安装并投入运行了一个测试系统,包括7台x系列345服务器,连接到5TB的存储系统,由通用并行文件系统和Extreme集群管理工具箱(xCAT)系统管理软件支持。
新的IBM超级计算机集群的最高性能超过每秒1.32万亿次浮点运算,能够可靠地处理中心内部开发的各种应用和密集计算。新系统速度远超原有系统。Skolnick教授表示:“IBM的超级计算机提供了我们大幅改进蛋白质结构和功能预测研究所需要的性能。可管理性的显著提高和基础设施的简化允许我们将工作重点放在寻找致命疾病的病因和开发治疗这些疾病的新药物上。”
自部署以来,中心系统的故障次数显著减少,使科学家们能够进行更多的计算和可视化建模。此外,IBM超级计算机还简化了IT支持工作。以前,当硬盘驱动器发生故障时,中心需要检查大量机架上的红灯指示,或将监视器插入到2000个节点中逐一诊断,这是一项令人沮丧且费时的任务。利用内置的BladeCenter管理工具,IT人员可以使用系统软件诊断故障并对集群进行远程管理,从而减少宕机时间并提高IT效率。Skolnick教授表示:“由于集群更多时间可以正常运行,科学家们在同样的时间内可以完成更多的科研任务。”
IBM BladeCenter集群所消耗的能源和散热大大少于以前的系统,帮助中心降低了运营成本。在占地空间受限的情况下,刀片配置允许在同样大小的区域内部署更多服务器,同时简化系统配置并预留增长空间。Skolnick教授总结道:“目前看来,我希望我们不久将会再次进行扩展,我断定我们将会继续采用BladeCenter系统来进行扩展。”