Параллельные вычисления на кластерах
Книга посвящена практическим вопросам построения и эксплуатации вычислительных кластеров. Материал охватывает широкий спектр тем — от выбора аппаратного обеспечения и организации электропитания до настройки системного программного обеспечения и запуска параллельных приложений.
Значительное внимание уделено вопросам надёжности и отказоустойчивости: источникам бесперебойного питания (UPS), резервированию, мониторингу состояния узлов и диагностике неисправностей. Рассматриваются особенности работы с операционными системами UNIX, Linux и Windows в контексте кластерных решений.
Отдельные разделы посвящены средствам параллельного программирования, в частности библиотеке MPI, а также тестированию производительности с помощью High Performance LINPACK и системы Cleo. Приводятся практические рекомендации по развёртыванию и сопровождению кластеров.
Книга ориентирована на системных администраторов, инженеров и специалистов, занимающихся построением и обслуживанием высокопроизводительных вычислительных систем. Материал сопровождается примерами и ссылками на интернет-ресурсы, включая сайт ClusterBook.Parallel.ru.
