Cуперкомпьютеры: администрирование - страница 23

Шрифт
Интервал


, в которых жёстко прописана длина MAC-адреса Ethernet в 6 байт, не могут корректно работать и отображать адреса канального уровня для IPoIB. Утилита >ip, рекомендуемая для замены >ifconfig, такого недостатка лишена. В адресе канального уровня содержится GID порта, номер пары очередей (Queue Pair Number, QPN, аналог номера порта в TCP для InfiniBand) и флаги, указывающие, какие протоколы транспортного уровня InfiniBand могут использоваться для передачи IP.

Утилиты для просмотра информации по сетям InfiniBand

В этом разделе мы приводим примеры выдачи некоторых утилит из комплекта OFED с объяснениями выдаваемой информации. Эти данные помогут сориентироваться в том, что происходит в сети InfiniBand, и диагностировать некоторые ошибки в её работе.

Команда >ibstat показывает состояние всех портов на всех адаптерах InfiniBand, установленных на узле, где она запущена



Сначала выводится информация по адаптеру: его имя (>mlx5_0), тип адаптера (название модели), количество портов, версии встроенного программного (firmware) и аппаратного обеспечения, а также идентификаторы Node GUID и System Image GUID.

Для каждого порта в строке >Link layer выводится тип подключения: InfiiniBand или Ethernet. Некоторые адаптеры InfiniBand позволяют подключаться как к сети InfiniBand, так и к Ethernet. Тип подключения определяется установленным трансивером. Строка >Port GUID показывает GUID порта. >Base lid – первый LID, присвоенный данному порту. Всего порту присвоено, как говорилось выше, 2LMC подряд идущих LID. >SM lid – LID порта, на котором работает менеджер данной подсети. Rate – скорость передачи данных, на которой работает порт (56 в данном случае – это режим 4x FDR).

>Physical state – состояние физического уровня передачи данных. Нормальное состояние – >LinkUp. Также может быть >Disabled, >Polling (в это состояние порт переходит после включения), >Configuration (согласование режимов работы с другой стороной связи), >Recovery (восстановление после сбоя связи). Есть и другие состояния, но их появление означает серьёзный сбой в работе оборудования, и мы их здесь описывать не будем.

>State – состояние канального уровня передачи данных. >Active – состояние нормального функционирования, возможна передача любых типов данных. >Down – передача данных невозможна (физический уровень ещё не перешёл в состояние