Показаны сообщения с ярлыком IBM. Показать все сообщения
Показаны сообщения с ярлыком IBM. Показать все сообщения

четверг, 15 ноября 2012 г.

Storwize V7000. Сервисные заметки

Сервисные операции можно выполнить зайдя браузером по адресам контроллеров
https://node SA IP/service (по умолчанию адреса напоминаю - 192.168.70.121 и 122).

Зайти можно только пользователем superuser (passw0rd по умолчанию)

Так же можно зайти и через CLI. Сервисные команды из групп sainfo и satask.

Так же можно через флешку сделать некоторые вещи как то сбросить пароли, сменить сервисные адреса.

При инициализации можно включить режим Call Home. Этот режим повышает уровень поддержки или менять его. Всего 4-е уровня - локальный, Европа, США, разработчики.
По умолчанию многие не делают этого и далее все по накатанной - звонок в Москву, если там не решают - передают проблему дальше. Когда Call Home включен, то проблема передаётся на все 4-е уровня сразу и тот кто первый ответит тот и будет решать.
При включеном Call Home и необходимости поиграть и потестить и что бы не напрягать людей в поддержке, то надо включить режим сервиса:
svctask chiogrp -maintenance yes
пока этот режим включен, в поддержку ничего не отправляется.

Журнал ошибок хранится на массиве но может так же копироваться на syslog сервер удаленный. Журнал хранится пока не разрушен кластер.

Если в Events есть проблема, можно выполнить процедуру  Run Fix Procedure. Если проблему не решить в течении 25-ти часов, то у нее меняется приоритет.

Журналы событий можно скачать с массива (Settings -> Support).
Журнал аудита ведется с начала создания кластера! И ведется с записью всех команд группы svctask.

Обновление прошивки. По соглашению с ИБМ что выдается при первой инсталляции, говорится что заказчик должен поддерживать актуальное состояние прошивки.  Но будьте бдительны. При выходе новой версии прошивки, качаем Release Notes, читаем что поправили и если не критично - не обновляемся. Ждем следующую.

Если требуется обновить прошивки дисков..... Да уж... КАЖДЫЙ ДИСК ОБНОВЛЯЕТСЯ в РУЧНУЮ и ПО ОЧЕРЕДИ!

ВНИМАНИЕ, прошивка SSD всегда переводит его в OFFLINE! Обновление HDD в OnLine.

Прошивку ставим через прогон Upgrade test utility.
Обновление прошивки идет около 20 минут. Для одной ноды. Далее идет ожидание перехода томов и отработки мультипасинг-драйверов - 30 минут. И только потом обновляется вторая нода - еще 20 минут.

Во время операции обновления не работают сервисы копирования (нельзя новые запустить), те операции что были в работе - продолжают работу.

Если в кластере 4 узла (две io_group), обновление будет производиться так - первой node2 в группе 0 (20 минут), далее - node3 в группе 1 (20 минут), 10 минут пауза, далее node1 из группы 0 (20 минут) и в этот момент node2 стала Configuration Node, далее node4 группы 1 (20 минут).

Откат на предыдущую прошивку осуществляется либо автоматом при ошибке, либо в ручную. Время на откат такое же как на обновление.

  Обновление прошивки дисков:
- не должно быть алертов, снижаем нагрузку на диски.
Время на обновление диска - 15... 20 секунд.
Использовать пока только CLI.

Резервное копирование конфигурации массива.
svcconfig backup

На самом деле в 01:00 каждый день массив сам делает это.
В бэкап входит три файла. Именно они и нужны будут для восстановления если что.
Это файл xml, sh, log.




Storwize V7000. Easy Tier. Заметки

Easy Tear (далее EA) включена в базу массива.

EA собирает статистику в течении 24 часов каждые пять минут. Далее формируется список Top Extents по условиям - IO запросы не более 64 КБ и эти запрос только на чтение!

Далее происходит миграция (перенос) Extents из списка, который был составлен на базе собранной статистики, но не более 2ТБ в 24 часа. Далее собранная за следующие 24 часа статистика накладывается и совмещается с предыдущей и происходит вновь перемещение горячих Extents на SSD, но заметим, что не происходит обратного перемещения с SSD на HDD без необходимости. То есть если Extent перемещен был когда то по статистике на SSD, то он там и останется пока не потребуется освободить место на SSD, и если этот Extent не находится в новом совмещенном TOP Extents списке. Это значит, что за выходные (когда например нет ввода-вывода), в понедельник не будет торможения, ибо не будет принудительного перемещения на HDD.
Еще раз обращаю внимание на то, что приложения с блоком ввода-вывода более 64 КБ не будут участвовать в EA.

Для дисков Thin Provision в EA будут участвовать только заполненные Extents.

EA может быть включено как для Storage Pool так и для каждого тома. Причем, если SSD дисков нет вообще и включим EA (определенным образом) то можно включить режим сбора статистики. А после сбора статистики используя инструмент STAT (Storage Tier Advisor Tool) - бесплатно с сайта ИБМ под Windows можно получить отчет о том приросте производительности, который даст покупка SSD. Файл статистики после начала сбора, находится в /dump/dpa_heat/. Его надо забрать и скормить STAT-у.





среда, 14 ноября 2012 г.

Storwize V7000. Виртуализация внешних систем хранения

Для памяти и пояснений - будем внимательны при работе со StorWize V7000 и виртуализации внешних систем через него.

Во-первых, на внешней системе надо сделать правильные настройки по предоставлению томов нашему StorWize. StorWize выступает как хост в этом случае.

Далее, конечно проверяем зонирование...

Далее на сторвайзе надо провести операцию Detect MDisks. Это позволит найти наши тома с внешней системы. Будут созданы объекты MDisk Unmanage. На этих объектах давим правой кнопкой мышки и говорим - Import! НО!

Прежде чем это сделать подумайте вот над чем. IMPORT делает исключительно ПЕРЕНОС данных в другой пул (обычно на внутренние диски сторвайза). Это маркетинговое ограничение GUI интерфейса. Запускается операция миграции как она делается обычно - блоками по 16 МБ (блокируя на время операции и чтение и запись, изменения копятся в кэше и после переноса блока 16МБ в новое место, накатывается блок измененных данных на перенесенный в новое место блок данных а старый блок помечается как пустой).

Дак вот что бы сделать тома с внешней дисковой системы доступными и рабочими на той же внешней системе с сохранением данных но управлять и иметь доступ к этим данным через сторвайз, надо использовать CLI!!!!

Команда mkvdisk с параметром -vtype image - это и есть условие создания такой конфигурации.

ЛИБО вариант два - используем Migration Wizard (Pools -> System Migration -> Start New Migration)

В этом мастере мы можем сделать в автомате обнаружение внешних (подготовленых заранее томов). Этот мастер дает гораздо больше возможностей. А именно, может делать миграцию множества томов. А так же дает возможность выбрать какому хосту отдать мигрированые тома, выбрать пул, куда мигрировать И будет запущено зеркалирование томов а не перенос данных! И кстати будет по окончании операции копирования возможность удалить старые тома или оставить же их в покое.

Export Wizard - это операция обратная - когда нужно со сторвайза данные слить на внешнюю систему. Тут делается изменение представления тома из формата сторвайза (который базируется на Extents) в последовательный блочный вариант. Mdisk после завершения будет типа Image. Это на этом MDisk был том, то в конце операции удаляем это том - это не удаляет данные а удаляет только ссылку на данные. Далее просто мы делаем мапинг уже нового местоположения данных.







понедельник, 30 июля 2012 г.

IBM Storwize. Заметки

IP адреса на сервисных портах по умолчанию: 192.168.70.121 и 122 /24
User: superuser, password: passw0rd

Документация для старта: http://pic.dhe.ibm.com/infocenter/storwize/ic/index.jsp

В комплекте с железкой идет флешка. На ней два файла InitTool.exe и autorun.inf.
Флешку втыкаем в ноут, запускаем InitTool. Оно запросит IP адрес (я вводил сервисные умолчательные). Давим Finish. Был создан текстовый файл satask.txt. В нем одна строка с адресом, шлюзом и маской. Далее вставляем флешку в USB порт на массиве (любой из 4-х сзади). Начинает моргать оранжевый индикатор со знаком !

При инициализации лучше выбрать тип системы Unified, ибо если сделать только блочную инициализацию а потом когда захочется использовать файловый функционал, то придётся разрушать кластер и создавать его заново.


Удалить кластерную конфигурацию можно только переведя канистры в сервисный режим. Более того , надо удалить имя старого кластера (Configure Enclosure).

45 дней дается на демо и нигде не проверяется. Этим можно пользоваться без завода ключей. Но при заводе заявки в сервис это будет выяснено.

Лицензирование делается по количеству полок. External Virtualization - это количество полок на внешних массивах. Именно полок.

Для мультипассинга под винды и аикс - нужно ставить драйверы SDD.
Для остальных ОС работают родные.

На каждом диске резервируется 512 МБ кусок при инициализации для нужд кворума. Для кворум предпочтение отдается дискам Spare. Но место резервируется на всех дисках. 

io_group - группа из двух головных устройств - то есть два контроллера, что входят в состав массива.

Система не является Active-Active. Драйвер мультипасинга работает по алгоритму round-robin. И это накладывает следующее разумное объяснение - минимум ДВА FC порта с КАЖДОГО контроллера должно быть подключено.
То есть именно по этим двум путям к одному контроллеру и будет отработан round-robin а ни как на оба контроллера.

Надо понять так же систему распределения нагрузки по дискам. Помним, что есть верхняя сущность - VDISK (Volume), которая суть набор неких Extents. Каждый Extent это ссылка на Mdisk (хоть внешний хоть внутренний). Размер Extent-а от 16 МБ до 8 ГБ. По сути это определяет объем который может быть доступен для управления массивом. Это зашито в прошивке - 4 млн extents на систему. Механизм отработки понятен - блок данных пришел в массив, собрался в кэше (может быть), и далее будет записан в текущий Extent (пока не заполнится) со страйпом на Mdisk (а страйп у нас по умолчанию 256 Кб и есть еще второй вариант - 128 Кб и все). Если VDisk сделан на базе Storage Pool, в который входят несколько Mdisk , то extent будет записываться на один MDisk пока не заполнится, после чего переключится на следующий Mdisk. 

Storage Pool по умолчанию собирается в режиме страйпа.

ЦПУ в массиве 4-х ядерные, и оптимально нагружать в 4 потока. 1 поток обрабатывается одним ядром. 

Кэш тут работает по "честному" - всем поровну. Кусок кэша выделяется каждому Storage Pool. Не регулируется. На контроллере 8 ГБ кэша, в сумме 16 ГБ, зеркалируется только кэш на запись. Кэш так же используется и для хранения сумм CRC для рейдов (если используются).
Кэш на запись и чтение не могут быть выключены. При создании нового пула, кэш тут же распределится в пропорциях , особенно забавно что для продакшн системы (если она была до этого) мы уменьшим размер кэша при этом.

Статья по производительности от одного из разработчиков - ТУТ.


iSCSI крайне ограничен. Не поддерживаются VLAN, нет бондов и порт 1Гб...
Надо глянуть нет ли расширения iSCSI в версии Unified. Репликации нет по iSCSI, Volume Mirror - нет.

В одну систему можно добавить в сумме 10 полок (одна из них это голова).
Причем из-за особенностей строения SAS на первую цепь - 5 полок, на вторую - 4.






среда, 16 ноября 2011 г.

IBM WPAR

Что такое LPAR понятно многим, кто работает с Power systems.
Пару слов о том что такое WPAR. Для тех кто знает что есть виртуализация, скажу сразу - аналоги у других - Solaris zones, HP vPAR, VmWare player...
Workload PARtition. Работает на базе AIX 6.1. Любой Power CPU. Не требует дополнительных лицензий.
Версия AIX внутри WPAR будет всегда такая как в глобальной. За одним исключением - при AIX 7.1 можно сделать WPAR с версией 5.2!

Есть графика управления - WPAR Manager
WPAR можно мигрировать без остановки.

AIX, Power Systems and AME

Есть в AIX инструмент - amepat. Запускаем его на пару часов и получаем отчет об использовании ресурсов цпу и памяти и в конце еще отчет-оценка использования AME и расчетные варианты фактором сжатия и полученый буст. Можно также поиграть параметрами, указывая какие параметры фактора попробовать и что получим. Дак вот прежде чем решить купить или не купить AME - active memory expansion - попробуйте оценить её эффективность. Стоит ключик довольно не мало.
Штука конечно хорошая, но применение должно быть обосновано! Не верьте выводу amepat на слово.

Помочь AME может в некоторых случаях.
1. Когда у вас уже все слоты памяти заняты и докупить память означает только заменить её.
2. 60 дней на пробу - используйте и пробуйте прежде чем купить
3. Тестовые серверы где производительность не так важна но память важна.

AME - компрессия памяти для Power 7 с AIX 6.1.  Вместо свопирования при дефиците памяти  можно попробовать AME. PowerVM не требуется. AME - это отдельный ключ.

вторник, 27 июля 2010 г.

IBM x3650M2 + DS3400... Hard disk 0 boot failed

С подачи и расследования Евгения Раздобарова.

Итак, имеется сервер IBM x3650M2 с установленной операционной системой, которая загружается с внутренних дисков сервера. Далее, к серверу с помощью адаптеров Qlogic 4GB FC подсоединяем массив DS3400. Перегружаем сервер и видим сообщение “Hard Disk 0 boot failed”, т.е. сервер отказывается грузится со своего внутреннего диска. BIOS адаптеров FC при этом, что интересно, отключен. Отсоединяем оптические кабели от FC адаптеров и сервер снова нормально грузится, подсоединяем – опять не грузится…
Лечится следующим образом:
-перегружаем сервер и заходим в UEFI BIOS
- выбираем пункт “Boot Manager” далее “Add boot option”.
- из всего многообразия устройств выбираем “Legacy only”, не забываем сделать “Commit changes
- возвращаемся в “Boot manager”, выбираем “Change boot order” и на первое место передвигаем “Legacy only”, подтверждаем выбор – “Commit changes
- выключаем сервер, подсоединяем оптические кабели от массива и нормально грузимся с внутренних жестких дисков сервера!

четверг, 27 мая 2010 г.

IBM p550 AIX 5.3 в связке с Sun STK 6140

Для рабочей связке потребовался RDAC драйвер от SUN. Он вот здесь

Устанавливаем драйвер только после прочтения документа, что скачиваем по той же ссылке. Обратить внимание на то, что нужно вынести драйвер DPF если он там был.

На массиве делаем инициаторов и хост по типу AIX_FO.

Делаем том и отдаем AIX.
После установки драйвера получим набор интсрументов в /usr/lpp/sundac.
Не забыв запустить cfgmgr сначала, смотрим что есть. По идее, есть dar - массив и dac0,dac1 - адаптеры. Перед тем как создать дисковую группу в AIX с томом с массива, запустить сценарий /usr/lpp/sundac/setSUNdac. А именно он установит глубину очереди в 32 вместо 10.

среда, 18 февраля 2009 г.

IBM: обращение в сервис центр

Звонить: 495 - 755-88-00. Соединить с сервисным центром. Описать проблему. Для этого нужно иметь под рукой серийный номер и номер модели (на передней панели сервера).
Для снятия журналов для службы поддержки из AIX:
#snap -r
#snap -gc

и отправить по адресу ibmservice@ru.ibm.com
В теме указать номер заявки.