HP DL380

From
Serguei Revtov (2:5021/49.1)
To
All
Date
2006-12-11T16:07:40Z
Area
RU.UNIX.SOLARIS
Hi All!

Взгромоздил Solaris 10 6/06 на HP Proliant DL380 (2xXeon 2.8, Smart Array 6i + Smart Array 641). Накатил рекомендованный кластер с сентябрьского двд.

Через SA641 прицепил один конец дискового массива Smart Array 30, второй, пока незадействованный конец повесил на внешний порт 6i. Дрова к контроллерам - 1.60. Сеть определилась сама.

Собрал на 7x146GB дисках RAID5 том, сделал там обычный ufs. Файлы раздаются по самбе и нфс. Вроде работает, однако есть несколько неожиданностей:


1. psrinfo откуда-то показывает 8 процессоров:

0       on-line   since 12/06/2006 14:19:30
1       on-line   since 12/06/2006 14:19:39
2       on-line   since 12/06/2006 14:19:41
3       on-line   since 12/06/2006 14:19:43
4       on-line   since 12/06/2006 14:19:45
5       on-line   since 12/06/2006 14:19:47
6       on-line   since 12/06/2006 14:19:49
7       on-line   since 12/06/2006 14:19:51

Откуда их столько? Должно быть 4. Это фича или бага?


2. Иногда подтормаживает файловый сервис... Вот из логов другой машинки:

Dec  9 05:51:59 client unix: NFS server xxx not responding still trying
Dec  9 05:52:01 client unix: NFS server xxx ok
Dec  9 21:04:21 client unix: NFS server xxx not responding still trying
Dec  9 21:04:24 client unix: NFS server xxx ok
Dec 10 06:35:49 client unix: NFS server xxx not responding still trying
Dec 10 06:35:56 client unix: NFS server xxx ok
Dec 11 03:54:05 client unix: NFS server xxx not responding still trying
Dec 11 03:54:14 client unix: NFS server xxx ok
Dec 11 11:29:43 client unix: NFS readdir+ failed for server xxx: error 2 (RPC: Can't decode result)
Dec 11 11:29:43 client unix: NFS readdir+ failed for server xxx: error 2 (RPC: Can't decode result)
Dec 11 11:29:43 client unix: NFS lookup failed for server xxx: error 2 (RPC: Can't decode result)
Dec 11 11:34:27 client last message repeated 11 times
Dec 11 12:28:03 client unix: NFS server xxx not responding still trying
Dec 11 12:28:03 client unix: NFS server xxx not responding still trying
Dec 11 12:28:07 client unix: NFS server xxx ok
Dec 11 12:28:10 client unix: NFS server xxx ok

Причем если то, что было 11го после 11, происходило под более-менее нормальной нагрузкой, то все остальное было просто без нагрузки... Может по крону что и выполнялось, но несущественное. С чего бы оно так чудит?



3. Dec 11 03:54:10 В messages появилось вот такие сообщения:

cpqary3: [ID 702911 kern.warning] WARNING:
Smart Array 641 Controller
cpqary3: [ID 103154 kern.warning] WARNING: Bus = 10 : Device = 1 : Function = 0
cpqary3: [ID 404339 kern.notice]  Event Occured on ......... 12/11/2006
cpqary3: [ID 678209 kern.notice]  Event Time................ 04:10:23
cpqary3: [ID 269178 kern.notice]  Description............... SCSI bus speed downshifted, SCSI port 1

Вполне возможно, что причина - не самый крутой scsi кабель от SA641 до планки на задней стенке сервера (сам контроллер не имеет внешнего разъема). Запустился какой-нибудь nfsfind.

Нельзя ли чем-либо помониторить дисковый массив? Типа HP Systems Insight Manager. Насколько не удалось ничего найти, его под солярку не существует? Может альтернатива есть?




TIA,
-- Serguei
   2:5021/11.10 || 2:5021/49.1

--- GoldED+/W32-MSVC 1.1.5-snapshot Sep 11 2005
 * Origin: Welcome to ru.unix.solaris (2:5021/49.1)
SEEN-BY: 450/1024 5000/5000 5011/13 5012/46 5015/28 5020/400 545 2238 4441
SEEN-BY: 5021/2 19 29 49 5025/3 5030/1957 5035/38 5045/7 5054/1 4 8 9 28 35 37
SEEN-BY: 5062/10 5064/7 5080/1003 5085/13 5095/20 5096/18
PATH: 5021/49 19 29 5020/545 5054/1 37