Bienvenidos

Todos estos pasos descriptos fueron probados en ambientes productivos

martes, 26 de junio de 2012

Send mondo Timeout o problema de Hardware y/o Software



Problema de Hardware o Software ? leer todo

Send mondo timeout panic
El equipo, genero un panic y switcheo al otro nodo del cluster, aparentemente seria por hardware, esta es la salida fmdump



Jun 13 07:51:24 sol5002 fmd: [ID 441519 daemon.error] SUNW-MSG-ID: FMD-8000-2K, TYPE: Defect, VER: 1, SEVERITY: Minor
Jun 13 07:51:24 sol5002 EVENT-TIME: Wed Jun 13 07:51:24 ART 2012
Jun 13 07:51:24 sol5002 PLATFORM: SUNW,Sun-Fire-15000, CSN: -, HOSTNAME: sol5002
Jun 13 07:51:24 sol5002 SOURCE: fmd-self-diagnosis, REV: 1.0
Jun 13 07:51:24 sol5002 EVENT-ID: 2ad4ec18-b1a4-eca0-a67d-a268a7af7071
Jun 13 07:51:24 sol5002 DESC: A Solaris Fault Manager component has experienced an error that required the module to be disabled. Refer to http://sun.com/msg/FMD-8000-2K for more information.
Jun 13 07:51:24 sol5002 AUTO-RESPONSE: The module has been disabled. Events destined for the module will be saved for manual diagnosis.
Jun 13 07:51:24 sol5002 IMPACT: Automated diagnosis and response for subsequent events associated with this module will not occur.

Envie un explorer del equipo y explorer de la SC para que lo analizaran en Oracle.
Lo que vi, fue que la falla estaria en el dimm de memoria J16301 . de la SB1,P3,B1
Lo primero que vieron en el analisis del explorer fue lo siguiente :

*///Salida del FMA confirma evento de hardware.
::::::::::::::
fmadm-faulty.out
::::::::::::::
STATE RESOURCE / UUID
-------- ----------------------------------------------------------------------
faulted fmd:///module/cpumem-diagnosis
2ad4ec18-b1a4-eca0-a67d-a268a7af7071

*///La probalidad de falla es del 100% en memoria RAM, pero no apunta a un FRU especfico.
fmdump-vu_2ad4ec18-b1a4-eca0-a67d-a268a7af7071.out
::::::::::::::
TIME UUID SUNW-MSG-ID
Jun 13 07:51:24.7743 2ad4ec18-b1a4-eca0-a67d-a268a7af7071 FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -

*///Numero alto de errores en DIMM
fmdump-e.out
::::::::::::::
TIME CLASS
Jun 13 03:09:59.7741 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7740 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7736 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7733 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7731 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7730 ereport.cpu.ultraSPARC-IVplus.ce
Jun 13 03:09:59.7730 ereport.cpu.ultraSPARC-IVplus.ce

*///Ubicando el origen exacto de la falla, multiples dimms en SB1 involucrados.
fmdump-eV.out |grep unum|more
unum = SB1/P2/B1/D0 J15301
unum = SB1/P1/B1/D0 J14301
unum = SB1/P2/B0/D0 J15300
unum = SB1/P3/B0/D0 J16300
unum = SB1/P3/B1/D0 J16301
unum = SB1/P0/B0/D0 J13300
unum = SB1/P1/B0/D0 J14300
unum = SB1/P0/B1/D0 J13301
unum = SB1/P2/B0/D0 J15300
unum = SB1/P0/B0/D0 J13300
unum = SB1/P0/B1/D0 J13301



1er conclusion

Luego, del analisis del ingeniero del caso, realizado al explorer de la System controller, nos indica que hay muchos RSTOPS reportados, comenzaron en Junio 10, apuntando a DIMMs de SB1/P1

Jun 10 12:14:13 2012 e25k-5-sc0 ssd[1091]: [1319 7280716936303484 NOTICE StartupManager.cc 2602] efhd output: ECC correctable errors detected from Processor Port SB1/P1, no
Jun 10 12:14:13 2012 e25k-5-sc0 ssd[1091]: [1319 7280716944070151 NOTICE StartupManager.cc 2602] efhd output: corresponding parity error in DXs or DCDSs.
Jun 10 12:14:13 2012 e25k-5-sc0 ssd[1091]: [1319 7280716944567150 NOTICE StartupManager.cc 2602] efhd output: Assuming the error originated in memory on this port.
Jun 10 12:14:13 2012 e25k-5-sc0 ssd[1091]: [1319 7280716944976756 NOTICE StartupManager.cc 2602] efhd output: Data syndrome 049 is CE bit 49.
Jun 10 12:14:13 2012 e25k-5-sc0 ssd[1091]: [1319 7280716945364851 NOTICE StartupManager.cc 2602] efhd output: This bit is in one of Dimm SB1/P1/B0/D0 or Dimm SB1/P1/B1/D0.

Jun 10 12:15:24 2012 e25k-5-sc0 dsmd[27493]: [2517 7280787849650558 WARNING Domain.cc 591] Record stop has been detected in domain B.
Jun 10 12:16:14 2012 e25k-5-sc0 dsmd[27493]: [2517 7280837789222307 WARNING Domain.cc 591] Record stop has been detected in domain B.
Jun 10 12:16:46 2012 e25k-5-sc0 dsmd[27493]: [2517 7280869346469788 WARNING Domain.cc 591] Record stop has been detected in domain B.
Jun 10 12:17:02 2012 e25k-5-sc0 dsmd[27493]: [2517 7280886045362988 WARNING Domain.cc 591] Record stop has been detected in domain B.

El 12 de Junio, mas rstops, esta vez sobre DIMMs de SB1/P2

Jun 12 19:37:13 2012 e25k-5-sc0 ssd[1091]: [1319 7480096796647204 NOTICE StartupManager.cc 2602] efhd output: This bit is in one of Dimm SB1/P2/B0/D0 or Dimm SB1/P2/B1/D0.
Jun 12 19:37:13 2012 e25k-5-sc0 ssd[1091]: [1319 7480096797043039 NOTICE StartupManager.cc 2602] efhd output: Bank/Dimm fault attribution for data CEs is the responsibility of
Jun 12 19:37:13 2012 e25k-5-sc0 ssd[1091]: [1319 7480096797435634 NOTICE StartupManager.cc 2602] efhd output: lpost or domain software which has address information that
Jun 12 19:37:13 2012 e25k-5-sc0 ssd[1091]: [1319 7480096797824449 NOTICE StartupManager.cc 2602] efhd output: allows error attribution to a bank. No action taken here.
NW,UltraSPARC-IV+:send_one_mondo+160 (24, 24, 995c5647, 1, 18b1448, 1)


*///Finalmente viene el panic en el dominio en Junio 13.

Jun 13 06:39:34 sol5002 ^Mpanic[cpu35]/thread=2a100a77cc0:
Jun 13 06:39:34 sol5002 unix: [ID 862289 kern.notice] send mondo timeout (target 0x24) [1470496 NACK 0 BUSY]
Jun 13 06:39:34 sol5002 unix: [ID 100000 kern.notice]
*////El rstop mas cercano a esa hora, es este. Donde se reporta falla en los procesadores P2 y P1. de la SB1.-------------------------------------------------------------------
desde la SC, dentro de /var/opt/SUNWMS/adm/B/dump , podemos ver el log de los record stop
redxl> dumpf load dsmd.rstop.120613.0647.41
Created Wed Jun 13 06:47:41 2012
By hpost v. 1.6 Generic 124319-04 Oct 12 2007 11:30:48 executing as pid=20198
On ssc name: e25k-5-sc0.
Primary service FRU is Slot SB1.

redxl> wfail -B
port SB1/P2 # redx wfail of dump 120613.0447.41
port SB1/P3 # redx wfail of dump 120613.0447.41


CONCLUSION de los ingenieros de Oracle
==============================
Panic producido por falla de hardware en SB1.
PLAN de ACCION
===========

Reemplazo de SB1
540-6753
540-6753 [F] CPU/Memory Uniboard w/4× US IV+ 1.8GHz, 0MB
Se recomienda altamente actualizar los patches de kernel para un mejor control de estos eventos.
Referencia:
Systems With UltraSPARC IV+ Processors Running Solaris 9 or 10 May Experience "send mondo timeout" Panic (Doc ID 1019109.1)

Eso hicimos, instalamos los parches recomendados , pero …....
Luego de reemplazar la System Board, y memoria
El equipo levanto.
Luego del boot, se chequeo los eventos fma y vimos esta condicion

 fmd:///module/cpumem-diagnosis degraded, se le hizo un fmadm repair y lo reparo.
el fmdump muestra eventos anteriores sobre el mismo modulo.

Envio el explorer y la contestacion fue :
Hemos revisado la información del explorer del dominio , luego del cambio de la SB1.

//La salida del comando 'fmadm faulty" no muestra enventos.
::::::::::::::
fmadm-faulty.out
::::::::::::::
STATE RESOURCE / UUID
-------- ----------------------------------------------------------------------
//La salida del comando "fmadm faulty -a" siempre mostrara los eventos anteriores. Estos ya no requieren ninguna accion.
:::::::::::::
fmadm-faulty-a.out
::::::::::::::
STATE RESOURCE / UUID
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e70d5a
ff12f344-8d86-eac6-832b-92ac8e1063eb
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e712fa
7ea9887b-6631-4a28-806e-d74a61cd4733
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e7368e
44d9d55f-8277-cdeb-f205-8ca3a2d52ab6
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P1/B0/D0,J14300/offset=227500dc
d100412a-3592-493e-95f1-d460a157e15b
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P1/B0/D0,J14300/offset=4657339a
//El FMA (fmdump -e ) reporta eventos nuevamente  uhhhh
Jun 13 17:30:30.2977 ereport.cpu.ultraSPARC-IVplus.ivc
Jun 13 17:30:30.293 ereport.cpu.ultraSPARC-IVplus.ivc
Jun 13 17:30:30.3054 ereport.cpu.ultraSPARC-IVplus.ivc
Jun 13 17:30:30.3113 ereport.cpu.ultraSPARC-IVplus.ce

*///Estos son los DIMMS involucrados.

unum = SB1/P3/B0/D0 J16300
unum = SB1/P2/B0/D0 J15300
unum = SB1/P1/B1/D0 J14301
unum = SB1/P3/B1/D0 J16301

Me pidieron otro explorer del equipo y de la System Controller
Envie un explorer de la sc y me contestaron :

// El ultimo rstop registrado en el equipo, se presento el dia de hoy, 13 de Junio, a las 15:01 horas.
-rw-r--r-- 1 sctools other 2288 Jun 13 15:00 wfailoutput.120613.1659.57
-rw-r--r-- 1 sctools other 1934 Jun 13 15:00 wfailoutput.120613.1700.32
-rw-r--r-- 1 sctools other 2288 Jun 13 15:01 wfailoutput.120613.1701.16 
 El ultimo POST registrado en el equipo, nos indica a que hora fue remplazada la system board y la ultima vez en que el dominio fue encendido.
///
Los logs nos dan la misma fecha: 13 de Junio a las 15:01
horas:-rw-r--r-- 1 sctools other 1035 Jun 13 15:00 post120613.1700.10.log
-rw-r--r--
1 sctools other 924 Jun 13 15:00 post120613.1700.33.log
-rw-r--r--
1 sctools other 1035 Jun 13 15:00 post120613.1700.52.log
-rw-r--r--
1 sctools other 924 Jun 13 15:01 post120613.1701.16.log
-rw-r--r--
1 sctools other 1035 Jun 13 15:01 post120613.1701.27.log <----


///
Esta es la hora en la que se capturo el explorer de la SC:
=========== SUN(TM) EXPLORER DATA COLLECTOR (Version 5.10) =======
== Esto indica que desde las 15:01, hora en que se levanto por ultima vez el dominio, hasta las 20:42, hora en que se recolecto el explorer, no se han presentado nuevos record stops.


REVISANDO EL EXPLORER DEL DOMINIO
=================================
/ El fma faulty no muestra errores:
$ more fmadm-faulty.ou
STATE RESOURCE / UUID
-------- ----------------------------------------------------------------------

/// El fmadm faulty -i tampoco aparecen errores:
$ more fmadm-faulty-i.out
STATE RESOURCE / CACHE-ID
-------- ----------------------------------------------------------------------

// Es en el fmdump -a donde aparecen errores de memoria, pero no se muestra la fecha de origen de dichos eventos:
ATE RESOURCE / UUID
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e70d5a
ff12f344-8d86-eac6-832b-92ac8e1063eb
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e712fa
7ea9887b-6631-4a28-806e-d74a61cd4733
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P0/B1/D0,J13301/offset=22e7368e
44d9d55f-8277-cdeb-f205-8ca3a2d52ab6
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P1/B0/D0,J14300/offset=227500dc
d100412a-3592-493e-95f1-d460a157e15b
-------- ----------------------------------------------------------------------
faulted mem:///unum=SB1/P1/B0/D0,J14300/offset=4657339a
296a078c-9763-6c57-f7c9-89a413657bdc
 En el fmdump -e, aparecen algunos errores que parecieran indicar errores de ecc en memoria y cpu:
bash-3.2$
tail fmdump-e.out
Jun
13 17:30:20.8827 ereport.cpu.ultraSPARC-IVplus.ce
Jun
13 17:30:22.9015 ereport.cpu.ultraSPARC-IVplus.ivc
Jun
13 17:30:22.9015 ereport.cpu.ultraSPARC-IVplus.ce
Jun
13 17:30:24.8022 ereport.cpu.ultraSPARC-IVplus.ivc
Jun
13 17:30:26.8814 ereport.cpu.ultraSPARC-IVplus.ce
Jun
13 17:30:30.1206 ereport.io.xmits.ecc.dwce
Jun
13 17:30:30.2977 ereport.cpu.ultraSPARC-IVplus.ivc
Jun
13 17:30:30.2993 ereport.cpu.ultraSPARC-IVplus.ivc
Jun
13 17:30:30.3054 ereport.cpu.ultraSPARC-IVplus.ivc
Jun
13 17:30:30.3113 ereport.cpu.ultraSPARC-IVplus.ce// Estos son todos los archivos fmdump -vu recolectados en el explorer:
bash-3.2$
ls -lrt | grep fmdump-vu
-rwxrwxrwx+
1 root staff 320 Jun 13 15:30 fmdump-vu_2bd9feed-7269-c64a-8f54-a269a93cec55.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:30 fmdump-vu_ca963465-a151-cc2d-9521-a8e0e6749a70.out-rwxrwxrwx+ 1 root staff 320 Jun 13 15:30 fmdump-vu_d002087b-50d0-64c8-fe5a-8de2099fa3b4.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:30 fmdump-vu_bd302929-fe79-49bd-b1b4-9c9599c7f7db.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:30 fmdump-vu_d1c88b3a-affd-c8fd-b7ad-e161f51f7c2d.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:30 fmdump-vu_92f53876-b809-4969-d00d-dac6859754b6.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:31 fmdump-vu_210c66e3-a939-62c6-d0e3-8b040b97ff82.out
-rwxrwxrwx+
1 root staff 320 Jun 13 15:31 fmdump-vu_cdf55e54-0758-6e26-9f46-de77a562dd5a.out
/ Revisando del ultimo hacia el primero, se encuentra que siempre se reporta un error en el modulo de fma llamado cpumem-diagnosis:

bash-3.2$ more fmdump-vu_fde87c22-19d6-e8c6-a9a6-a80bb9a1dcf4.out
TIME UUID SUNW-MSG-ID
Jun 13 09:03:58.0344 fde87c22-19d6-e8c6-a9a6-a80bb9a1dcf4 FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -

bash-3.2$ more fmdump-vu_e2ca8c9b-20e2-c419-a73a-e3f0f3198fd2.out
TIME UUID SUNW-MSG-ID
Jun 13 08:46:46.2303 e2ca8c9b-20e2-c419-a73a-e3f0f3198fd2 FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -

bash-3.2$ more fmdump-vu_2ad4ec18-b1a4-eca0-a67d-a268a7af7071.out
TIME UUID SUNW-MSG-ID
Jun 13 07:51:24.7743 2ad4ec18-b1a4-eca0-a67d-a268a7af7071 FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -

bash-3.2$ more fmdump-vu_2af501d9-6d9b-cc47-bfd9-b27d4214a161.out
TIME UUID SUNW-MSG-ID
Jun 08 02:41:09.9915 2af501d9-6d9b-cc47-bfd9-b27d4214a161 FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -

bash-3.2$ more fmdump-vu_9512e0a0-f65f-4d3d-8010-c94ad974d5de.out
TIME UUID SUNW-MSG-ID
Jun 01 02:40:48.2977 9512e0a0-f65f-4d3d-8010-c94ad974d5de FMD-8000-2K
100% defect.sunos.fmd.module

Problem in: fmd:///module/cpumem-diagnosis
Affects: fmd:///module/cpumem-diagnosis
FRU: -
Location: -


== Esta informacion nos direcciona hacia un posible error o bug del fma.


Plan de accion.
1) Limpiar logs de fma.
(aun no se han limpiado todos, ya que en el explorer hay logs con fecha del 1 de Junio y anteriores; si estuviera completamente limpio, veriamos solo logs de fma del dia de hoy).
Favor de aplicar todos los pasos.

Clearing FMA Faults from the O/S
================================

Please run the following commands from the O/S:

1. Run the fmadm faulty command

# fmadm faulty

When you run the fmadm faulty command you may see the output similar to below, and it is the long hex number that is the UUID
STATE RESOURCE / UUID
-------- ----------------------------------------------------------------------
degraded dev:////pci@8,700000 d83323bd-f87b-6cc9-f754-c62f479c7706
-------- ----------------------------------------------------------------------

**NOTE: if fmadm comes back clean, skip to step 3 and continue

2. Run the fmadm repair command on all the UUIDs.
Since you will probably see the same UUID for each event, you will only need to repair that UUID. If you see different UUIDs, run it on each one.

# fmadm repair d83323bd-f87b-6cc9-f754-c62f479c7706

3. Clear ereports and resource cache

# cd /var/fm/fmd
# rm e* f* c*/eft/* r*/*

4. Reset the fmd serd modules
# fmadm reset cpumem-diagnosis
# fmadm reset cpumem-retire
# fmadm reset eft
# fmadm reset io-retire


5. Reboot the system to clear the errors.
En este punto, es necesario monitorear si aparecen nuevos errores de fma despues del reboot.


2) Si llegara a suceder que el problema continuara (que aparecieran nuevos errores de fma), entonces sera necesario aplicar un POST 96 al dominio ,para descartar en su totalidad que haya una falla de hardware en el system board, memoria o en el expander board.

Para correr el POST 96, es necesario dar de baja y apagar el dominio con un setkeyswitch off y encenderlo con el siguiente comando:
setkeyswitch -d B -l 96 on
donde "B" es el identificador del dominio y "l" es el nivel del POST

A esta Altura, el ingeniero de Oracle, recomendo cambiar el EXPANDER BOARD ( ya habiamos reemplazados 2 SB y Memorias )
Al momento, las cosas venian asi :
El equipo venia presentando record stops desde Diciembre, pero el 13 de Junio a las 07:51 presento un panic.

Con la ayuda de un ingeniero de campo, reemplazamos la system board y todos los dimms de memoria, pero el problema continuaba. Entonces se remplazo tambien la expander board pero el problema persiste.

Se corrio un post 96 con todo este nuevo hardware y no aparecio ningun error.
El ingeniero en sitio hizo la prueba de hacer un boot del dominio desde un dvd de solaris en una version mas reciente a la que esta instalada en el equipo (utilizo Solaris 10 Release 09/10)y el problema persistio, se siguieron presentando los record stops en el dominio.


A esta altura es un kilombo, esto seria un resumen
====================
El equipo genera record stops todo el tiempo cuando el sistema operativo esta corriendo. Los record stops indican problemas en los cpus.
En el sistema operativo, se presentan mensajes de fma que indican errores de memoria.
AUN NO HEMOS PODIDO DETERMINAR SI EL PROBLEMA ES DE HARDWARE O DE SOFTWARE.

De acuerdo al analisis del nuevo ingeniero que tomo el caso se desprende:
Del core generado Jun 13 9:03 ,
- El panic fue debido a un "send mondo timeout", lo cual se traduce a un excesivo numero de CE registrados, sumado a que no se tienen los parches para hacer un mejor manejo de los errores de FMA.
- Los parches de FMA estan desactualizados, se deben actualizar para mejorar el manejo de los mensajes de error (rstops)
- La SB actual no presenta falla en ninguno de sus componentes en Post 96 , pero los rstops siguen generandose.
$ strings vmcore.0 | head
SunOS
sol5002
5.10
Generic_127111-09
sun4u
SUNW,Sun-Fire-15000
send mondo timeout (target 0x24) [1470496 NACK 0 BUSY] --* Indica el problema antes mencionado!!
.symtab
.strtab
.shstrtab


Anexo link con informacion al respecto :
https://support.us.oracle.com/oip/faces/secure/km/DocumentDisplay.jspx?id=1019109.1&h=Y
https://support.us.oracle.com/oip/faces/secure/km/DocumentDisplay.jspx?id=1000495.1&h=Y

patch 125369-03 esta obsoleto y reemplazado por 127755-01
patch 137111-01 esta obsoleto y reemplazado por 137137-09

*** Rstops :
------------

Cambian un poco en relacion al Hw instalado pero me da la impresion que la mayor parte de ellos hacen referencia a CE.
por lo que la instalacion de los parches de FMA son necesarios
-Current Action Plan:
--------------------------------------------------------------

1.- Instalar parches faltantes de FMA:
FMA Patch 127755 missing (rps -01, current -01): SunOS 5.10: Fault Manager patch
FMA Patch 127127 missing (rps -11, current -11): SunOS 5.10: kernel patch
FMA Patch 137137 missing (rps -09, current -09): SunOS 5.10: kernel patch
FMA Patch 139555 missing (rps -08, current -08): SunOS 5.10: Kernel Patch
FMA Patch 141444 missing (rps -09, current -09): SunOS 5.10: kernel patch
FMA Patch 142909 missing (rps -17, current -17): SunOS 5.10: kernel patch
FMA Patch 144500 missing (rps -19, current -19): SunOS 5.10: Solaris kernel patch
FMA Patch 147790 missing (current -01): SunOS 5.10: fmd patch
FMA Patch 146582 missing (current -02): SunOS 5.10: fmadm patch
FMA Patch 147705 missing (rps -01, current -02): SunOS 5.10: pciex patch
FMA Patch 147778 missing (current -01): SunOS 5.10: fmd patch
FMA Patch 148629 missing (current -01): SunOS 5.10: xaui patch

2.- Reiniciar equipo y verificar que haya reducido o detenido el numero de rstops
Se abrieron dos escalaciones técnicas, a ingenieros de Kernel y a Ingenieros de Sparc
De las dos escalaciones se logra concluir:

1)causa del panic reportado por cliente en este SR:
Could be a hardware or OBP, firmware and fma patch issues.

Solucion:
Actulizar patches de OS

Solucion implementada:
Patches recomendados del EIS-March-2012 fueron aplicados anoche por FEs. 
2)Respecto a los Rstops.

Estos vienen ocurriendo desde el 2011, son del tipo CE, "errores corregibles" por lo que no
requieren accion.
Solo si el FMA del dominio los reporta deberan ser reemplazados. No se deben cambiar DIMMS que no
esten reportados en logs del FMA.




Plan de accion
================
1. Actualizar patches de SC-SMS
Correr post en nivel 127 domain B.


El post 127 tarda aprox 70 minutos

_________________________________-
Esto conteste yo
Se realizo, el ultimo action plan, que consistia en la instalacion de parches de SC-SMS + un setkeyswitch -d B -l 127.

Al levantar el dominio luego de pocos minutos el FMA reporta errores nuevamente:

[sol5002] /opt/SUNWexplo/output # fmdump -v
TIME UUID SUNW-MSG-ID
Jun 16 02:54:24.5023 79a1d7cf-9a4a-cd58-b57b-ca35d705af4c SUN4U-8001-32
100% fault.memory.datapath

Problem in: hc://:product-id=SUNW,Sun-Fire-15000:server-id=sol5002/component=EX1
Affects: hc://:product-id=SUNW,Sun-Fire-15000:server-id=sol5002/component=EX1
FRU: hc://:product-id=SUNW,Sun-Fire-15000:server-id=sol5002/component=EX1
Location: -
A esta altura ( empezamos un miercoles a las 7am y terminamos un sabado 15 hs ) el ingeniero de campo Ojea Quintana tuvo la solucion final.
Probamos de levantar el sistema operativo con las placas de red unplumbed y levanta sin RecordStop (es decir, sin fallas).

El problema se acoto a lo que es el IO Board, y se reemplazo 
la IO1 (501-7394 que es el IO board completo).
El cluster levanto sin errores de ningún tipo. 



viernes, 23 de marzo de 2012

Instalacion de Solaris 11 x86 en un Blade IBM


Esta Instalacion fue realizada en el siguiente Hardware
Product Name LS20 Blade Server, 2 AMD Opteron dual-core sockets, 2x GB Enet
Description LS20 (Type 8850)
Machine Type/Model 885065U
El release instalado fue Oracle Solaris 11 11/11 X86, Assembled 18 October 2011

Cantidad de memoria del Servidor
Memory size: 2048 Megabytes

Esta es la salida del prtdiag -v
System Configuration: IBM IBM eServer BladeCenter LS20 -[885065U]-
BIOS Configuration: IBM -[BKE121AUS-1.08]- 01/12/2006
BMC Configuration: IPMI 1.5 (KCS: Keyboard Controller Style)

==== Processor Sockets ====================================

Version Location Tag
-------------------------------- --------------------------
AMD Opteron CPU 1
AMD Opteron CPU 2
AMD Opteron CPU 3
AMD Opteron CPU 4

==== Memory Device Sockets ================================

Type Status Set Device Locator Bank Locator
----------- ------ --- ------------------- ----------------
DDR in use 1 DIMM1 Slot 1
DDR in use 1 DIMM2 Slot 2
DDR in use 2 DIMM3 Slot 3
DDR in use 2 DIMM4 Slot 4

==== On-Board Devices =====================================
ATI Radeon
Ethernet 1 BroadCom 5704S Ethernet Controller
Ethernet 2 BroadCom 5704S Ethernet Controller
LSI Logic 1020/1030 Ultra320 SCSI Adapter

A continuacion, el paso a paso en fotos

En la Figura 1, se muestra la primer pantalla de instalacion donde pregunta el
Figura 1

En la Figura 2, se muestra el menu de instalacion, varia respecto a las versiones anteriores

Figura 2

En la Figura 3, muestra los discos disponibles y donde se instalara Solaris.
Figura 3

En la Figura 4, muestra el Nuevo menu, donde pregunta el nombre del host, y que tipo de configuracion vamos a realizar ( se cambia con )
Figura 4



En la Figura 5, muestra ( esto tambien es Nuevo ) las placas de red a configurar, notese que la bge0 cambio por net0, que es como la veremos de ahora en mas cuando hagamos un ifconfig -a
Figura 5



En la Figura 6, se ve como le tenemos que cargar los datos a la red, en este menu tambien nos movemos con la tecla TAB
Figura 6



En la Figura 7, nos pide la configuracion del DNS
Figura 7

En la Figura 8, al igual que en versiones anteriores, nos pregunta si queremos NIS, LDAP o Ninguno
Figura 8



En la Figura 9, el TIMEZONE, en mi caso elijo America, Buenos Aires, Argentina
Figura 9

En la Figura 10, fecha y hora....vamos vamos que terminamos
Figura 10



En la Figura 11, Atencion, esto es Nuevo y muy distinto, pide password de root, tiene que ser con al menos un caracter especial, y un usuario comun, con la misma caracteristica que root en cuanto al password, es decir, con al menos un caracter especial.
Con este usuario nos vamos a loguear,y luego recien nos podemos sustituir como root, porque Root ahora es un ROL.
Figura 11


Bueno, ya lo instale, notese como cambio el ifconfig -a
root@nuve:~# ifconfig -a
lo0: flags=2001000849 mtu 8232 index 1
inet 127.0.0.1 netmask ff000000
net0: flags=1000843 mtu 1500 index 2
inet 10.19.33.100 netmask ffffff00 broadcast 10.19.33.255 ether 0:14:5e:86:20:90
lo0: flags=2002000849 mtu 8252 index 1
inet6 ::1/128
net0: flags=20002004841 mtu 1500 index 2
inet6 fe80::214:5eff:fe86:2090/10  ether 0:14:5e:86:20:90
root@nuve:~#

Otra cosa, es que el querido UFS no te lo deja elegir en el proceso de instalacion, te pone de prepo el ZFS
mira la salida del df -h
root@nuve:~# df -h
Filesystem                   Size     Used    Available    Capacity        Mounted on
rpool/ROOT/solaris     67G     1.4G         63G           3%              /
/devices 0K 0K 0K 0% /devices
/dev 0K 0K 0K 0% /dev
ctfs 0K 0K 0K 0% /system/contract
proc 0K 0K 0K 0% /proc
mnttab 0K 0K 0K 0% /etc/mnttab
swap                            1.9G    1.4M       1.9G           1%           /system/volatile
objfs 0K 0K 0K 0% /system/object
sharefs 0K 0K 0K 0% /etc/dfs/sharetab
/usr/lib/libc/libc_hwcap2.so.1     65G 1.4G 63G 3% /lib/libc.so.1
fd 0K 0K 0K 0%                /dev/fd
rpool/ROOT/solaris/var       67G    215M      63G        1%      /var
swap                                    1.9G      44K     1.9G        1%      /tmp
rpool/export                          67G      32K      63G        1%      /export
rpool/export/home                67G       32K      63G       1%      /export/home
rpool/export/home/diego      67G       32K      63G        1%     /export/home/diego
rpool                                     67G       39K     63G        1%     /rpool
/export/home/diego               63G       32K     63G        1%     /home/diego
root@nuve:~#

Otra cosita, el dladm show-dev NO VA MAS,( en realidad el dladm toma protagonismo es esta version de Solaris) el que vamos a usar es ....
root@nuve:~# dladm show-phys
LINK MEDIA STATE SPEED DUPLEX DEVICE
net1 Ethernet unknown 0 unknown bge1
net0 Ethernet up 1000 full bge0
root@nuve:~#











lunes, 12 de marzo de 2012

Discos IBm en multipath


No me reconocia los discos Ibm en Multipath.
La Solucion es que el vendor id tiene que tener 8 caracteres, y en estos ibm hay que agregarle 5 espacion en blanco, de esta menra el /kernel/drv/scsi_vhci.conf quedaria asi "IBM_____2105800" donde _ es un espacio en blanco.

Configurar JET para instalacion desatendida


Todo este procedimiento fue realizado con los siguientes elementos:
Notebook HP modelo HP430 con sistema operativo linux CentOS 6, dentro de la misma, le instale Oracle Virtual Box,
con sistema operativo Solaris x86 release 09/10
#configurar JET para instalacion desatendida

En el linux, en el directorio /usr/scripts/ tengo las imagenes .iso del dvd de solaris 10 y del dvd del EIS
Dentro del Oracle Virtual Box, hay una opcion que se llama "shared folders", ahi le digo que fs o directorio quiero compartir a en este caso mi solaris
***Aclaracion importante: cuando creo en el VirtualBox el Solaris, debo hacerlo con la opcion de red "Bridget " para que funcione cuando lo conecte al server que quiero instalar ***
Cuando levanta el solaris, monta automaticamente los fs que comparti desde el Virtual Box anteriormente
Aca va un ejemplo de como montamos la imagen .iso del dvd del EIS
# lofiadm -a /mnt/sf_ISOs/eis-diciembre2011-one.iso
/dev/lofi/1
# mkdir /eis
# mount -o ro -F hsfs /dev/lofi/1 /eis
# cd /eis
# ls -ltra
dr-xr-xr-x 7 root root 2048 Jul 21 2010 sun
-r--r--r-- 1 root root 2520 Dec 13 11:48 README-14DEC11
-r--r--r-- 1 root root 90353 Dec 13 11:56 .eis-dvd1.md5
# cd sun
# cd progs/JET/
# ls -tlra
-r--r--r-- 1 root root 417542 Dec 8 21:05 JET-EIS.pkg.bz2
# cp -p JET-EIS.pkg.bz2 /usr/scripts/
# cd /usr/scripts/
# bzip2 -d JET-EIS.pkg.bz2
# pkgadd -d ./JET-EIS.pkg
The following packages are available:
1 JetEISCD EIS CD JET module
(sparc,i386) 4.3
2 JetEXPLO jet explo product
(sparc,i386) 3.1.22
3 JetFLASH JET flash product
(sparc,i386) 3.1.11
4 JetISO JET ISO product
(sparc) 1.0.2
5 JetJASS JASS product
(sparc,i386) 3.0.17
6 JetLDOM JET LDOM product
(sparc,i386) 2.5
7 JetRBAC JET RBAC product
(sparc) 1.1.5
8 JetSAN JET san product
(sparc,i386) 3.1.14
9 JetSBD Secure By Default product
(sparc,i386) 1.0.4
10 JetSC3 JET sc3 Product
(sparc,i386) 3.3.40
11 JetSDS JET sds product
(sparc,i386) 3.5
12 JetVFS JET vfs product
(sparc) 1.0.3
13 JetVTS JET VTS product
(sparc,i386) 3.0.15
14 JetVXFS VxFS product
(sparc) 3.0.7
15 JetVXVM JET VXVM product
(sparc) 3.2.8
16 JetVXVM4 JET VXVM4 product
(sparc) 1.2
17 JetWanBoot JET WanBoot support
(sparc) 1.3.2
18 JetZFS JET zfs product
(sparc,i386) 1.2
19 JetZONES JET Zones module
(sparc,i386) 1.3.17
20 SUNWjet Sun JumpStart Enterprise Toolkit
(sparc,i386) 4.9.2
21 SUNWjetd JET Documentation
(sparc) 4.5

Select package(s) you wish to process (or 'all' to process
all packages). (default: all) [?,??,q]: all
Processing package instance from
The selected base directory must exist before
installation is attempted.
Do you want this directory created now [y,n,?,q] y
Using as the package base directory.
## Processing package information.
## Processing system information.
## Verifying disk space requirements.
## Checking for conflicts with packages already installed.
## Checking for setuid/setgid programs.
This package contains scripts which will be executed with super-user
permission during the process of installing this package.
Do you want to continue with the installation of [y,n,?] y
Installing Sun JumpStart Enterprise Toolkit as

## Executing preinstall script.
Adding 'jet' group to /etc/group
## Installing part 1 of 1.
/opt/SUNWjet/Products/base_config/solaris/base_config.conf
/opt/SUNWjet/Products/base_config/solaris/boot_image_patches
.........
Corto la salida porque es larguisima
............
Processing package instance from

JET Documentation(sparc) 4.5
Installation of was successful.
Installing JET sds product as
Installing JET vfs product as
Installing JET VXVM product as
Installation of was successful.
Installing JET VXVM4 product as
Installation of was successful.
Installing VxFS product as
Installation of was successful.
Installing EIS CD JET module as
Installation of was successful.
Installing JET VTS product as
Installation of was successful.
Installing jet explo product as
Installation of was successful.
Installing JET san product as
Installation of was successful.
Installing JET sc3 Product as
Installation of was successful.
Installation of was successful.
Installing JET Zones module as
Installation of was successful.
Installing JASS product as
Installation of was successful.
Installing Secure By Default product as
Installation of was successful.
Installing JET RBAC product as
Installation of was successful.
Installing JET WanBoot support as
Installation of was successful.
Installing JET LDOM product as
Installation of was successful.
Installing JET ISO product as
Installation of was successful.
Installing JET zfs product as
####### Aca yo habia sacado los shares viejos para despues no hacerme quilombo. La idea es que el share del /opt/SUNWjet te lo agrega solo automaticamente.
# vi /etc/dfs/dfstab
# share -F nfs -o rw=engineering -d "home dirs" /export/home2
share -F nfs -o ro,anon=0 /usr/scripts/Solaris_10
share -F nfs -o ro,anon=0 -d "JET Framework" /opt/SUNWjet
# shareall
# share
- /opt/SUNWjet ro,anon=0 "JET Framework"
# cd /usr/scripts
# ls -tlra
-r--r--r-- 1 root root 2143232 Dec 8 21:05 JET-EIS.pkg
drwxr-xr-x 6 root root 512 Mar 6 15:47 Solaris_10
###### Aca borre la vieja instalacion del dvd de solaris para no mezclarme con lo nuevo que iba a instalar.
# rm -r Solaris_10/
# mkdir /sun-dvd
# pwd
/usr/scripts
# lofiadm -a /mnt/sf_ISOs/sol10SparcNov2011.iso
/dev/lofi/2
# mount -o ro -F hsfs /dev/lofi/2 /sun-dvd/
###### Aca se modifican los tres directorios pkgs, patches y media (si los queremos cambiar de la ubicacion default) y la clave que orignalmente es newroot.
Editar el sig archivo y configurar donde va a buscar los archivos a instalar

# vi /opt/SUNWjet/etc/jumpstart.conf
JS_Default_Root_PW=boajrOmU7GFmY
JS_BUILD_DIR=/var/opt/sun/jet
JS_PKG_DIR=/usr/scripts/jumpstart/pkgs
JS_PATCH_DIR=/usr/scripts/jumpstart/patches
JS_CFG_SVR=
JS_SOLARIS_DIR=/usr/scripts/jumpstart/media
JS_DHCP_VENDOR="SUNW.Ultra-5_10 SUNW.Ultra-30"
JS_CLIENT_MANAGEMENT="dhcp bootp"
JS_CLIENT_MANAGEMENT="bootp"
JS_CLIENT_BOOT="local"

# /opt/SUNWjet/bin/copy_solaris_media -n sol10u10_sparc /sun-dvd/
Copying Solaris image....
Verifying target directory...
Calculating the required disk space for the Solaris_10 product
| /
Install Server setup complete
Added Solaris image sol10u10_sparc at the following location:
Media: /usr/scripts/jumpstart/media/Solaris_10
removing directory /usr/scripts/jumpstart/media/3465

# cd /usr/scripts
# cp -p /eis/sun/progs/explorer/Explorer_6.9.tar.gz .
# gzip -d Explorer_6.9.tar.gz
# tar xvf Explorer_6.9.tar
# /opt/SUNWjet/bin/copy_product_media explo 6 /eis/sun/progs/explorer/ sparc
Transferring package instance
Transferring package instance
Packges copied.


####### Este paso tarda como 3 horas... se ve que los discos compartido con virtual box van muy lento.
# /opt/SUNWjet/bin/copy_eiscd /eis/
Scanning for components in /eis/
Copying DVD

/usr/scripts/jumpstart/patches/eiscd/14DEC11 already exists...
Copying from EIS-DVD image into /usr/scripts/jumpstart/patches/eiscd/14DEC11....
Copying contents of directory sun...
Completed... Please ensure that following line exists in /etc/dfs/dfstab

share -F nfs -o ro,anon=0 /usr/scripts/jumpstart/patches/eiscd/14DEC11
Installtaion of DVD (1) finished

###### Agrego la linea que me pasa el copy_eiscd
# vi /etc/dfs/df stab
share -F nfs -o ro,anon=0 -d "JET Framework" /opt/SUNWjet
share -F nfs -o ro,anon=0 /usr/scripts/jumpstart/patches/eiscd/14DEC11
# shareall
###### Cambiamos las cosas basicas en estos 3 archivos de configuracion en el primero es importante modificar base_config_client_allocation y agregarle bootp
###### El resto son detalles para despues cuando el make_template no tener que tocar a mano mucho el archivo que me devuelve.
###### Yo en el primero modifique el timezone el system_locale, profile_root, profile_swap, dns_domain, dns_nameservers, ntp_servers.
###### En el archvio eiscd modifique solo eiscd_product_version le puse latest
###### En el archivo explo.conf el numero de version en 6. explo_product_version=6
# vi /opt/SUNWjet/Products/base_config/solaris/base_config.conf
# vi /opt/SUNWjet/Products/eiscd/eiscd.conf
# vi /opt/SUNWjet/Products/explo/explo.conf

# make_template -E 0:3:ba:4:96:d9 cabarulo base_config sds sbd explo eiscd

Adding product configuration information for
+ base_config
+ sds
+ sbd
+ explo
+ eiscd
Updating base_config template specifics
Client template created in /opt/SUNWjet/Templates
# cd /opt/SUNWjet/Templates
# ls -tlra
total 324
drwxr-xr-x 11 root root 512 Mar 8 14:23 ..
-rw-rw-r-- 1 root jet 104070 Mar 8 14:23 sample.template
-rw-rw-r-- 1 root jet 48389 Mar 8 16:21 cabarulo
drwxrwsr-x 2 root jet 512 Mar 8 16:21 .
################################3
Editar el sig archivo ( es el nombre del host que quiero instalar ) y configurar lo que quiero que se instale automaticamente, por ejemplo, tamano de los fs
a crear, parches, si quiero mirror.

base_config_ClientEther=0:3:ba:4:96:d9 ( aca va la mac address del Servidor que quiero instalar, una de las formas de verlo es con el equipo en OBP, tipear
banner )
base_config_ClientOS=sol10u10_sparc
base_config_products=" sds sbd explo eiscd"

base_config_sysidcfg_nameservice=NONE
base_config_sysidcfg_network_interface=PRIMARY
base_config_sysidcfg_ip_address=10.11.33.108 ( esta es la ip del equipo que quiero instalar)
base_config_sysidcfg_netmask=255.255.255.0
base_config_sysidcfg_root_password=boajrOmU7GFmY ( si dejamos esto boajrOmU7GFm la passwd de root que le pone es newroot)
base_config_sysidcfg_system_locale=en_US
base_config_sysidcfg_timeserver=localhost
base_config_sysidcfg_timezone=America/Buenos_Aires
base_config_sysidcfg_terminal=vt100
base_config_sysidcfg_security_policy=NONE
base_config_sysidcfg_protocol_ipv6=no
base_config_sysidcfg_default_route=10.11.33.1

base_config_profile_usedisk=rootdisk.
base_config_profile_dontuse=""
base_config_profile_root=30000 ( le deje 30gb al / )
base_config_profile_swap=8192 ( le deje 8gb al swap )
base_config_dns_domain="eldominio.com.ar"
base_config_dns_searchpath=""
base_config_dns_nameservers="10.XX.7.16"
base_config_dns_disableforbuild="yes"
base_config_ntp_servers="10.xx.33.30" ( ip del servidor de NTP )
Parametros de Solaris Disksuite porque quiero mirrorear el equipo
sds_root_mirror=""
sds_use_fmthard="yes"
sds_database_locations="rootdisk.s7:3"
sds_database_partition="s7:32"
sds_root_alias="rootdisk"
sds_root_mirror_devalias_name="rootmirror"

Valores para El Explorer
explo_product_version=6
###### Agrego el fs que me falte.. la idea es que tienen que estar compartidos los tres directorios principales mas el de instalacion (media,patches,pkgs y o
pt/SUNWjet)
share -F nfs -o ro,anon=0 -d "JET Framework" /opt/SUNWjet
share -F nfs -o ro,anon=0 /usr/scripts/jumpstart/patches/eiscd/14DEC11
share -F nfs -o ro,anon=0 /usr/scripts/jumpstart/media/Solaris_10/Solaris_10/Tools/Boot
share -F nfs -o ro,anon=0 /usr/scripts/jumpstart/pkgs

# shareall
# make_client cabarulo
Gathering network information..
Client: 10.11.33.108 (10.11.33.0/255.255.255.0)
Server: 10.11.33.109 (10.11.33.0/255.255.255.0, SunOS)
Solaris: client_prevalidate
Clean up /etc/ethers
Solaris: client_build
Creating sysidcfg
Creating profile
Adding base_config specifics to client configuration
Adding sds specifics to client configuration
Adding sbd specifics to client configuration
SBD: Setting Secure By Default to limited_net
Adding eiscd specifics to client configuration
Solaris: Configuring JumpStart boot for cabarulo
Solaris: Configure bootparams build
Starting SMF services for JumpStart
cleaning up preexisting install client "cabarulo"
removing cabarulo from bootparams
removing /etc/bootparams, since it is empty
removing /tftpboot/inetboot.SUN4U.Solaris_10-1
updating /etc/bootparams
copying boot file to /tftpboot/inetboot.SUN4U.Solaris_10-1
Force bootparams terminal type
-Restart bootparamd
Running '/opt/SUNWjet/bin/check_client cabarulo'
Client: 10.11.33.108 (10.11.33.0/255.255.255.0)
Server: 10.11.33.109 (10.11.33.0/255.255.255.0, SunOS)
Checking product base_config/solaris
BASE_CONFIG/SOLARIS: JS_PKG_DIR is on a remote server. Not checking
BASE_CONFIG/SOLARIS: JS_PATCH_DIR is on a remote server. Not checking
Checking product sds
Product sbd does not support 'check_client'
Checking product explo
WARNING: EXPLO: Unable to locate package SUNWexplo
WARNING: EXPLO: Unable to locate package SUNWexplu
Checking product eiscd
EISCD: Using latest EISCD version -> 14DEC11
--------------------------------------------------------------
Check of client cabarulo

#######
En mi maquina virtual de Solaris x86, (luego de conectar los cables como muestro mas abajo en la foto ) hice
ifconfig e1000g0 10.11.33.109 netmask 255.255.255.0 up

svcadm restart svc:/network/rarp:default

####
Desde mi linux, hice:
minicom para conectarme a la consola del servidor v240 donde quiero hacer la instalacion
Una vez conectado y en OBP hice
boot net - install











Esta instalacion fue realizada en conjunto con mi compañero de equipo,Nicolas Morono

miércoles, 7 de marzo de 2012

Crear un Servidor JumpStart


Para crear un servidor JumpStart ( como para hacer un booteo por red boot -net -s )

Crear archivo de configuracion de tftp (en /var/tmp p.e.) con la siguiente linea
tftp dgram udp6 wait root /usr/sbin/in.tftpd in.tftpd -s /tftpboot
inetconv -i /var/tmp/tftpd.conf

Reiniciar o verificar que este arriba el tftp
svcs -a |grep tftp

### Probamos desde una ip del mismo segmento poder hacer un put y un get con el comando tftp

### Creacion del server de instalacion.
mkdir /export/install/sol10u9_sparc
### Voy al cdrom o en este caso a donde monte la iso con lofiadm
cd /mnt/Solaris_10/Tools/
./setup_install_server /export/install/sol10u9_sparc/
Verifying target directory...
Calculating the required disk space for the Solaris_10 product
Calculating space required for the installation boot image
Copying the CD image to disk...
Copying Install Boot Image hierarchy...
Copying /boot netboot hierarchy...
Install Server setup complete

share -F nfs -o ro,anon=0 -d "install server directory" /export/install/sol10u9_sparc
### Lo agrego al /etc/dfs/dfstab

######## PARA AGREGAR CLIENTES UNO A UNO
### Agregar al /etc/ethers con el formato mac tabulacion hostname
### Agregar al /etc/hosts con el formato ip tabulacion hostname
cd /export/install/sol10u9_sparc/Solaris_10/Tools
./add_install_client sunp002 sun4u


Documento realizado por Nicolas Morono

martes, 10 de enero de 2012

Desasignar System Board en 25k


Para desasignar una System Board con el sistema operativo ejecutandose, realizar desde la system controller :
**** OJO que esto me freeza el Sistema Operativo por unos minutos ***
e25k> deleteboard -c unconfigure SB12
System may be temporarily suspended, proceed
(yes/no)? yes
request suspend SUNW_OS
request suspend SUNW_OS done
request delete capacity (8 cpus)
request delete capacity (4194304 pages)
request delete capacity SB12 done
request offline SUNW_cpu/cpu384
request offline SUNW_cpu/cpu388
request offline SUNW_cpu/cpu385
request offline SUNW_cpu/cpu389
request offline SUNW_cpu/cpu386
request offline SUNW_cpu/cpu390
request offline SUNW_cpu/cpu387
request offline SUNW_cpu/cpu391
request offline SUNW_cpu/cpu384 done
request offline SUNW_cpu/cpu388 done
request offline SUNW_cpu/cpu385 done
request offline SUNW_cpu/cpu389 done
request offline SUNW_cpu/cpu386 done
request offline SUNW_cpu/cpu390 done
request offline SUNW_cpu/cpu387 done
request offline SUNW_cpu/cpu391 done
unconfigure SB12
unconfigure SB12 done
notify remove SUNW_cpu/cpu384
notify remove SUNW_cpu/cpu388
notify remove SUNW_cpu/cpu385

request offline SUNW_cpu/cpu389 done
request offline SUNW_cpu/cpu386 done
request offline SUNW_cpu/cpu390 done
request offline SUNW_cpu/cpu387 done
request offline SUNW_cpu/cpu391 done
unconfigure SB12
unconfigure SB12 done
notify remove SUNW_cpu/cpu384
notify remove SUNW_cpu/cpu388
notify remove SUNW_cpu/cpu385
notify remove SUNW_cpu/cpu389
notify remove SUNW_cpu/cpu386
notify remove SUNW_cpu/cpu390
notify remove SUNW_cpu/cpu387
notify remove SUNW_cpu/cpu391
notify remove SUNW_cpu/cpu384 done
notify remove SUNW_cpu/cpu388 done
notify remove SUNW_cpu/cpu385 done
notify remove SUNW_cpu/cpu389 done
notify remove SUNW_cpu/cpu386 done
notify remove SUNW_cpu/cpu390 done
notify remove SUNW_cpu/cpu387 done
notify remove SUNW_cpu/cpu391 done
notify capacity change (8 cpus)
notify capacity change (4194304 pages)
notify capacity change SB12 done
notify resume SUNW_OS
notify resume SUNW_OS done
e25k>

Del lado del sistema operativo ( parado en la consola) muestra estos mensajes ( me freezo unos 5 o 10 minutos el OS )
root@psun5ads #
DR: suspending user threads...

DR: checking devices...
DR: suspending drivers...
suspending scsa,00.bvhci@g60050768019901b400000000000004dd (aka ssd)
suspending scsa,00.bvhci@g60050768019901b400000000000004e1 (aka ssd)
suspending scsa,00.bvhci@g60050768019901b400000000000004e0 (aka ssd)
suspending scsa,00.bvhci@g60050768019901b400000000000004df (aka ssd)
suspending scsa,00.bvhci@g60050768019901b400000000000004de (aka ssd)
suspending memory-controller@140,400000 (aka mc-us3)
suspending memory-controller@141,400000 (aka mc-us3)
suspending memory-controller@142,400000 (aka mc-us3)
suspending memory-controller@143,400000 (aka mc-us3)
suspending pci108e,c416@2 (aka sbbc)
suspending pci100b,35@0 (aka ce)
suspending pci100b,35@1 (aka ce)
suspending sd@8,0
suspending sd@9,0
suspending sd@a,0
suspending sd@b,0
suspending ses@5,0
suspending pci1000,b@2 (aka glm)
suspending pci1000,b@2,1 (aka glm)
suspending pciclass,060400@1 (aka pci_pci)
suspending pci108e,1101@3,1 (aka eri)
suspending pciclass,0c0310@3,3 (aka ohci)
suspending pciclass,060400@1 (aka pci_pci)
suspending pci108e,8002@15c,700000 (aka pcisch)
suspending pci108e,8002@15c,600000 (aka pcisch)
suspending pci100b,35@0 (aka ce)
suspending pci100b,35@1 (aka ce)
suspending pci100b,35@2 (aka ce)
suspending pci100b,35@3 (aka ce)
suspending pciclass,060400@1 (aka pci_pci)
suspending pci108e,8002@15d,700000 (aka pcisch)
suspending fp@0,0
suspending pci1077,2422@1 (aka qlc)
suspending scsiclass,01@w500507630f415635,0 (aka st)
suspending scsiclass,01@w500507630f415632,0 (aka st)
suspending scsiclass,01@w500507630f415643,0 (aka st)
suspending scsiclass,01@w500507630f415634,0 (aka st)
suspending scsiclass,01@w500507630f415644,0 (aka st)
suspending scsiclass,01@w500507630f415633,0 (aka st)
suspending pci1077,2422@1,1 (aka qlc)
suspending pci108e,8002@15d,600000 (aka pcisch)
suspending memory-controller@180,400000 (aka mc-us3)
suspending memory-controller@181,400000 (aka mc-us3)
suspending memory-controller@182,400000 (aka mc-us3)
suspending memory-controller@183,400000 (aka mc-us3)
suspending pci108e,c416@2 (aka sbbc)
suspending pci108e,1101@3,1 (aka eri)
suspending pciclass,0c0310@3,3 (aka ohci)
suspending pciclass,060400@1 (aka pci_pci)
suspending pci108e,8002@19c,700000 (aka pcisch)
suspending pci108e,8002@19c,600000 (aka pcisch)
suspending pci108e,8002@19d,700000 (aka pcisch)
suspending fp@0,0
suspending pci1077,2422@1 (aka qlc)
suspending fp@0,0
suspending pci1077,2422@1,1 (aka qlc)
suspending pci108e,8002@19d,600000 (aka pcisch)
suspending wrsm@ffff,0
suspending wrsm@100
suspending wrsm@101
suspending wrsm@102
suspending wrsm@103
suspending wrsm@104
suspending wrsm@105
suspending wrsm@106
suspending wrsm@107
suspending wrsm@108
suspending wrsm@109
suspending wrsm@110
suspending wrsm@111
suspending wrsm@112
suspending wrsm@113
suspending wrsm@114
suspending wrsm@115
suspending iosram@10,900000 (aka iosram)
suspending iosram@10,900000 (aka iosram)
suspending SUNW,axq@15e,0 (aka axq)
suspending SUNW,axq@15f,0 (aka axq)
suspending SUNW,axq@19e,0 (aka axq)
suspending SUNW,axq@19f,0 (aka axq)
resuming SUNW,axq@19f,0 (aka axq)
resuming SUNW,axq@19e,0 (aka axq)
resuming SUNW,axq@15f,0 (aka axq)
resuming SUNW,axq@15e,0 (aka axq)
resuming iosram@10,900000 (aka iosram)
resuming iosram@10,900000 (aka iosram)
resuming wrsm@115
resuming wrsm@114
resuming wrsm@113
resuming wrsm@112
resuming wrsm@111
resuming wrsm@110
resuming wrsm@109
resuming wrsm@108
resuming wrsm@107
resuming wrsm@106
resuming wrsm@105
resuming wrsm@102
resuming wrsm@101
resuming wrsm@100
resuming wrsm@ffff,0
resuming pci108e,8002@19d,600000 (aka pcisch)
resuming pci1077,2422@1,1 (aka qlc)
resuming fp@0,0
resuming pci1077,2422@1 (aka qlc)
resuming fp@0,0
resuming pci108e,8002@19d,700000 (aka pcisch)
resuming pci108e,8002@19c,600000 (aka pcisch)
resuming pci108e,8002@19c,700000 (aka pcisch)
resuming pciclass,060400@1 (aka pci_pci)
resuming pciclass,0c0310@3,3 (aka ohci)
resuming pci108e,1101@3,1 (aka eri)
resuming pci108e,c416@2 (aka sbbc)
resuming memory-controller@183,400000 (aka mc-us3)
resuming memory-controller@182,400000 (aka mc-us3)
resuming memory-controller@181,400000 (aka mc-us3)
resuming memory-controller@180,400000 (aka mc-us3)
resuming pci108e,8002@15d,600000 (aka pcisch)
resuming pci1077,2422@1,1 (aka qlc)
resuming fp@0,0
resuming scsiclass,01@w500507630f415642,0 (aka st)
resuming scsiclass,01@w500507630f415641,0 (aka st)
resuming scsiclass,01@w500507630f415631,0 (aka st)
resuming scsiclass,01@w500507630f415645,0 (aka st)
resuming scsiclass,01@w500507630f415633,0 (aka st)
resuming scsiclass,01@w500507630f415644,0 (aka st)
resuming scsiclass,01@w500507630f415634,0 (aka st)
resuming scsiclass,01@w500507630f415643,0 (aka st)
resuming pci1077,2422@1 (aka qlc)
resuming fp@0,0
resuming pci108e,8002@15d,700000 (aka pcisch)
resuming pciclass,060400@1 (aka pci_pci)
resuming pci100b,35@3 (aka ce)
resuming pci100b,35@2 (aka ce)
resuming pci100b,35@1 (aka ce)
resuming pci100b,35@0 (aka ce)
resuming pci108e,8002@15c,600000 (aka pcisch)
resuming pci108e,8002@15c,700000 (aka pcisch)
resuming pciclass,060400@1 (aka pci_pci)
resuming pciclass,0c0310@3,3 (aka ohci)
resuming pci108e,1101@3,1 (aka eri)
resuming pciclass,060400@1 (aka pci_pci)
resuming pci1000,b@2,1 (aka glm)
resuming pci1000,b@2 (aka glm)
resuming ses@5,0
resuming sd@b,0
resuming sd@a,0
resuming sd@9,0
resuming sd@8,0
resuming pci100b,35@1 (aka ce)
resuming pci100b,35@0 (aka ce)
Jan 9 20:33:11 psun5ads eri: SUNW,eri0 : No response from Ethernet network : Link down -- cable problem?
Jan 9 20:33:29 psun5ads eri: SUNW,eri1 : 100 Mbps half duplex link up
resuming pci108e,c416@2 (aka sbbc)
resuming memory-controller@143,400000 (aka mc-us3)
resuming memory-controller@142,400000 (aka mc-us3)
resuming memory-controller@141,400000 (aka mc-us3)
resuming memory-controller@140,400000 (aka mc-us3)
resuming scsa,00.bvhci@g60050768019901b400000000000004de (aka ssd)
resuming scsa,00.bvhci@g60050768019901b400000000000004df (aka ssd)
resuming scsa,00.bvhci@g60050768019901b400000000000004e0 (aka ssd)
resuming scsa,00.bvhci@g60050768019901b400000000000004e1 (aka ssd)
resuming scsa,00.bvhci@g60050768019901b400000000000004dd (aka ssd)
DR: resuming user threads...
Jan 9 20:33:49 psun5ads scsi: ASC: 0x29 (power on, reset, or bus reset occurred), ASCQ: 0x0, FRU: 0x0
DR: resume COMPLETED
Jan 9 20:33:57 psun5ads dman: NOTICE: dman0 Link up


Luego , desde la SC con un showboards -d F ( donde F es el dominio que le voy a sacar la SB )
SB12 On V3CPU Active Passed F

e25k-5-sc0:sms-svc:12> deleteboard SB12

disconnect SB12
disconnect SB12 done
poweroff SB12
poweroff SB12 done
SB12 successfully unassigned.
e25k-5-sc0:sms-svc:13>
showboards -d F ( recien ahora muestra la SB12 apagada y lista para ser usada o extraida )
SB12 Off V3CPU Available Unknown Isolated

jueves, 29 de diciembre de 2011

Un saludo para cerrar este año 2011

Para cerrar este año 2011, quiero mostrar un orgullo y satisfaccion personal que fue la mencion de mi blog en la web de oracle.


Favorite Bloggers of OTN Latin America


image courtesy of wikipedia
By now you've probably heard of OTN Latinoamerica, the Spanish- and Portuguese-language version of the Oracle Technology Network. It provides resources similar to those on the English-language version, but in the local languages. And it focuses on the needs of Latin America's OTN members. 
They just had an update worthy of noting: their list of favorite bloggers. It categorizes Spanish- and Portuguese-language bloggers by application and region. If you live or work in Latin America, or just want to read something in your native language. Check it out.
And, if you're interested in Oracle Solaris, be sure to check out Apuntes de Solaris, Diego Aguirre's blog. Diego brought this list of bloggers to my attention.
- Rick


La mencion de este Blog en Oracle Technology Network

http://www.oracle.com/technetwork/es/articles/servers-storage-admin/configurar-sun-cluster-3-2-rac-asm-521494-esa.html


Quiero Agradecer   por toda la ayuda y buena onda  y predisposicion a las siguientes personas:

Rick Ramsey ( un genio)
Pablo Ciccarello ( por la buena onda )
Nicolas Morono ( compañero de trinchera  )
Carlos Lazarte ( un referente en Solaris )

martes, 20 de diciembre de 2011

Migrar / Clonar disco de Sistema Operativo Solaris


Procedmiento realizado por Nicolas Morono, para migrar / clonar un solaris 10 con ufsdump | ufsrestore.
 Despues de varios intentos el resultado final es este.



bootear de cdrom o de red ( boot cdrom -s  o  boot net -s)

#con format generar los slice de los discos para el / y para el swap y crear el fs
newfs /dev/dsk/c0t8d0s0
#configurar la ip y agregar ruta para poder montar por nfs la imagen a restorear.

ifconfig ce2 10.77.100.124 netmask 255.255.255.0
route add default 10.77.100.1

mount 10.11.33.114:/BACKUPS /mnt
mount /dev/dsk/c0t8d0s0 /a
cd /a
ufsrestore -rf /mnt/exdsunp002/BARRA.DMP
#### Selectivamente modificamos los archivos de configuracion necesarios 
/mnt/etc/hosts
/mnt/etc/hostname.*
/mnt/etc/nodename
/mnt/etc/vfstab
/mnt/etc/shadow
/mnt/etc/netmasks
/mnt/etc/defaultrouter

 /a/usr/sbin/installboot /a/usr/platform/`uname -i`/lib/fs/ufs/bootblk /dev/rdsk/c0t8d0s0
cd /
umount /a

init 0

#### Aca viene lo complicado
### Booteamos en failsafe  ( Esta opcion funciona con los ultimos release de solaris 10 )
boot rootdisk -F failsafe

nos deberia de reconocer el disco y montarlo en /a

rm -rf /a/devices/*
rm -rf /a/dev/*
rm -rf /a/dev/.*

cp -p /tmp/root/etc/path_to_inst /a/etc/
devfsadm -r /a -p /a/etc/path_to_inst

init 0
boot -r

Importante: Recordar que en OBP este seteado correctamente el boot-device

jueves, 1 de diciembre de 2011

Que Servidores usan ILOM, ALOM4v, ALOM, LOM, ELOM, SP o RSC


Aca va una lista de equipos ,de un articulo tecnico de Sun, con cuales sistemas usan ILOM/ALOM4v/ALOM/LOM/ELOM/SP o RSC.


LOM
Sun Netra[TM] X1
Sun Netra[TM] T1400/1405
Sun Netra[TM] T1 AC200
Sun Netra[TM] T1 DC200
Sun Fire[TM] V100
Sun Fire[TM] V120
Sun Fire[TM] E2900
Sun Netra[TM] 20
Sun Fire[TM] V1280

ALOM
Sun Fire[TM] V125
Sun Fire[TM] V210
Sun Fire[TM] V215
Sun Fire[TM] V240
Sun Fire[TM] V245
Sun Fire[TM] V250
Sun Fire[TM] V440
Sun Fire[TM] V445

ALOM4v
Sun Fire[TM] T1000
Sun Fire[TM] T2000
Sun SPARC[TM] Enterprise T1000
Sun SPARC[TM] Enterprise T2000
Sun Netra[TM] T2000
Sun Blade[TM] T6300

ILOM
Sun Fire[TM] X4100
Sun Fire[TM] X4200
Sun Fire[TM] X4500
Sun Fire[TM] X4600
Sun Fire[TM] X4100 M2
Sun Fire[TM] X4200 M2
Sun Fire[TM] X4600 M2
Sun Blade[TM] 6000
Sun Blade[TM] 8000
Sun Netra[TM] X4200 M2
Sun SPARC[TM] Enterprise T5120
Sun SPARC[TM] Enterprise T5220
Sun Blade[TM] X6220
Sun Blade[TM] T6320

ELOM
Sun Fire[TM] X2100 M2
Sun Fire[TM] X2200 M2
Sun Blade[TM] X6250
Sun Blade[TM] X6450


SP
Sun Fire[TM] V20z
Sun Fire[TM] V40z


RSC
Sun Fire[TM] V890
Sun Fire[TM] V490
Sun Fire[TM] V880
Sun Fire[TM] V480
Sun Fire[TM] 280R
Sun Enterprise[TM] 250

viernes, 18 de noviembre de 2011

Solaris 2.6 a un Solaris 10 con container con solaris 8... Si, se puede.


Equipo Origen :
Enterprise 450 con solaris 2.6
Discos Internos
Oracle 8.1.5
Connect Direct 3303
Java 1.3

Equipo Destino :
Dominio de 25k solaris 10 release 09/10
Parches del EIS-DVD marzo 2011
Discos Internos Mirroreados con SVM
Storage Externo manejados con Veritas 5.0 Service Pack 3

Por obsolesencia de hardware y Software, tuvimos que migrar/upgradear del equipo origen (descripto mas arriba en este documento) al nuevo Hardware y Software.
Instale desde la imagen de un ufsdump deun equipo con solaris 8, una branded zone, en el equipo con la global con solaris 10.
Luego en la zona con solaris 8, pase con un ufsdump|ufsrestore remoto, pase del equipo origen a esta zona, los filesystems que contienen el motor de oracle, los datafiles y el connect direct.
Probamos levantar la base de datos, y la misma, funciono perfecto.
Probamos el Connect Direct con el mismo resultado.Antes tuve que modificarle a la zona con solaris 8, el hostid y cambiarlo por el que tenia el viejo equipo (esto es porque el Connect Direct, licencia por hostid)
El primer inconveniente que tuve, fue que el /etc/TIMEZONE estaba seteado en GMT-3 y la hora real estaba 6 horas adelantada.
Quize levantar el xntpd pero cuando se instala la braded zone, el script p2v ( physical to virtual) modifica el script de inicio del xntpd y no lo deja levantar.
Asi que fui por lo que pense que era la mejor opcion... compilarle un huso horario nuevo, con el comando /usr/sbin/zic


A continuacion, el paso a paso para la instalacion de la zona con solaris 8, el cambio de hostid, y la compilacion del nuevo huso horario.

root@GlobalZone # zonecfg -z ZONA1
ZONA1: No such zone configured
Use 'create' to begin configuring a new zone.
zonecfg:ZONA1> create -t SUNWsolaris8
zonecfg:ZONA1> set zonepath=/export/zona1
zonecfg:ZONA1> set autoboot=true
zonecfg:ZONA1> add net
zonecfg:ZONA1:net> set address=10.XX.33.90
zonecfg:ZONA1:net> set physical=ce2
zonecfg:ZONA1:net> end
zonecfg:ZONA1>
zonecfg:ZONA1> exit
solaris8_support error: The Solaris 8 Containers right-to-use package
has not been installed
ZONA1: Brand-specific error
Configuration not saved; really quit (y/[n])? y
root@GlobalZone #
*******Cuando me dio ese error le instale este paquete
root@GlobalZone # ls
SUNWs8brandk
root@GlobalZone # pkgadd -d .

The following packages are available:
 1  SUNWs8brandk     Solaris 8 Containers: solaris8 brand support RTU
                     (sparc) 11.10.0,REV=2008.09.20.18.50

Select package(s) you wish to process (or 'all' to process
all packages). (default: all) [?,??,q]:
Processing package instance from

Solaris 8 Containers: solaris8 brand support RTU(sparc) 11.10.0,REV=2008.09.20.18.50
Copyright 2008 Sun Microsystems, Inc.  All rights reserved.

Use is subject to license terms.
Using as the package base directory.
## Processing package information.
## Processing system information.
  8 package pathnames are already properly installed.
## Verifying package dependencies.
## Verifying disk space requirements.
## Checking for conflicts with packages already installed.

The following files are already installed on the system and are being
used by another package:
 /usr/share/man/man5/solaris8.5

Do you want to install these conflicting files [y,n,?,q] y
## Checking for setuid/setgid programs.

Installing Solaris 8 Containers: solaris8 brand support RTU as

## Installing part 1 of 1.
/usr/lib/brand/solaris8/files/patches/109147-44.zip
/usr/lib/brand/solaris8/files/patches/109221-01.zip
/usr/lib/brand/solaris8/files/patches/111023-03.zip
/usr/lib/brand/solaris8/files/patches/111431-01.zip
/usr/lib/brand/solaris8/files/patches/112050-04.zip
/usr/lib/brand/solaris8/files/patches/112605-04.zip
/usr/lib/brand/solaris8/files/patches/order
/usr/share/man/man5/solaris8.5
[ verifying class ]Installation of was successful.
root@GlobalZone #


y luego la volvi a crear y salio joya
root@GlobalZone # zonecfg -z ZONA1
ZONA1: No such zone configured
Use 'create' to begin configuring a new zone.
zonecfg:ZONA1> create -t SUNWsolaris8
zonecfg:ZONA1> set zonepath=/export/zona1
zonecfg:ZONA1> set autoboot=true
zonecfg:ZONA1> add net
zonecfg:ZONA1:net> set address=10.XX.33.90
zonecfg:ZONA1:net> set physical=ce2
zonecfg:ZONA1:net> end
zonecfg:ZONA1> exit
root@GlobalZone #
root@GlobalZone # zoneadm list -cv
 ID NAME             STATUS     PATH                           BRAND    IP
  0 global           running    /                              native   shared
  - ZONA1          configured /export/zona1                  solaris8 shared
root@GlobalZone # chmod 700 /export/zona1
root@GlobalZone #
root@GlobalZone # zoneadm -z ZONA1 install -p -v -a /mnt/solaris8/BARRA.DMP
     Log File: /var/tmp/ZONA1.install.9915.log
      Product: Solaris 8 Containers 1.0
    Installer: solaris8 brand installer 1.3
         Zone: ZONA1
         Path: /export/zona1
       Source: /mnt/solaris8/BARRA.DMP
   Media Type: ufsdump archive    Installing: This may take several minutes...
  Postprocess: Gathering information about zone ZONA1
  Postprocess: Creating mount points
  Postprocess: Processing /etc/system
  Postprocess: Booting zone to single user mode
  Postprocess: Applying p2v module S20_apply_patches
       S20_apply_patches:  Unpacking patch:  109147-44
       S20_apply_patches: Installing patch:  109147-44
       S20_apply_patches:  Unpacking patch:  111023-03
       S20_apply_patches: Installing patch:  111023-03
       S20_apply_patches:  Unpacking patch:  111431-01
       S20_apply_patches: Installing patch:  111431-01
       S20_apply_patches:  Unpacking patch:  112605-04
       S20_apply_patches: Installing patch:  112605-04
       S20_apply_patches:  Unpacking patch:  112050-04
       S20_apply_patches: Installing patch:  112050-04
       S20_apply_patches:  Unpacking patch:  109221-01
       S20_apply_patches: Installing patch:  109221-01
  Postprocess: Applying p2v module S31_fix_net
  Postprocess: Applying p2v module S32_fix_nfs
  Postprocess: Applying p2v module S33_fix_vfstab
  Postprocess: Applying p2v module S34_fix_inittab
  Postprocess: Applying p2v module S35_fix_crontab
  Postprocess: Applying p2v module S36_fix_pam_conf
  Postprocess: Applying p2v module S40_setup_preload
  Postprocess: Halting zone
  Postprocess: Postprocessing successful.
       Result: Postprocessing complete.
  Service Tag: Gathering information about zone ZONA1
  Service Tag: Adding service tag: urn:st:e8ea730c-8115-6af5-8e12-9590388aa6c6
  Service Tag: Operation successful.
       Result: Installation completed successfully.
     Log File: /export/zona1/root/var/log/ZONA1.install.9915.log
root@GlobalZone #
Pasos realizados para cambiar el hostid en la zona.
root@GlobalZone # zonecfg -z ZONA1
zonecfg:ZONA1> add attr
zonecfg:ZONA1:attr> set name=hostid
zonecfg:ZONA1:attr> set type=string
zonecfg:ZONA1:attr> set value=80f05bad
zonecfg:ZONA1:attr> end
zonecfg:ZONA1> exit
root@GlobalZone #

Pasos realizados para cambiar el huso horario.
1) Crear en /var/tmp el archivo newbsas con el siguiente contenido
Zone    America/Buenos_Aires    -3:00   -       ART     2011    Nov     15      00:00
                                -2:00   -       ART
2) Luego se compila el archivo
/usr/sbin/zic /var/tmp/newbsas
No requiere reboot, el cambio es instantaneo
chequeo el archivo generado por la compilacion
ls -ltr /usr/share/lib/zoneinfo/America|grep Buen

date y date -u para terminar con los chequeos
y todos contentos.