> Когда я заменяю системный диск ... Это все выливается самое большое в 1 час простоя
А я вообще выдергиваю засбоивший винт, на его место контроллер автоматически поднимает hot spare и делает синхронизацию, затем втыкаю новый винт и с помощью софта контроллера объявляю hot spare'ом его, и не получаю никакого простоя совсем, и что с того?
Нет никакой разницы, какой коэффициент доступности у LOR'а: есть он, нет ли его - все равно хозяин сервера на этом никаких денег не теряет, и спокойно может отвести его в даун на столько, на сколько сочтет нужным.
>А я вообще выдергиваю засбоивший винт, на его место контроллер автоматически поднимает hot spare и делает синхронизацию, затем втыкаю новый винт и с помощью софта контроллера объявляю hot spare'ом его, и не получаю никакого простоя совсем, и что с того?
Наверное, все-таки при сбое винта контроллер заюзывает хотспаре, а система тебе об этом сообщает и тогда уже физически меняется винт и контроллеру отдается команда, что новый винт хотспаре.
Вроде порядок такой :-)
> Наверное, все-таки при сбое винта контроллер заюзывает хотспаре
Винт совсем не обязательно имеет состояния только offline, online или hotspare :-) Он еще может быть degrading, например - что совсем не обязательно означает его увод в offline...
2no-dashi (*) (28.07.2005 14:03:58)
>Винт совсем не обязательно имеет состояния только offline, online или hotspare :-) Он еще может быть degrading, например - что совсем не обязательно означает его увод в offline...
Ну это уже как контроллер настроишь :-) Для критически важных данных (вроде базы сообщений анонимусов) IMHO нужно ставить режим "чуть шо, ховайся, ибо нефиг", а то анонимусы загрызут, они такие :-)
> Нет никакой разницы, какой коэффициент доступности у LOR'а: есть он, нет ли его - все равно хозяин сервера на этом никаких денег не теряет, и спокойно может отвести его в даун на столько, на сколько сочтет нужным.
Деньги тут не причём. Просто данный простой был слишком большим, неоправданно большим.
Конечно знаю, если бы там было в 3 раза более дорогое железо с горячей заменой SCSI дисков в RAID массиве с зеркалированием и чредованием, да в 2х экземплярах, да база данных на отдельном железе, то простоя вообще бы не было. А после общения с такими [грбое ругательство] как bbk123, вообще не понятно, зачем было его поднимать. Может bbk123 скинется с парой анонимусов и купят нам пару Proliant DL760, или заткнутся?
>Какие тут все умные и умелые, прямо страшно становится.
Самые умные тут анонимусы :-)
Кстати, простой 20 часов в год (или сколько там без перезагрузок) и то по причине сбоя железа для некоммерческого интернет-сервера (всего один баннер :-)) это хороший кляп для визжащих о нестабильности Linux :-)
отстой честно говоря, никакого "чувства прекрастного" при взгляде на эту коробку из под обуви у меня лично не возникает.
Неудержусь похвастаться ;) - для славнения мой комп, на котором кроме всего прочего я храню почти все свои кины. Debian GNU Linux (Sarge) (фотка немного устарела, сейчас у него уже новый медный кулер и честный БП)
Клава на удлинителе и 19'' монитор есть, звук тоже, одним эзернетом он в сеть домашних компов смотрит, другим в впн моего района + на мою работу. Мышка, флоппик, оптический привод мне как-то не нужны. Так что на таком компе можно прекрастно и отдыхать и работать :)
Пиво не пью, стремянки не имею ;) Не страшно, он в нише образовавшейся между двумя шкафами повешен, да и еще все это находиться за монитором передвигающимся по комнате на основании офисного стула с колесиками :)
> Ты можешь попросить их об этом рассказать. Без вызывов и обвинений в непрофессионализме.
Перечитай это обсуждение, вмести с удалёнными сообщениями, ещё раз. Если заданных тут вопросов мало или если ты найдёшь мои обвинения кого-то в непрофессионализме, то я сдаюсь. Не считай за наезд, но у тебя действительно очень странная реакция.
Тебе никто ничего не должен. Сервер работал года 2 или 3 даже 24х7 на самом обычном железе. После поломки на нем переставили вообще все, не торопясь никуда, причем большая чать простоя пришлась на ночь. Green из Симферополя приехал специально только для этого. И ты весь в претензиях. Нету spare оборудования, понимаешь? И никто себе задачь покорения сердца bbk123 не ставит.
Я и не говорил, что мне кто-то должен. Мне только не понятно, чего ты встрял в разгвор если сказать по сути ничего не можешь? К чему все эти твои пыхтения и удаления сообщений?
Влез как раз ты. По сути я сказал все, что надо было сказать. Про неоправданно большое время простоя - это твои слова. Вот и рассказал бы нам, чем именно оно не оправдано.
А вот по моему опыту - основной расходный материал в однопроцессорных машинах в режиме 24/7/365 - блоки питания и бесперебойники!
У меня был прецедент: машина пошла на пост-400 дневный аптайм, я задел UPS, дернул шнур питания, ведущий к блоку и опа! больше блок не завелся. :О
По сути, что тут делалось в течении 20 часов, ты практически ничего толкового до сих пор не сказал. А про неоправданно большое время простоя я говорил не тебе. Если хочешь об этом подискутировать, то дождись пока Макс и Грин придут и расскажут что они делали. Это будет гораздо полезнее твоих пыхтений и обид.
В 34 раз повторяю, что в течение этих 20 часов был заменен хард, переставлен софт и выпито пиво. Никто никуда не спешил и время работы над проблемой меньше времени простоя.
кстати, одно время на сайте висело явно что-то очень старое. И там были ещё доcтупны /hum и ещё чего-то. А я чего-то стормозил и не посмотрел чего там. Через полчаса зашёл и увидел servlet error...
Зачем в этой теме такие разборки? Люди сделали свое дело, не спеша, не гоняясь за баблом. Результаты: сервер на ходу, сайт в онлайне. За что этим людям человеческое спасибо.
Спасибо за отличный сервер: много хорошей инфы и просто есть что почитать. Я захожу раз в 1-2 дня - так что даже не заметил простоя. Для фришного проекта - просто неверояная оперативность. А то что здесь не все благодарят, думаю, даже хорошо: это, по-моему, свидетельствует о реальной популярности и востребованности сайта.
>Когда я заменяю системный диск, я сначала ставлю все на другой машине, подцепляю конфиги и скрипты, потом вечером ставлю на основную, компилю ядро под железо сервака и проверяю. Это все выливается самое большое в 1 час простоя, 20 часов это явный непроффесионализм.
cp -a /usr /opt/usr mv /usr /old_usr ln -s /opt/usr /usr (примем /dev/sda4 ecть /dev\/sda4 .... и вряд ли больше 1GB) sed "s/^\/dev\/sda4/#\/dev\/sda4/g" /etc/fstab > tmp | mv tmp /etc/fstab halt Замена диска старт mount /dev/sda4 /old_usr mkreiserfs --format 3.6 /dev/sda4 cp -a /opt/usr /old_usr mv /old_usr /usr sed "s/^#\/dev\/sda4/\/dev\/sda4/g" /etc/fstab > tmp | mv tmp /etc/fstab
Начиная с этого момента. /usr -- накрылся, стоит ли его пытаться копировать? Кроме того, по случаю слетевшего рута решили обновить OS, почему бы и нет?