LINUX.ORG.RU
ФорумTalks

Сервер uptime 1888 days ≈ 5 лет и 2 месяца

 , ,


0

1

Сейчас на одном стареньком сервере (крутит сайты) заметил дикий аптайм -

uptime
 21:06:49 up 1888 days, 11:59, 23 users,  load average: 1.79, 1.51, 1.32

cat /etc/os-release
PRETTY_NAME="Debian GNU/Linux 10 (buster)"

uname -r
4.19.0-16-amd64


who -b
         system boot  2021-07-15 09:07

Собираюсь его дропать, т.к. есть ощущение, что перезагрузку он может не пережить =)

★★★★★

Последнее исправление: pi11 (всего исправлений: 1)

есть ощущение, что перезагрузку он может не пережить

Когда кажется - креститься надо. Как раз у таких систем никаких проблем с перезагрузками обычно и не бывает.

Обновляторы ради обновляторства, едрить. Выжигать эту заразу надо калёным железом. Работает - не трогай.

Stanson ★★★★★
()
Ответ на: комментарий от Camel

Что, простите, собираетесь?

дропать

pi11 ★★★★★
() автор топика
Ответ на: комментарий от Stanson

Работает - не трогай.

Там уже железо устарело (по цене сколько в месяц плачу за него), так что в любом случае буду дропать.

pi11 ★★★★★
() автор топика

Норм, у меня что-то около 1000 дней бывало думаю.

firkax ★★★★★
()
Ответ на: комментарий от pi11

Там уже железо устарело (по цене сколько в месяц плачу за него)

А, так это не твоё железо, а какой-то хостинг, да ещё и виртуалка, поди? С этого и надо было начинать.

Stanson ★★★★★
()
Ответ на: комментарий от Stanson

Арендованный, но физический сервак

pi11 ★★★★★
() автор топика

перезагрузку он может не пережить

да как нефиг делать это ж дебиан - там все железобетонно

amd_amd ★★★★★
()

О, хвастовство в духе «смотрите, у меня в системе все 0day-уязвимости за 5 лет, налетай!»

Думал, в 2026 такого уже не увидеть. Прикольно

CrX ★★★★★
()
Последнее исправление: CrX (всего исправлений: 1)
Ответ на: комментарий от amd_amd

да как нефиг делать это ж дебиан - там все железобетонно

вопрос же не в дебиане, а в железке

pekmop1024 ★★★★★
()

Был у меня похожий сервер в нулевых. На FreeBSD 5-сколько-то(достался в наследство от предыдущего админа). Управлял модемным пулом и не ребутался лет пять. А потом мы решили его почистить и оказалось, что у него уже давно сдох винт и оно всё работало исключительно в оперативе. :)

shell-script ★★★★★
()

Ужасно.

Сработал синдром неуловимого Джо, тебе очень повезло.

Dimez ★★★★★
()
Ответ на: комментарий от Stanson

Обновляторы ради обновляторства, едрить. Выжигать эту заразу надо калёным железом. Работает - не трогай.

Принцип «работает - не трогай» это деградация и старость.

Во-первых, сервера надо перегружать иногда для профилактики и проверки, не сдохнут ли (а они часто дохнут именно при перезагрузке), ибо при аварийном отключении питания у тебя и так будет жопа гореть, а так ещё будет гореть дополнительно от неподнявшегося сервера.

Во-вторых, уязвимости ядра и libc никто никуда не девал.

Dimez ★★★★★
()

«Работает? Не лезь!» ©

sparkie ★★★★★
()
Ответ на: комментарий от Dimez

Для тех мест, где оно на улицу торчит, есть различные вариант лайв-патчинга вроде kernelcare/libcare, без ребута. Потому что, например, брокеры кафки с десятками терабайт реплик в каждом перезагружать очень больно, даже если у тебя их в кластере сорок штук.

pekmop1024 ★★★★★
()
Ответ на: комментарий от pekmop1024

Это особенные случаи, у которых особенные решения. Всё равно сервера рано или поздно дохнут. Очень хорошо и приятно, когда они дохнут предсказуемо и в то время, когда, условно говоря, минимальная нагрузка/повышенное резервирование/etc.

Dimez ★★★★★
()
Ответ на: комментарий от sparkie

Не. Именно деградация («и так сойдёт») и старость.

Dimez ★★★★★
()

Ineffa /var/log/smart # for i in `echo a b c d`; do smartctl -a /dev/sd$i |grep Power_On_Hours ; done
9 Power_On_Hours 0x0012 089 089 000 Old_age Always - 78221
9 Power_On_Hours 0x0032 100 100 000 Old_age Always - 14233
9 Power_On_Hours 0x0012 087 087 000 Old_age Always - 93413
9 Power_On_Hours 0x0032 058 058 000 Old_age Always - 31290


10 лет аптайма.

PS: И в отличие от окаменелого Дебиана, на этом стоит свежий Gentoo

Sylvia ★★★★★
()
Последнее исправление: Sylvia (всего исправлений: 1)
Ответ на: комментарий от Dimez

У таких кластеров не бывает «минимальной нагрузки» или «повышенного резервирования», потеря брокеров приводит только к заметной деградации производительности на время ребаланса, который может идти часы, если данные много. Вот потому там ребуты ради ребутов никому не нужны и используется лайв-патчинг.

pekmop1024 ★★★★★
()
Ответ на: комментарий от Sylvia

smartctl -a /dev/sd$i |grep Power_On_Hours ; done

А аптайм тут причём?

Это не аптайм, это сколько они всего проработали, хоть с перезагрузкой каждый час…

Такого добра и у меня хватает:

for i in /dev/sd?; do sudo smartctl -a "$i" | grep Power_On_Hours; done
  9 Power_On_Hours          0x0032   032   032   000    Old_age   Always       -       27534
  9 Power_On_Hours          0x0032   083   011   000    Old_age   Always       -       15295
  9 Power_On_Hours          0x0032   001   001   000    Old_age   Always       -       98345
  9 Power_On_Hours          0x0012   100   100   000    Old_age   Always       -       20000
  9 Power_On_Hours          0x0032   040   040   000    Old_age   Always       -       53144 
  9 Power_On_Hours          0x0032   001   001   000    Old_age   Always       -       109468
  9 Power_On_Hours          0x0032   001   001   000    Old_age   Always       -       74123
  9 Power_On_Hours          0x0032   072   072   000    Old_age   Always       -       25237

12.5 лет самый старый, получается, отпахал. Но именно аптайм тут ни причём.

P.S. Тот, что 20000, он уже несколько лет так. Это SSD на 60 ГБ от Smartbuy. Они додумались залочить этот счётчик на 20000 максимуме, хех. На самом деле он, насколько я понимаю, тоже где-то чуть за 50к часов отпахал.

CrX ★★★★★
()
Последнее исправление: CrX (всего исправлений: 2)
Ответ на: комментарий от pekmop1024

минимальной нагрузки

Даже не выходных?

потеря брокеров приводит только к заметной деградации производительности на время ребаланса

Ок, у тебя непредсказуемо сдох сервер, заметная деградация всё равно есть.

Dimez ★★★★★
()
Последнее исправление: Dimez (всего исправлений: 1)
Ответ на: комментарий от CrX

ну ТС зачем-то хвастается поставленным в уголок и нетрогаемым всего лишь 5 лет сервером,
у многих хватает «добра» честно отработавшего и по 10 лет, но при этом актуального и используемого.

Sylvia ★★★★★
()
Ответ на: комментарий от Dimez

Ну видимо сдохший раз в 10 лет сервер даст проседание 1 раз в 10 лет, а если его ребутать каждый год для проверки - то за 10 лет будет 10 проседаний. Или 120 если раз в месяц.

firkax ★★★★★
()
Ответ на: комментарий от Sylvia

10 лет аптайма.

Но не у всех компонентов, хехе. Второй винт молодой еще.

thesis ★★★★★
()
Ответ на: комментарий от Dimez

Даже не выходных?

Когда ты держишь 15% рынка онлайн-рекламы, у тебя выходных не бывает.

Ок, у тебя непредсказуемо сдох сервер, заметная деградация всё равно есть.

Это дешевле, чем периодические ребуты. Ынтерпрайз-класс не дохнет просто так, а там DL380 Gen10 и DL385 Gen10 Plus (уже наверное и новее есть, я давно не там).

pekmop1024 ★★★★★
()
Ответ на: комментарий от Sylvia

И что, у меня в прошлом году сдох винт, который с 2010 непрерывно практически работал.

ptah_alexs ★★★★★
()
Ответ на: комментарий от pekmop1024

Ынтерпрайз-класс не дохнет просто так

Шутку понял, смешно :-))

Dimez ★★★★★
()
Ответ на: комментарий от Dimez

Принцип «работает - не трогай» это деградация и старость.

Вот только в 99.99% случаев, когда поторогают и избавятся от «деградации и старости», заменив её на «модно и мододёжно», работать оно перестаёт, а когда будет запинано до подобия работы, непременно окажется что оно жрёт в несколько раз больше, чем жрала «деградация и старость». :)

Во-первых, сервера надо перегружать иногда для профилактики и проверки,

Нет, не нужно. Линукс же не венда, которая гарантированно объедается кексов если её не перезагружать периодически.

не сдохнут ли (а они часто дохнут именно при перезагрузке),

Нет, они часто дохнут при включении питания. Причём сервак с дохлым БП может перезагружаться 100500 раз без малейших проблем, а вот именно после отключения питания он перестаёт запускаться вообще.

ибо при аварийном отключении питания у тебя и так будет жопа гореть, а так ещё будет гореть дополнительно от неподнявшегося сервера.

При перезагрузке питание не пропадает и БП не отключается. Поэтому если перезагрузка произошла успешно, это совершенно не значит, что сервак запустится после «аварийного отключения питания».

Видишь - ты даже не в курсе такой элементарщины как работает перезагрузка, и чем она отличается от пропадания питания, и не в курсе, что линукс не требуется перезагружать периодически как венду. Но тем не менее, зачем-то даёшь советы и что-то там про «деградацию и старость» наяриваешь.

Что-то менять надо только если для этого есть реальная и весомая причина. «Изменения ради изменений» такой причиной вообще ни разу не являются. И это как раз «изменения ради изменений» и есть самая натуральная деградация. Посмотри вокруг - ты легко увидишь эту деградацию практически везде, от автомобилей и самолётов до тех же самых серверов и ОС.

Stanson ★★★★★
()
Ответ на: комментарий от pekmop1024

Я кстати как-то одну свою гуи-прогу патчил отладчиком, чтобы не разрывать нужные уже установленные ей tcp-соединения в интернет.

firkax ★★★★★
()
Ответ на: комментарий от Stanson

Вот только в 99.99% случаев, когда поторогают и избавятся от

И вот вместо нормального разговора начинается гадание на кофейной гуще.

Нет, не нужно. Линукс же не венда

Причём тут линукс, венда, я про железо говорю.

Нет, они часто дохнут при включении питания.

Да, И при включении И при перезагрузке. При включении по одной причине, при перезагрузке по других.

Dimez ★★★★★
()
Ответ на: комментарий от Dimez

Ну кстати проблемы от холодной загрузки я встречал заметно чаще чем от ребута. От ребута это скорее всего ошибки настройки даже а не сломанное железо. А чтобы именно железо горячий ребут не пережило - даже не помню, было или нет. Вот выше кто-то пишет что у него диск в сервере умер и сервер в оперативке жил пока его не потрогали - только такое на ум и приходит (но современные линуксы так не умеют, мне кажется).

firkax ★★★★★
()
Ответ на: комментарий от Stanson

Причём сервак с дохлым БП может перезагружаться 100500 раз без малейших проблем, а вот именно после отключения питания он перестаёт запускаться вообще.

хыхы. синдром высохших электролитов чувствую я в этом !! (с) йода…
пока электролиты «горячие» их емкость еще достаточна для работы схем. при перезагрузке они «остывают», параметры питания выходят за пределы нормы, и специяльна микросхемка в БП перестает выдавать защитный сигнал PowerGood.
это надо менять, а не некрофильcтвовать пока труп в пепел не рассыпется….

реальная и весомая причина называется «техническое обслуживание» железяки, оно должно быть не только на бумаге, но и в башке разумного пользователя железяк. а некрофилия это совсем из другой йоперы.

pfg ★★★★★
()
Последнее исправление: pfg (всего исправлений: 1)
Ответ на: комментарий от firkax

Ну кстати проблемы от холодной загрузки я встречал заметно чаще чем от ребута.

Что естественно, ибо сервера остывают, БП остывают, характеристики компонентов уезжают.

А чтобы именно железо горячий ребут не пережило - даже не помню, было или нет.

Тоже бывает. Буквально в этом году у меня было такое в последний раз.

Dimez ★★★★★
()
Ответ на: комментарий от pfg

Мне казалось там дело ещё в том что дежурное 5V, нужное для старта, делается отдельной схемой, которая при штатной работе компа вроде как не требуется вообще, и пока холодный старт не сделаешь не узнаешь живая ли она.

firkax ★★★★★
()
Ответ на: комментарий от CrX

У меня был случай, правда давно уже, когда в качестве почтового сервера крутилась Фря, с похожим аптаймом.

sparkie ★★★★★
()
Ответ на: комментарий от shell-script

У меня тоже как минимум один сервак в оперативке крутился, но мне кажется что всё-таки их больше одного было :)

anc ★★★★★
()
Ответ на: комментарий от Dimez

ибо при аварийном отключении питания у тебя и так будет жопа гореть

Почему при аварийном отключении жопа должна гореть?

anc ★★★★★
()
Ответ на: комментарий от pfg

Да, электролиты в БП бывает высыхают.

Но ты же в курсе, что в нормальных серверах 2 БП, и их можно по-отдельности менять без отключения и перезагрузки сервака, если есть сомнения или регламентом положено?

реальная и весомая причина называется «техническое обслуживание» железяки, оно должно быть не только на бумаге, но и в башке разумного пользователя железяк.

Так и есть.

а некрофилия это совсем из другой йоперы.

Некрофилия - это когда пытаются ядро Linux 6.х и последный хром запустить на i486 с 32Мб памяти.

Stanson ★★★★★
()
Ответ на: комментарий от Sylvia

С каких пор Power_On_Hours харда стал показывать аптайм системы?

anc ★★★★★
()
Вы не можете добавлять комментарии в эту тему: только для зарегистрированных, score>=50.