Система сама себе поставила сто процентов. Что с этим не так?
Почему доступность меряют снаружи
Проверка, работающая на проверяемом сервере, молчит ровно тогда, когда сервер лежит, — в единственный момент, когда её показания нужны. Поэтому доступность меряется снаружи: машинами, которые к проверяемому серверу отношения не имеют.
То же самое верно и для вашей техники. Программа, следящая за сервером изнутри, не сообщит о том, что сервер выключился: сообщать в этот момент некому и нечем.
Простой считается по разрывам между пробами, а не по записям об ошибке. Упавшая машина запись «всё плохо» не примет — принимать некому. Учёт по сообщениям об отказе показывает сто процентов ровно в тот день, когда ничего не работало.
Одна пропущенная проба — ещё не простой: столько занимает перезапуск при обновлении, и объявлять сбоем каждую выкладку значило бы завышать простой. Цена этого послабления: короткий сбой на график не попадёт.
Дни, когда наблюдения не было, показаны отдельно, а не нулём. До запуска истории не существовало, и рисовать её как отказ значило бы показывать сбои, которых не случалось.

