DigitableCourses
Настройки портала
Показать возможности портала

Локально и без аккаунта. Аккаунта нет, регистрация не нужна: введённое в инструменты остаётся в localStorage браузера и на сервер не уходит.

Свой счётчик считает открытия страниц и дочитывания: уезжает адрес и десятая доля текста. Без cookies и чужих счётчиков, IP не хранится, Do Not Track уважается. Как это проверить

Репозиторий портала не выложен, «открытым кодом» мы его не зовём. Открыто это:

Живёт портал на донатах, платных консультациях и разборах по запросу и покупке Workbench.

Планов делать курсы платными нет.

База знаний

Тема: sre

19 материалов в этой теме.

Материалы

12 на странице
Статья

Устойчивость: circuit breaker, retry, bulkhead, backpressure, деградация

Как проектировать систему, которая переживает отказ своих зависимостей: таймауты и бюджеты дедлайнов, ретраи без лавины, размыкатели, переборки, обратное давление, …

#архитектура#устойчивость#отказоустойчивость
26 мин
Статья

Рутина и автоматизация: что автоматизировать, а что убрать

Рутина как измеримая величина, а не жалоба: журнал операций, арифметика окупаемости автоматизации, лестница «убрать — упростить — автоматизировать», ограничители радиуса …

#надёжность#sre#автоматизация
25 мин
Статья

Реакция на инцидент: роли, связь, первые действия

Инцидент — это не «все побежали чинить», а координация: кто командует, кто чинит, кто пишет наружу, почему митигация идёт раньше диагностики и во что процесс обходится …

#надёжность#sre#инциденты
31 мин
Статья

Проверка отказом: учения, chaos-эксперименты, game day

Резерв, фолбэк и рунбук — это гипотезы, пока их не активировали специально: арифметика латентного дефекта, расчёт радиуса поражения в единицах бюджета ошибок, устройство …

#надёжность#sre#chaos-engineering
29 мин
Статья

Надёжность, доступность и отказоустойчивость: что чем меряют

Три слова, которые в разговорах об эксплуатации подменяют друг друга, и честная арифметика за ними: сколько минут даёт каждая девятка, как доступности складываются в …

#надёжность#sre#доступность
28 мин
Статья

Наблюдаемость и дежурства: метрики, логи, трейсы, алерты, SLO и постмортемы

Как устроены три сигнала телеметрии, сколько на самом деле стоит их хранить, как считать SLO и настраивать алерты по скорости сжигания бюджета, и как построить дежурство, …

#devops#наблюдаемость#мониторинг
27 мин
Статья

Как ломаются распределённые системы: каскады и насыщение

Каталог механик отказа, которые не выводятся из поломки отдельного компонента: насыщение пулов и очередей, усиление повторами, метастабильность с гистерезисом, серые …

#надёжность#sre#распределённые системы
25 мин
Статья

Дежурство: расписание, эскалация и цена для людей

Дежурство как инженерный контракт: сколько людей нужно на 168 часов в неделю, почему таймаут эскалации — это статья расхода бюджета ошибок, во что обходится прерванный …

#надёжность#sre#дежурство
32 мин
Статья

Геораспределённая архитектура: регионы, ячейки, failover и аварийное восстановление

Что на самом деле означает «второй регион»: три разные задачи под одним словом, RTO и RPO как проектные входы, четыре топологии данных, ячеистая архитектура и радиус …

#архитектура#отказоустойчивость#мультирегион
29 мин