Когда команда спорит между новыми релизами и надёжностью системы, решения часто принимаются на уровне мнений. Разберём, как бюджет ошибок помогает перевести этот разговор в цифры: оценивать риски, управлять приоритетами и находить баланс между скоростью разработки и стабильностью. Читать далее
Управление обработкой ошибок в Go всегда вызывает споры — это извечная тема в ежегодном опросе о самых больших проблемах, с которыми сталкиваются разработчики при работе с Go. Однако когда дело доходит до обработки ошибок в многопоточной среде или объединения нескольких ошибок одной и той же горутины, Go предоставляет отличные пакеты, которые упрощают управление обработкой множественных ошибок. Давайте посмотрим, как объединить несколько ошибок, генерируемых одной горутиной. Читать далее
Рассказали, как мы в команде SLA учились измерять надёжность сначала отдельных микросервисов в архитектуре Авито, а затем всей системы в целом. Подробно опишем, что входит в понятие надёжности сервиса, что такое бюджет ошибок и как его считать. А в конце поделимся способами измерения надёжности, которые помогли нам сформулировать понятную и удобную в подсчётах метрику для бизнеса. Читать далее
Никто не знает, что такое время. Это понятие возникло, когда первый человек обратил внимание: мир здесь и сейчас отличается от мира тогда и там.Википедия гласит, что время — это форма протекания физических и психических процессов. Философы скажут: время — необратимый поток, направленный из прошлого в будущее. Классическая физика заканчивает спор, объявив: время — фундаментальное свойство мироздания, которое выражается ничем. Читать далее