Всем привет. Сегодня мы хотели бы поговорить про выявления аномалий в микросервисной среде. Данный пост является краткой выжимкой нашего 40 минутного доклада, который мы делали на онлайн конференции DevOps Live 2020 и, чтобы не писать лонгрид, мы решили сфокусироваться на обзоре…
Site Reliability Engineering (SRE) — это одна из форм реализации DevOps. SRE-подход возник в Google и стал популярен в среде продуктовых IT-компаний после выхода одноимённой книги в 2016 году. В статье опишем, как SRE-подход соотносится с DevOps, какие задачи решает инженер по SRE и о каких показателях заботится. Читать дальше →
Слёрм приглашает на митап «Профессия SRE: практика и мифы». Поговорим про SRE с экспертами, обсудим вопросы участников. Повестка дня: Что такое SRE и зачем все это нужно IT и бизнесу? SRE – хайп или проверенный подход? Как с этим работать? Практики SRE. Как внедрить у себя? Что нужно, чтобы стать SRE-инженером? Начало митапа: 3 ноября, вторник, 19.00 МСК. Читать дальше →
Татьяна Гребенюкова, продакт-оунер курса Слёрм «SRE: внедряем DevOps от Google», собирает интересные кейсы внедрения SRE в российских компаниях. Некоторые истории мы используем для развития курса, а другими рады поделиться со всеми.Сергей Бухаров, SRE из Dodo Engineering, рассказал историю внедрения SRE в компании, какие практики из книжек оказались неприменимы и из чего состоят будни SRE-команды. Читать далее