Вот уже почти 20 лет компания Google обеспечивает работу невообразимо сложных и масштабных систем, которые чутко реагируют на запросы пользователей. Поисковик Google находит ответ на любые вопросы за доли секунды, карты Google с высочайшей точностью отражают земной ландшафт, а почта Google доступна в режиме 365/24/7 и, в сущности, стала первым общедоступным облачным хранилищем. Неужели эти системы безупречны? Нет, они тоже отказывают, ломаются и устаревают, как любая техника. Просто мы этого не замечаем. Все дело в том, что уже более десяти лет Google нарабатывает уникальную технологию Site Reliability Engineering, обеспечивающую бесперебойную работу и поступательное развитие софтверных систем любой сложности. Эта книга - кладезь опыта, накопленного компанией Google за долгие годы, коллективный труд многих выдающихся специалистов и незаменимый ресурс для любого инженера, желающего разрабатывать и поддерживать любые продукты максимально качественно и эффективно
Опыт Google из первых рук. Книга написана самими инженерами Google и собирает более десяти лет практики построения технологии Site Reliability Engineering, обеспечивающей бесперебойную работу их систем.
Показывает изнанку сервисов, которыми пользуется весь мир. Поиск, Карты, Gmail — как эти системы на самом деле ломаются, устаревают и восстанавливаются, оставаясь незаметными для пользователя.
Практические концепции, а не только теория. SLO, бюджеты ошибок, борьба с рутиной, мониторинг по методу "золотых сигналов" — конкретные инструменты, которые можно внедрять сразу.
Задает стандарт целой профессии. Именно эта книга закрепила подход SRE как отдельную дисциплину и породила словарь терминов, которым сегодня пользуется вся индустрия эксплуатации.
Фундаментальный труд, а не поверхностный обзор. 592 страницы охватывают все — от управления рисками и автоматизации до реагирования на инциденты и построения культуры постмортемов.
Заказ обратного звонка
Спасибо за обращение!
Скоро с вами свяжется наш менеджер