Show Notes
- Amazon Poland Store: https://www.amazon.pl/dp/149192912X?tag=9natreepoland-21
- Amazon Worldwide Store: https://global.buys.trade/Site-Reliability-Engineering%3A-How-Google-Runs-Production-Systems-Jennifer-Petoff.html
- Apple Books: https://books.apple.com/us/audiobook/site-reliability-engineering-how-google-runs-production/id1573412970?itsct=books_box_link&itscg=30200&ls=1&at=1001l3bAw&ct=9natree
- eBay: https://www.ebay.com/sch/i.html?_nkw=Site+Reliability+Engineering+How+Google+Runs+Production+Systems+Jennifer+Petoff+&mkcid=1&mkrid=711-53200-19255-0&siteid=0&campid=5339060787&customid=9natree&toolid=10001&mkevt=1
- Czytaj więcej: https://polish.9natree.com/read/149192912X/
#wskaźnikipoziomuusługSLI #celepoziomuusługSLO #budżetbłędów #ograniczanietoil #postmortemybezobwiniania #SiteReliabilityEngineering
Site Reliability Engineering: How Google Runs Production Systems to zbiór tekstów redagowany przez Betsy Beyer, Chrisa Jonesa, Jennifer Petoff i Nialla Richarda Murphy’ego, oparty na doświadczeniach zespołów Google utrzymujących wielkie usługi produkcyjne. Książka należy do literatury technicznej o niezawodności, systemach rozproszonych i organizacji pracy inżynierskiej. Jej główna teza brzmi prosto, operacje nie powinny być wyłącznie ręcznym reagowaniem na awarie, lecz problemem rozwiązywanym metodami inżynierii oprogramowania. Autorzy pokazują, jak łączyć szybkie wdrażanie zmian z mierzalną odpowiedzialnością za dostępność i jakość usług. Omawiają między innymi wskaźniki poziomu usług, cele niezawodności, budżety błędów, monitoring, dyżury, zarządzanie incydentami, planowanie pojemności oraz automatyzację powtarzalnych działań. Nie jest to podręcznik jednego narzędzia ani uniwersalna recepta dla każdej firmy. To raczej opis sposobu myślenia, w którym niezawodność jest świadomie projektowana, mierzona i stale ulepszana. Książka wyjaśnia również, dlaczego kultura pracy, podział odpowiedzialności oraz uczenie się po błędach są równie ważne jak infrastruktura.