Chaos Engineer
Kategori: Infra & Ops
Sengaja menyuntikkan kegagalan ke sistem untuk menemukan kelemahan sebelum outage sungguhan terjadi, membangun keyakinan pada resiliensi.
Sehari-hari
Merancang dan menjalankan eksperimen kegagalan, mendefinisikan metrik steady-state, mengotomasi fault injection di staging dan produksi, serta mengubah temuan jadi perbaikan reliabilitas.
Skill inti
- sistem terdistribusi
- fault injection
- observability
- analisis insiden
- otomasi
- pola resiliensi