Blog Spaceship

Pembaruan gangguan layanan Spaceship

Pembaruan gangguan layanan Spaceship

Pada 13 Agustus, kami mengalami gangguan layanan besar yang berdampak pada sejumlah layanan Spaceship.

Penyebabnya adalah kegagalan sistem pendingin di pusat data RadiusDC: Phoenix, yang menjadi host bagi beberapa operasi penting Spaceship. Hal ini memaksa kami menonaktifkan layanan untuk melindungi infrastruktur pelanggan dari panas berlebih dan kemungkinan kerusakan.

Semua yang terdampak oleh insiden ini kini telah dipulihkan, dan tim kami terus memantau sistem dengan saksama untuk memastikan semuanya tetap stabil.

Kami sangat menyesal atas dampaknya terhadap pelanggan yang bergantung pada kami untuk situs web, email, dan layanan online lainnya. Gangguan yang ditimbulkan oleh hal ini, serta keadaan di baliknya, ditangani dengan sangat serius.

Apa yang terjadi

Insiden ini dimulai ketika sistem pendingin gagal di pusat data Phoenix akibat badai besar, sehingga suhu di sekitar infrastruktur kami mencapai tingkat kritis.

Melanjutkan pengoperasian sistem dalam kondisi seperti itu berisiko menyebabkan peralatan mengalami panas berlebih dan kerusakan jangka panjang maupun kerusakan katastrofik. Menonaktifkan layanan menyebabkan gangguan yang signifikan, tetapi hal itu diperlukan untuk melindungi infrastruktur pelanggan kami.

Menjaga peralatan tetap offline sampai sistem pendingin kembali online juga memberi waktu bagi suhu untuk kembali ke tingkat aman sebelum pemulihan dimulai. Ini membantu menghindari timbulnya masalah tambahan yang dapat semakin memperpanjang insiden yang sudah serius.

Bagaimana pelanggan terdampak

Gangguan ini memengaruhi layanan termasuk Shared, VPS, penerusan email, dan Spacemail. Spaceship.com tetap online selama insiden berlangsung.

Berikut adalah rincian tentang bagaimana situasi ini memengaruhi produk dan layanan utama:

Operasi hosting

Akses pelanggan ke situs web dan layanan hosting terdampak, dengan banyak situs web pelanggan tidak tersedia, lambat, atau menampilkan error. Beberapa operasi penagihan juga tidak tersedia setelah sistem yang bertanggung jawab untuk memprosesnya dinonaktifkan selama insiden.

EasyWP

Dashboard EasyWP dan situs web pelanggan mengalami gangguan. Selama pemulihan, beberapa situs web pelanggan tetap tidak tersedia setelah EasyWP.com dan Dashboard dipulihkan, dengan sebagian menampilkan error koneksi database.

Spacemail

Layanan email juga mengalami gangguan. Pelanggan yang terdampak tidak dapat mengirim email, dan email masuk tidak dapat dikirimkan selama server terkait sedang offline.

Yang penting, ini tidak berarti pesan masuk otomatis hilang. Penyedia email biasanya melakukan upaya pengiriman lanjutan ketika server penerima sementara tidak tersedia. Jadi pesan akan tetap tiba, tetapi lebih lambat dari biasanya.

Bagaimana kami memulihkan layanan

RadiusDC mulai memulihkan kapasitas pendinginnya sesegera mungkin, sementara pendingin sementara dipasang dan diarahkan ke area kami di pusat data untuk membantu menurunkan suhu.

Tim kami bekerja tanpa henti di lokasi bersama RadiusDC untuk memulihkan pendinginan. Kami baru mulai mengaktifkan kembali layanan setelah suhu kembali ke tingkat operasional yang aman, dan kami yakin tidak ada risiko panas berlebih atau kerusakan jangka panjang.

Setelah kondisi operasional yang aman dipulihkan, kami memulai pemulihan terkontrol di seluruh infrastruktur kami. Ini perlu dilakukan secara bertahap, sehingga pelanggan melihat layanan yang berbeda kembali pada waktu yang berbeda.

Mengapa layanan dipulihkan secara bertahap

Skala insiden ini berarti berbagai bagian platform kami mengalami gangguan pada saat yang sama. Meskipun pelanggan mengalaminya sebagai layanan yang terpisah, insiden pusat data ini memengaruhi infrastruktur yang terlibat dalam penyediaan sejumlah layanan tersebut.

Layanan seperti hosting dan email bergantung pada berbagai lapisan teknologi, termasuk server, jaringan, penyimpanan, dan database. Memulihkannya berarti mengaktifkan kembali elemen-elemen berbeda ini dalam urutan yang tepat, bukan sekadar menyalakan semuanya sekaligus.

Apa yang terjadi selanjutnya

Kami menangani gangguan ini dan dampaknya terhadap pelanggan kami dengan sangat serius. 

Tim kami sedang melakukan peninjauan menyeluruh atas situasi ini untuk memperkuat sistem kami dan memastikan insiden serupa tidak terjadi lagi.

Kami akan sepenuhnya transparan tentang apa yang kami pelajari dan akan membagikan hasilnya kepada Anda, beserta tindakan yang kami ambil.

KOREKSI: Operator pusat data kami adalah RadiusDC, bukan PhoenixNAP seperti yang disebutkan dalam beberapa posting awal di X pada 13 Agustus. PhoenixNAP tidak terlibat dalam insiden ini.


Bagikan pemikiran Anda

Diperlukan lebih dari 10 karakter.
Identitas Anda untuk tampilan publik.
Memberikan alamat email Anda adalah opsional. Itu tidak akan dibagikan dengan pihak ketiga.

Bantu kami meningkatkan blog kami

Bagikan pemikiran Anda dalam survei singkat dua menit.

Email yang valid diperlukan