خاموشی چندساعته Namecheap؛ نقص خنک کننده ای که حسابی کاربران را عصبانی کرد
اختلال نام چیپ برای چند ساعت دسترسی بخشی از مشتریان به سرویس های این شرکت را مختل کرد. ماجرا از یک خرابی دیتاسنتر و از کار افتادن سیستم خنک کننده شروع شد؛ اتفاقی که سرویس های میزبانی، پنل های مدیریتی و برخی خدمات آنلاین Namecheap را تحت تأثیر قرار داد و صدای کاربران را در شبکه های اجتماعی درآورد.
این قطعی حدود چهار ساعت ادامه داشت و خیلی ها نمی توانستند به سرویس های مورد نیازشان دسترسی پیدا کنند. برای کسب وکارهایی که وب سایت، دامنه یا خدمات آنلاینشان را با نام چیپ مدیریت می کنند، چهار ساعت اصلاً زمان کمی نیست؛ مخصوصاً وقتی هر دقیقه آفلاین بودن می تواند به معنی از دست رفتن مشتری و درآمد باشد.
مطالعه مقاله قبلی در دسته بندی بازی و سرگرمی با عنوان تاریخ انتشار دی ال سی بازی Crimson Desert در سال جاری.
خرابی سیستم خنک کننده، عامل اصلی قطعی
طبق توضیحی که Namecheap منتشر کرد، مشکل اصلی به نقص تجهیزات سرمایشی در دیتاسنتر برمی گشت. با افزایش دمای محیط، برخی زیرساخت ها برای جلوگیری از صدمه جدی تر از دسترس خارج شدند. ظاهراً سیستم های پشتیبان هم نتوانستند شرایط را آن طور که باید کنترل کنند و همین موضوع قطعی را طولانی تر کرد.
در دیتاسنترها کنترل دما شوخی بردار نیست. سرورها به صورت شبانه روزی کار می کنند و گرمای زیادی تولید می شود. اگر سیستم خنک کننده دیتاسنتر از کار بیفتد، بالا رفتن دما می تواند به تجهیزات آسیب بزند یا حتی باعث خاموشی گسترده سرورها شود. اینجا هم تیم فنی مجبور شد بین ادامه فعالیت و خطر آسیب سخت افزاری، گزینه امن تر را انتخاب کند.
Namecheap در پیام عذرخواهی خود خیلی مستقیم گفت که «امروز شما را ناامید کردیم». شرکت مسئولیت اتفاق را پذیرفت و اعلام کرد تیم های فنی برای بازگرداندن سرویس ها مشغول کار شده اند. این مدل عذرخواهی صریح قابل توجه بود، اما خب برای کاربری که چند ساعت به سرویسش دسترسی نداشته، یک جمله عذرخواهی به تنهایی کافی نیست.
کاربران نام چیپ حسابی شاکی شدند
هم زمان با ادامه اختلال نام چیپ، کاربران ناراضی به شبکه های اجتماعی رفتند و از نبود دسترسی، اطلاع رسانی کند و طولانی شدن روند بازیابی سرویس ها گلایه کردند. بعضی مشتریان می گفتند علاوه بر وب سایت، امکان مدیریت حساب یا بررسی دامنه هایشان را هم نداشتند.
بخش دیگری از اعتراض ها به وابستگی سرویس های مختلف به یک مرکز داده مربوط بود. وقتی یک نقص فنی در سیستم سرمایشی بتواند چند سرویس را هم زمان زمین گیر کند، سؤال مهمی درباره میزان افزونگی زیرساخت ها مطرح می شود. کاربران انتظار دارند شرکتی در اندازه Namecheap برای چنین سناریوهایی برنامه جایگزین فوری داشته باشد.
البته وجود تجهیزات پشتیبان همیشه به معنی مصونیت کامل نیست. ممکن است خرابی اصلی، سیستم جایگزین را هم تحت فشار قرار دهد یا جابه جایی بار میان مراکز داده فوراً امکان پذیر نباشد. بااین حال، مشتریان حق دارند بدانند چرا لایه های پشتیبان نتوانستند جلوی یک قطعی چندساعته را بگیرند.
Namecheap بعد از بازگشت تدریجی خدمات تأکید کرد که وضعیت را بررسی می کند تا احتمال تکرار چنین حادثه ای کاهش پیدا کند. هنوز مهم ترین خواسته کاربران انتشار گزارشی شفاف درباره دلیل شکست تجهیزات پشتیبان و اقدام هایی است که برای مقاوم تر شدن زیرساخت انجام خواهد شد.
این اتفاق یک یادآوری جدی برای مدیران سایت ها هم هست: حتی شرکت های بزرگ میزبانی و ثبت دامنه ممکن است دچار مشکل شوند. داشتن نسخه پشتیبان مستقل، مانیتورینگ دائمی، DNS مقاوم و یک برنامه آماده برای زمان قطعی می تواند جلوی بخشی از خسارت را بگیرد.
در نهایت سرویس ها برگشتند، اما اثر این خرابی دیتاسنتر روی اعتماد مشتریان به این راحتی پاک نمی شود. حالا Namecheap باید نشان دهد عذرخواهی اش فقط یک پیام کوتاه نبوده و برای جلوگیری از تکرار چنین خاموشی دردسرسازی، تغییرات واقعی در راه است.
برای دریافت جدیدترین اخبار تکنولوژی با مجله هوش مصنوعی با ما همراه باشید
نظرات کاربران