چگونه امنیت و پایداری دیتاسنتر را افزایش دهیم؟ ۱۰ نکته مهم برای مدیران زیرساخت

محتوای جدول

دیتاسنتر را می‌توان قلب تپنده بسیاری از کسب‌وکارهای امروزی دانست. از وب‌سایت‌های فروشگاهی و سامانه‌های بانکی گرفته تا سرویس‌های ابری، نرم‌افزارهای سازمانی و پایگاه‌های داده، همگی برای عملکرد درست به زیرساختی پایدار و قابل اعتماد نیاز دارند. یک قطعی برق، افزایش بیش از حد دما، خرابی تجهیزات یا حتی ورود یک فرد غیرمجاز می‌تواند باعث اختلال جدی در سرویس‌ها و تحمیل هزینه‌های سنگین شود.

به همین دلیل، افزایش امنیت و پایداری دیتاسنتر فقط به خرید سرورهای قدرتمند یا تجهیزات گران‌قیمت محدود نمی‌شود. مجموعه‌ای از اقدامات ساده اما اصولی در حوزه برق، سرمایش، پایش، امنیت فیزیکی و نگهداری می‌تواند احتمال خرابی و توقف سرویس‌ها را تا حد زیادی کاهش دهد.

در ادامه با ۱۰ نکته کاربردی برای افزایش امنیت و پایداری دیتاسنتر آشنا می‌شویم.

۱. برق اضطراری را جدی بگیرید

یکی از مهم‌ترین تهدیدها برای هر دیتاسنتر، قطع یا نوسان برق است. حتی قطعی چند ثانیه‌ای می‌تواند باعث خاموش شدن تجهیزات، اختلال در شبکه یا آسیب به برخی سخت‌افزارها شود.

استفاده از UPS مناسب اولین قدم برای مقابله با این مشکل است. UPS در زمان قطع برق، برای مدت مشخصی انرژی موردنیاز تجهیزات را تأمین می‌کند و فرصت لازم را برای فعال شدن ژنراتور یا خاموش شدن کنترل‌شده سیستم‌ها در اختیار مدیران زیرساخت قرار می‌دهد.

البته تنها داشتن UPS کافی نیست. ظرفیت باتری‌ها باید به‌صورت دوره‌ای بررسی شود و عملکرد سیستم در شرایط شبیه‌سازی‌شده قطعی برق مورد آزمایش قرار گیرد.

در دیتاسنترهای حساس، استفاده از ژنراتور و طراحی مسیرهای برق پشتیبان نیز اهمیت زیادی دارد. هدف این است که خرابی یک بخش از سیستم برق، کل دیتاسنتر را از کار نیندازد.

۲. سیستم سرمایش را همیشه تحت کنترل داشته باشید

سرورها و تجهیزات شبکه در زمان فعالیت گرما تولید می‌کنند. اگر این گرما به‌درستی دفع نشود، دمای تجهیزات افزایش پیدا کرده و احتمال خرابی یا کاهش عمر سخت‌افزار بیشتر می‌شود.

به همین دلیل، سیستم سرمایش باید متناسب با ظرفیت دیتاسنتر طراحی شود. قرار دادن تجهیزات سرمایشی بدون توجه به محل نصب رک‌ها معمولاً نتیجه مطلوبی ندارد.

یکی از روش‌های کاربردی، طراحی مناسب مسیر ورود هوای سرد و خروج هوای گرم است. چیدمان رک‌ها نیز باید به شکلی باشد که هوای گرم و سرد تا حد امکان با یکدیگر ترکیب نشوند.

همچنین دما و رطوبت محیط باید به‌صورت مداوم پایش شوند. افزایش تدریجی دما ممکن است نشانه‌ای از مشکل در سیستم تهویه یا سرمایش باشد و اگر به‌موقع شناسایی شود، می‌توان قبل از ایجاد خسارت جدی مشکل را برطرف کرد.

۳. پایش ۲۴ ساعته را فراموش نکنید

یکی از تفاوت‌های دیتاسنتر پایدار با یک محیط معمولی، نظارت مداوم بر وضعیت تجهیزات است. مدیر زیرساخت نباید منتظر بماند تا یک سرور از کار بیفتد و سپس متوجه مشکل شود.

سیستم‌های مانیتورینگ می‌توانند وضعیت سرورها، تجهیزات شبکه، دما، رطوبت، مصرف برق، فضای ذخیره‌سازی و بسیاری از شاخص‌های دیگر را بررسی کنند.

مهم‌تر از خود پایش، هشداردهی مناسب است. برای مثال اگر دمای یک رک از مقدار مشخصی بالاتر رفت، سیستم باید به‌سرعت هشدار ارسال کند.

این موضوع باعث می‌شود بسیاری از مشکلات پیش از تبدیل شدن به بحران شناسایی شوند.

۴. امنیت فیزیکی را دست‌کم نگیرید

وقتی درباره امنیت دیتاسنتر صحبت می‌کنیم، معمولاً ذهنمان به سمت فایروال، رمز عبور و حملات سایبری می‌رود؛ اما امنیت فیزیکی نیز به همان اندازه مهم است.

دسترسی به اتاق سرورها باید محدود به افراد مجاز باشد. استفاده از کارت ورود، سیستم کنترل دسترسی، دوربین مداربسته و ثبت ورود و خروج می‌تواند سطح امنیت را افزایش دهد.

همچنین بهتر است تجهیزات حساس در محلی قرار بگیرند که افراد غیرمجاز به آن‌ها دسترسی مستقیم نداشته باشند.

یک سیاست ساده اما مهم این است که مشخص باشد چه کسی، چه زمانی و با چه هدفی وارد اتاق سرورها شده است.

۵. تجهیزات را به‌صورت منظم نگهداری کنید

بسیاری از خرابی‌ها ناگهانی به نظر می‌رسند، اما در واقع نشانه‌هایی دارند که اگر به‌موقع بررسی شوند، می‌توان از خرابی جدی جلوگیری کرد.

تمیز کردن مناسب تجهیزات، بررسی کابل‌ها، کنترل وضعیت فن‌ها، آزمایش باتری‌های UPS و بررسی عملکرد سیستم سرمایش باید بخشی از برنامه نگهداری دوره‌ای باشد.

برای هر دستگاه نیز بهتر است سوابق نگهداری ثبت شود. این اطلاعات در آینده کمک می‌کند مدیر زیرساخت بداند یک تجهیز چه زمانی سرویس شده و چه قطعاتی در آن تعویض شده‌اند.

نگهداری پیشگیرانه معمولاً هزینه بسیار کمتری نسبت به تعمیر اضطراری یا توقف سرویس دارد.

۶. از خرابی یک تجهیز نترسید؛ از وابستگی به آن بترسید

یکی از اصول مهم در طراحی زیرساخت، جلوگیری از ایجاد Single Point of Failure یا همان نقطه تک‌خرابی است.

فرض کنید تمام سرویس‌های مهم یک سازمان فقط به یک منبع برق، یک سوئیچ شبکه یا یک سیستم ذخیره‌سازی وابسته باشند. اگر همان یک تجهیز خراب شود، ممکن است کل سرویس متوقف شود.

برای کاهش این ریسک می‌توان از تجهیزات و مسیرهای پشتیبان استفاده کرد. نمونه‌های آن شامل منابع تغذیه افزونه، مسیرهای شبکه جایگزین، سیستم‌های ذخیره‌سازی دارای افزونگی و تجهیزات برق پشتیبان است.

هدف اصلی این نیست که همه چیز دو برابر خریداری شود؛ بلکه باید مشخص شود کدام بخش‌ها در صورت خرابی، بیشترین آسیب را به کسب‌وکار وارد می‌کنند.

۷. از اطلاعات نسخه پشتیبان داشته باشید

حتی بهترین دیتاسنترها نیز در برابر خرابی سخت‌افزاری، خطای انسانی یا اتفاقات پیش‌بینی‌نشده کاملاً مصون نیستند.

به همین دلیل، داشتن نسخه پشتیبان از اطلاعات حیاتی ضروری است. اما نکته مهم این است که نسخه پشتیبان نباید صرفاً روی همان زیرساخت اصلی نگهداری شود.

اگر سرور و نسخه پشتیبان هر دو در یک محل قرار داشته باشند، یک حادثه می‌تواند هر دو را تحت تأثیر قرار دهد.

برای اطلاعات مهم، بهتر است سیاست مشخصی برای تهیه، نگهداری و آزمایش Backup وجود داشته باشد. نسخه پشتیبان زمانی ارزشمند است که بتوان در زمان نیاز واقعاً آن را بازیابی کرد.

۸. شبکه و دسترسی‌ها را مدیریت کنید

هر دستگاهی که به شبکه دیتاسنتر متصل است، می‌تواند به‌عنوان یک نقطه بالقوه برای ایجاد مشکل در نظر گرفته شود. بنابراین دسترسی کاربران و تجهیزات باید تا حد امکان کنترل شود.

تقسیم‌بندی شبکه، محدود کردن دسترسی‌ها، استفاده از رمزهای عبور مناسب و حذف حساب‌های کاربری غیرضروری از اقدامات ساده اما مؤثر هستند.

همچنین مدیران زیرساخت باید بدانند چه تجهیزاتی در شبکه وجود دارند و هرکدام چه نقشی دارند. وجود تجهیزات ناشناخته یا قدیمی در شبکه می‌تواند ریسک امنیتی ایجاد کند.

۹. برای شرایط اضطراری برنامه داشته باشید

یکی از اشتباهات رایج این است که سازمان‌ها فقط در زمان وقوع بحران به فکر راهکار باشند.

بهتر است از قبل مشخص شود اگر برق قطع شد، سیستم سرمایش از کار افتاد، یک سرور اصلی خراب شد یا ارتباط شبکه دچار مشکل شد، چه کسی باید چه کاری انجام دهد.

یک برنامه Disaster Recovery مناسب باید شامل مسئولیت افراد، روش‌های ارتباطی، اولویت سرویس‌ها و مراحل بازگردانی سیستم‌ها باشد.

اجرای مانورهای دوره‌ای نیز اهمیت زیادی دارد. اگر برنامه‌ای فقط روی کاغذ وجود داشته باشد اما در عمل آزمایش نشده باشد، نمی‌توان از عملکرد صحیح آن در شرایط واقعی مطمئن بود.

۱۰. همه‌چیز را مستندسازی کنید

آخرین نکته شاید ساده به نظر برسد، اما در مدیریت دیتاسنتر اهمیت زیادی دارد.

اطلاعات مربوط به رک‌ها، سرورها، تجهیزات شبکه، آدرس‌های IP، اتصالات، تنظیمات مهم، فرآیندهای نگهداری و اطلاعات تماس افراد مسئول باید مستند باشند.

مستندسازی باعث می‌شود وابستگی سازمان به یک فرد خاص کاهش پیدا کند. اگر یکی از اعضای تیم در دسترس نباشد، سایر افراد می‌توانند بر اساس مستندات موجود مشکل را بررسی کنند.

بهتر است مستندات نیز مانند تجهیزات، به‌صورت دوره‌ای به‌روزرسانی شوند؛ زیرا اطلاعات قدیمی گاهی از نداشتن اطلاعات هم خطرناک‌تر هستند.

جمع‌بندی

افزایش امنیت و پایداری دیتاسنتر الزاماً به معنای صرف هزینه‌های بسیار زیاد نیست. در بسیاری از موارد، پایش مداوم، نگهداری منظم، برق اضطراری مناسب، سرمایش استاندارد، کنترل دسترسی و داشتن برنامه پشتیبان می‌تواند تفاوت بزرگی ایجاد کند.

مدیران زیرساخت بهتر است ابتدا نقاط حساس دیتاسنتر خود را شناسایی کنند و سپس بر اساس میزان اهمیت هر سرویس، برای کاهش ریسک برنامه‌ریزی کنند.

یک دیتاسنتر پایدار دیتاسنتری نیست که هیچ‌وقت دچار مشکل نمی‌شود؛ بلکه زیرساختی است که در برابر خرابی آماده است، مشکلات را سریع شناسایی می‌کند و می‌تواند سرویس‌های مهم را با کمترین اختلال به فعالیت ادامه دهد.