رفتن به محتوای اصلی
MedaNet
شرکت مدانت مجری تخصصی پیاده‌سازی، آموزش و پشتیبانی راهکارهای فناوری اطلاعات
راهنمای خدمات پشتیبانی و نگهداری شبکه | دانش و تجربه اجرایی

پشتیبانی شبکه فقط رفع خرابی نیست؛ چک‌لیست ماهانه برای جلوگیری از بحران IT

شرکت مدانت

ساعت ۸:۳۰ صبح شنبه است. واحد مالی نمی‌تواند به فایل‌سرور وصل شود، دو کاربر می‌گویند ایمیلشان باز نمی‌شود و روی یکی از سرورها فضای درایو سیستم به مرز خطر رسیده است. بکاپ شب قبل هم «موفق» ثبت شده، اما آخرین Restore واقعی سه ماه پیش انجام شده است.

این سناریو برای خیلی از سازمان‌ها آشناست؛ چون پشتیبانی شبکه هنوز به شکل «خراب شد، درستش کن» اداره می‌شود. درحالی‌که پشتیبانی حرفه‌ای شبکه باید بخش بزرگی از مشکل را قبل از اینکه کاربر متوجه شود پیدا کند.

پشتیبانی شبکه دقیقاً باید چه چیزی را پوشش دهد؟

پشتیبانی شبکه فقط سوئیچ، کابل و سرور نیست. تجربه واقعی کاربر به مجموعه‌ای از اجزا وابسته است: اینترنت، Active Directory، DNS، DHCP، فایل‌سرور، مجازی‌سازی، Backup، Endpointها، دسترسی‌ها، امنیت، ظرفیت و حتی مستندسازی.

حوزه بررسی دوره‌ای ریسکی که کاهش می‌دهد
سرورها CPU، RAM، فضای دیسک، Eventها و سرویس‌های حیاتی توقف ناگهانی سرویس
شبکه وضعیت لینک‌ها، Packet Loss، خطاهای Interface و تجهیزات کلیدی کندی و قطعی پراکنده
Backup موفقیت Jobها، ظرفیت مخزن و آزمون Restore بکاپ ظاهراً سالم اما غیرقابل بازیابی
امنیت Patch، حساب‌های ممتاز، دسترسی‌ها و رخدادهای مشکوک نفوذ و Privilege Creep
کاربران درخواست‌های پرتکرار و مشکلات تکرارشونده اتلاف زمان Help Desk
مستندسازی تغییرات، IPها، تجهیزات، Credentialهای مدیریتی و وابستگی‌ها وابستگی به حافظه افراد

یک چک‌لیست ماهانه عملی

۱. وضعیت سرورها و سرویس‌های اصلی

فقط روشن بودن سرور کافی نیست. باید روند مصرف منابع، خطاهای سیستم، سرویس‌های متوقف‌شده، وضعیت Storage و ظرفیت رشد بررسی شود. اگر درایو یک سرور هر ماه پنج درصد پرتر می‌شود، بهتر است قبل از رسیدن به ۹۹ درصد برای آن تصمیم گرفته شود.

۲. بکاپ را با Restore بسنجید، نه با چراغ سبز

موفق بودن Job بکاپ به معنی قابل بازیابی بودن اطلاعات نیست. حداقل بخشی از داده‌های مهم باید در بازه‌های مشخص Restore آزمایشی شوند. سناریوی Disaster Recovery نیز باید مشخص کند در زمان بحران چه کسی، از کجا و با چه اولویتی سرویس‌ها را برمی‌گرداند.

۳. درخواست‌های تکراری کاربران را تحلیل کنید

اگر هر هفته چند کاربر برای Reset Password، قطع شدن Printer یا مشکل یک نرم‌افزار خاص تماس می‌گیرند، مسئله دیگر یک Incident منفرد نیست. این الگو باید به Problem تبدیل شود و علت ریشه‌ای آن بررسی شود.

۴. امنیت را از عملیات روزمره جدا نکنید

Patchهای عقب‌افتاده، حساب‌های قدیمی، دسترسی‌های اضافی و سرویس‌های بلااستفاده معمولاً در یک روز ایجاد نشده‌اند. بررسی دوره‌ای آن‌ها بخشی از پشتیبانی شبکه است؛ نه یک پروژه امنیتی جدا که سالی یک‌بار انجام شود.

۵. تغییرات را ثبت کنید

تغییر VLAN، جابه‌جایی یک VM، نصب نرم‌افزار روی سرور یا تغییر Policy اگر ثبت نشود، چند هفته بعد تبدیل به یک معمای عیب‌یابی می‌شود. ثبت تغییرات ساده، زمان حل Incidentهای بعدی را به‌شدت کاهش می‌دهد.

پشتیبانی حضوری یا ریموت؟

برای اغلب سازمان‌ها ترکیب این دو بهتر جواب می‌دهد. کارهای روزمره، مانیتورینگ و بسیاری از خطاها می‌توانند ریموت انجام شوند؛ اما بازبینی فیزیکی رک، تجهیزات، کابل‌کشی، UPS و بعضی تغییرات زیرساختی نیازمند حضور برنامه‌ریزی‌شده هستند.

مدل مناسب باید بر اساس تعداد کاربر، حساسیت سرویس‌ها، تعداد شعب، ساعات کاری و SLA تعیین شود؛ نه صرفاً بر اساس تعداد روز حضور کارشناس.

گزارش مدیریتی ماهانه چه چیزی باید بگوید؟

  • چه Incidentهای مهمی رخ داده و علت آن‌ها چه بوده است؟
  • کدام مشکلات تکرارشونده هنوز باز هستند؟
  • وضعیت Backup و آزمون Restore چگونه است؟
  • کدام سرورها یا تجهیزات به ظرفیت یا پایان عمر نزدیک شده‌اند؟
  • چه ریسک‌های امنیتی باز مانده‌اند؟
  • چه اقدام پیشگیرانه‌ای برای ماه بعد پیشنهاد می‌شود؟

گزارش خوب فهرست کارهای انجام‌شده نیست؛ باید به مدیر نشان دهد وضعیت فناوری اطلاعات نسبت به ماه قبل بهتر شده، بدتر شده یا در چه نقطه‌ای نیاز به تصمیم دارد.

سناریوی درست: پیشگیری قبل از بحران

فرض کنید مانیتورینگ نشان می‌دهد فضای Datastore مجازی‌سازی طی سه ماه از ۶۵ درصد به ۸۶ درصد رسیده است. در مدل واکنشی، تیم زمانی وارد عمل می‌شود که VMها دیگر روشن نمی‌شوند. در مدل پشتیبانی مدیریت‌شده، روند رشد زودتر دیده می‌شود، ظرفیت پاک‌سازی یا توسعه پیدا می‌کند و اختلال اصلاً رخ نمی‌دهد.

سخن پایانی

پشتیبانی شبکه زمانی ارزش واقعی ایجاد می‌کند که تعداد تماس‌ها، خرابی‌های تکراری و غافلگیری‌های زیرساختی کمتر شود. هدف این نیست که کارشناس همیشه مشغول رفع خرابی باشد؛ هدف این است که محیط IT آن‌قدر قابل مشاهده و قابل مدیریت شود که خرابی‌های قابل پیشگیری، قبل از تبدیل شدن به بحران متوقف شوند.

خدمات پشتیبانی و نگهداری شبکه مدانت بر ترکیب پشتیبانی حضوری، Remote Support، مانیتورینگ، مستندسازی و رویکرد خدماتی مبتنی بر ITIL تمرکز دارد.

1311