مستندات آفاق
هر آنچه برای ادارهکردن ناوگان سرورتان از یک صفحه لازم دارید: افزودن سرور، خواندن داشبورد، تنظیم بررسیها و هشدارها، و اقدام بر پایهٔ آنچه میبینید. تصویرها با پوستهٔ انتخابی شما در بالای صفحه هماهنگ میشوند.
شروع کار
آفاق سرورهای شما را پایش میکند، اسکریپتها را از راه SSH روی آنها اجرا میکند و هنگام بروز خرابی به شما خبر میدهد. با سه گام از یک حساب خالی به ناوگانی میرسید که میبینید:
- یک ناوگان بسازید — گروهی نامدار از سرورها، مانند
ProductionیاStaging. - سرور اضافه کنید به آن ناوگان، با کلید SSH یا نام کاربری و گذرواژه.
- عامل را نصب کنید از صفحهٔ همان سرور. معیارها ظرف کمتر از یک دقیقه میرسند.
بقیهٔ امکانات — بررسی آپتایم، هشداردهی، راهاندازی مجدد سرویسها و عملیات اسکریپتی — همگی بر پایهٔ همین یک اتصال عامل کار میکنند. چیز دیگری برای نصب به ازای هر قابلیت وجود ندارد.
ورود به حساب از نشانی dash. دامنهٔ آفاق شما انجام میشود. سایت عمومی،
تعرفهها و همین مستندات روی دامنهٔ اصلی قرار دارند.
ناوگانها و سرورها
ناوگان گروهی نامدار از سرورهاست. از ناوگانها برای جداکردن محیطها یا مناطق استفاده کنید — داشبوردها، هشدارها و محدودیتهای طرح بر همین اساس تفکیک میشوند.
با بازکردن یک ناوگان، همان ردیف شاخصهای داشبورد اصلی را میبینید، اما محدود به سرورهای همان ناوگان: چند سرور آنلاین است، آپتایم ۳۰ روز گذشته، هشدارهای باز، و میانگین پردازنده و حافظه.
افزودن سرور
هر سرور به یک نام، یک نشانی و اطلاعات ورود SSH نیاز دارد تا آفاق بتواند عامل را نصب کند و اسکریپتها را اجرا کند. میتوانید کلید خصوصی را بچسبانید یا از نام کاربری و گذرواژه استفاده کنید — هر دو پیش از ذخیرهشدن رمزنگاری میشوند.
نصب عامل
از صفحهٔ سرور، زبانهٔ عامل را باز کنید و نصب را آغاز کنید. آفاق از راه SSH متصل میشود، یک باینری کوچک نصب میکند و آن را بهعنوان سرویس ثبت میکند. سپس عامل از طریق یک وبسوکت خروجی به آفاق متصل میشود و بهطور پیشفرض هر ۶۰ ثانیه گزارش میدهد.
- لاگ نصب بهصورت زنده نمایش داده میشود؛ موفقیت یا شکست آن را میبینید.
- اگر وبسوکت قطع شود، فرمانها بهطور خودکار به SSH مستقیم بازمیگردند.
- عامل پردازنده، حافظه، دیسک، شبکه، وضعیت سرویسهای systemd و خطوط ژورنال را گزارش میدهد.
سرور زمانی آفلاین در نظر گرفته میشود که عامل آن بیش از ۹۰ ثانیه ساکت بماند — با فاصلهٔ مناسبی بالاتر از بازهٔ پیشفرض ۶۰ ثانیه، تا یک گزارش دیرهنگام وضعیت را بیجهت تغییر ندهد.
داشبورد نمای کلی
نمای کلی، صفحهٔ نخست حساب شماست و خودش را بهروز میکند — معیارها، نتیجهٔ بررسیها و هشدارهای تازه بدون بارگذاری مجدد صفحه ظاهر میشوند.
| بخش | چه چیزی را نشان میدهد |
|---|---|
| سرورهای آنلاین | چند سرور در وضعیت بحرانی یا نامشخص نیستند، از کل سرورها. نام سرور بحرانی را هم میآورد. |
| آپتایم ناوگان (۳۰ روز) | سهم بررسیهای آپتایمی که در ۳۰ روز گذشته موفق بودهاند. |
| هشدارهای فعال | هشدارهای باز در کل حساب، و اینکه چند تای آنها بحرانی است. |
| میانگین CPU / RAM | میانگین بار میان همهٔ سرورهایی که گزارش میدهند. |
| جدول سرورها | وضعیت هر سرور با نوارهای پردازنده، حافظه و دیسک. برای بازکردن، روی ردیف کلیک کنید. |
| فهرست هشدارهای فعال | تازهترین هشدارها، هر کدام با گزینهٔ خاموشکردن موقت و رفع. |
| بررسیهای آپتایم | بررسیهای اخیر با تاریخچهٔ موفقیت/شکست، زمان پاسخ و کد وضعیت. |
نشانهای وضعیت
- سالم — گزارشدهی عادی است و چیزی از آستانه نگذشته.
- هشدار — پردازنده یا حافظه بالای ۸۵٪، یا دیسک بالای ۹۰٪.
- بحرانی — یک بررسی آپتایم در ۱۵ دقیقهٔ گذشته ناموفق بوده است.
- نامشخص — هنوز نه معیاری رسیده و نه بررسیای تعریف شده است.
جزئیات یک سرور
صفحهٔ هر سرور همهٔ آنچه دربارهٔ آن میزبان میدانیم را در چند زبانه گرد میآورد: معیارها، اطلاعات، سرویسها، بررسیهای آپتایم، لاگها، عامل و تعمیرات.
- معیارها — پردازنده، حافظه و دیسک در بازهٔ دلخواه شما، بههمراه نرخ شبکه. حافظه و دیسک با واحدهای واقعی و نسبت به ظرفیت کل ماشین نمایش داده میشوند.
- نوار آپتایم — تاریخچهٔ آنلاین/آفلاین، قابل تغییر میان ۱۲ ساعت، ۲۴ ساعت، ۷ روز و ۳۰ روز.
- اطلاعات — فهرست سختافزار گزارششده توسط عامل: مدل پردازنده، تعداد هسته، حافظه و سیستمعامل.
- لاگها — خطوط اخیر ژورنال که عامل ارسال کرده است.
- تعمیرات — برای خاموشکردن موقت هشدارهای این سرور هنگام کار روی آن، یک بازهٔ تعمیرات باز کنید.
پیشبینی پرشدن دیسک
آفاق بر دادههای ساعتی یک هفتهٔ گذشتهٔ مصرف دیسک خطی برازش میکند و زمان رسیدن به ۱۰۰٪ را پیشبینی میکند. هشدار را زمانی میگیرید که هنوز فرصت اقدام دارید، نه پس از پرشدن.
بررسیهای آپتایم
بررسی آپتایم، چیزی را که همیشه باید پاسخ دهد با بازهای که خودتان انتخاب میکنید میآزماید. سه نوع بررسی در دسترس است:
| نوع | مناسبِ | ثبت میکند |
|---|---|---|
| HTTP / HTTPS | نقاط پایانی وب و نشانیهای سلامت | کد وضعیت، زمان پاسخ، انقضای TLS |
| TCP | پایگاههای داده، صفها، هر پورت باز | زمان اتصال، خطاهای اتصال |
| Ping | در دسترسبودن پایه | زمان رفتوبرگشت، از دست رفتن بسته |
هر آزمایش زمان پاسخ، کد وضعیت و هر خطایی را ثبت میکند. تاریخچه بهصورت ساعتی تجمیع میشود و همین است که نمای ۳۰ روزه را سریع نگه میدارد. برای بررسیهای HTTPS، آفاق تاریخ انقضای گواهی را نیز پیگیری میکند و پیش از دردسرساز شدن هشدار میدهد.
بازه و مهلت زمانی را متناسب با حساسیت موردنظرتان تنظیم کنید. بازهٔ ۶۰ ثانیه با مهلت ۵ ثانیه برای یک نقطهٔ پایانی وب انتخاب معقولی است.
هشدارها و اعلانها
هشدارها از دو منبع میآیند: بررسیهای آپتایم ناموفق و سرویسهای تحت پایشی که از کار افتادهاند. این هشدارها در نمای کلی، در صفحهٔ سرور مربوطه، در شمارندهٔ نوار کناری و در صفحهٔ هشدارها دیده میشوند.
چه زمانی خبردار میشوید
اعلانها در لحظهٔ تغییر وضعیت ارسال میشوند — وقتی چیزی از کار میافتد و دوباره وقتی به حالت عادی بازمیگردد. در تکتک بررسیهای ناموفق میان این دو، اعلانی فرستاده نمیشود؛ بنابراین یک ساعت قطعی یک پیام است، نه شصت پیام.
کانالهای تحویل
ایمیل، وبهوک، اسلک، تلگرام و پیامک. هر کانال آستانهٔ شدت مخصوص خود را دارد که برای هر عضو تیم جداگانه تنظیم میشود؛ مثلاً میتوانید همهچیز را به وبهوک بفرستید اما تنها هشدارهای بحرانی را به پیامک. در دسترسبودن کانالها به طرح شما بستگی دارد.
بازههای تعمیرات
بازکردن یک بازهٔ تعمیرات روی سرور، هشدارهای آن را برای مدت تعیینشده پنهان میکند. بررسیها همچنان اجرا و نتایج ثبت میشوند — تنها هشداردهی خاموش است — تا تصویر واقعی در لحظهٔ پایان بازه دقیق باشد.
سرویسها و راهاندازی خودکار
عامل، همهٔ واحدهای systemd روی سرور را گزارش میدهد. هر واحد میتواند اینگونه علامت بخورد:
- تحت پایش — اگر متوقف شود، هشداری باز میشود.
- راهاندازی خودکار — آفاق در صورت خرابی، خودش آن را دوباره راهاندازی میکند.
راهاندازی خودکار به سقف تلاش مجدد و فاصلهٔ زمانی فزاینده پایبند است که هر دو را خودتان تعیین میکنید. سرویسی که سقف تلاشهایش تمام شود دیگر راهاندازی نمیشود و بهجای آن به هشدار تبدیل میشود — تا سرویسی که واقعاً خراب است به شما برسد، نه اینکه بیپایان تکرار شود.
از زبانهٔ سرویسها میتوانید هر سرویس را بهصورت دستی نیز شروع، متوقف یا راهاندازی مجدد کنید.
عاملهای SSH
عامل SSH یک اسکریپت bash قابل استفادهٔ مجدد است — نصب یک بسته، اجرای یک بررسی سلامت، انجام یک استقرار — که میتوانید روی هر سروری اجرایش کنید.
- اجراها از راه اتصال زندهٔ عامل انجام میشوند و در نبود آن به SSH مستقیم بازمیگردند.
- خروجی بهصورت زنده بازمیگردد و در تاریخچهٔ همان اجرا نگهداری میشود.
- عاملهای از پیش تعریفشده کارهای رایج را پوشش میدهند؛ میتوانید از تنظیمات، عاملهای خودتان را هم بنویسید.
هماهنگسازی
هماهنگسازی چند اسکریپت عامل SSH را در مراحلی مرتب زنجیر میکند و روی مجموعهای از سرورهای انتخابی اجرا میکند.
- هر مرحله روی همهٔ سرورهای انتخابی بهصورت موازی اجرا میشود.
- بهطور پیشفرض اگر مرحلهای در هر جایی شکست بخورد، کل اجرا متوقف میشود تا یک مرحلهٔ خراب به مراحل بعدی سرایت نکند.
- اجراها قابل زمانبندیاند و خروجی کامل هر اجرا برای هر میزبان نگهداری میشود.
از این قابلیت برای تغییرات هماهنگ استفاده کنید — ارتقای یک بسته، سپس راهاندازی مجدد یک سرویس، سپس یک بررسی سلامت — روی چندین سرور بهصورت همزمان.
ابر و سختافزار
ابر آروان
با اتصال کلید API ابر آروان، فهرست سرورهای ابری خود را در همهٔ مناطق آن حساب دریافت میکنید. از همانجا میتوانید نمونهها را خاموش و روشن، تغییر اندازه، بازسازی، اسنپشات یا حذف کنید و کنسول VNC را باز کنید — بدون خارجشدن از آفاق.
iLO شرکت HPE / Redfish
با اتصال به کنترلر مدیریتی iLO از راه API Redfish میتوانید سلامت سختافزار را بدون نیاز به نصب عامل روی سیستمعامل پایش کنید. آفاق دادههای حرارتی، برق، ذخیرهسازی و شبکه را میخواند و هر زیرسیستم معیوب را به هشدار تبدیل میکند. کنترل برق، چراغ شناسایی، تغییر ترتیب بوت و راهاندازی مجدد از راه دور نیز در دسترس است.
Caddy و تونلها
هرجا Caddy در حال اجرا باشد، وضعیت پروکسی معکوس آن کنار همان سرور نمایش داده میشود. تونلهای امن به شما امکان میدهند به سرویسهایی که در معرض اینترنت نیستند دسترسی پیدا کنید.
تنظیمات و اعلانها
در تنظیمات، کانالهای اعلان و حداقل شدت هر کدام را پیکربندی میکنید، اسکریپتهای عامل SSH خود را مدیریت میکنید و گزینههای معیارها را در سطح حساب تغییر میدهید. ترجیحات اعلان شخصی است — هر عضو تیم تنظیمات خودش را دارد.
رابط کاربری به فارسی و انگلیسی در دسترس است و در فارسی از چیدمان راستبهچپ پیروی میکند. زبان را میتوانید از پاورقی هر صفحه تغییر دهید.
تیم و نقشها
از صفحهٔ تیم، همتیمیهای خود را دعوت کنید — برای آنها ایمیلی حاوی پیوند پذیرش و تعیین گذرواژه ارسال میشود. اعضای تیم در ناوگانها، سرورها، هشدارها و صورتحساب حساب شریکاند، اما تنظیمات اعلان خودشان را دارند.
تنها مالک حساب میتواند اعضا را دعوت یا حذف کند و صورتحساب را مدیریت کند.
صورتحساب و طرحها
طرح شما تعیین میکند چند ناوگان، سرور، عامل SSH، هماهنگسازی و یکپارچهسازی ابری یا سختافزاری میتوانید داشته باشید. صفحهٔ صورتحساب مصرف کنونی را در برابر هر سقف، همراه با تاریخچهٔ پرداختها نشان میدهد.
با رسیدن به سقف، افزودن مورد تازه از همان نوع تا زمان ارتقا متوقف میشود. هیچچیزی که در حال اجراست خاموش یا کند نمیشود.
میخواهید همهچیز درون شبکهٔ خودتان بماند؟ استقرار درونسازمانی در دسترس است — برای شروع گفتوگو از فرم استقرار درونسازمانی در سایت اصلی استفاده کنید.
رفع اشکال
سرور آفلاین نشان داده میشود اما در حال اجراست
عامل بیش از ۹۰ ثانیه گزارشی نفرستاده است. بررسی کنید که سرویس عامل روی میزبان در حال اجرا باشد و بتواند بهصورت خروجی به آفاق دسترسی داشته باشد. زبانهٔ عامل، آخرین لاگ نصب و وضعیت کنونی اتصال را نشان میدهد.
بررسی آپتایم ناموفق است اما سایت در مرورگر من کار میکند
خطای ثبتشده را در صفحهٔ همان بررسی ببینید. یک علت رایج این است که نقطهٔ پایانی تنها از درون شبکهٔ شما در دسترس است — یک تونل، یا بررسیای که به نشانی داخلی متصل شود، این را حل میکند.
اعلان دریافت نمیکنم
مطمئن شوید کانال در تنظیمات فعال است، حداقل شدت آن بالاتر از شدت هشدار نیست، و طرح شما آن کانال را پوشش میدهد. به یاد داشته باشید که اعلانها تنها در لحظهٔ تغییر وضعیت ارسال میشوند، نه در هر بررسی ناموفق.
یک سرویس مدام راهاندازی مجدد میشود
وقتی راهاندازی خودکار سقف تلاشهایش را تمام کند، متوقف میشود و هشدار میدهد. اگر سرویس صرفاً به زمان بیشتری برای بالا آمدن نیاز دارد، سقف را بالا ببرید یا فاصلهٔ زمانی را بیشتر کنید؛ اگر واقعاً خراب است، همان هشدار نشانهٔ آن است که باید به آن رسیدگی کنید.