دید عملیاتی قابل‌اقدام

مشاهده‌پذیری

پایش را طوری طراحی کنید که وضعیت سرویس، اثر روی کاربر و رفتار وابستگی‌ها را توضیح دهد؛ نه اینکه فقط تعداد نمودارها بیشتر شود.

01

تمرکز روی سرویس

سیگنال‌ها حول سرویس حیاتی و مسیر واقعی کاربر سازمان‌دهی می‌شوند.

02

هشدار قابل‌اقدام

هر هشدار باید مسئول و اقدام بعدی مشخص داشته باشد.

03

شواهد برای مهندسی

داده‌های پایش برای رخداد، ظرفیت و تصمیم معماری استفاده می‌شوند.

دامنه کار

لایه‌های مشاهده‌پذیری

01

شاخص‌ها

تأخیر، خطا، اشباع و شاخص‌های سطح سرویس.

02

گزارش رویداد

رویداد ساختاریافته با شناسه ارتباط و زمان نگه‌داری مناسب.

03

ردگیری درخواست

مسیر درخواست میان وابستگی‌ها جایی که ارزش تشخیصی دارد.

04

بررسی مصنوعی

بررسی سرویس یا روند کار از دید بیرونی.

05

داشبورد

نمایی برای تصمیم اپراتور، نه تزئین.

06

هشدار

مسیردهی، شدت، حذف تکرار و ارجاع با مسئول روشن.

جزئیات اجرایی

داده بیشتر الزاماً دید بهتر نمی‌دهد.

خیلی از تیم‌ها حجم زیادی گزارش و شاخص جمع می‌کنند ولی هنگام رخداد هنوز جواب سؤال‌های پایه مشخص نیست. از تصمیمی شروع می‌کنیم که اپراتور باید بگیرد، بعد سیگنال لازم برای همان تصمیم را پیدا می‌کنیم و نویز و هزینه اضافه را حذف می‌کنیم.

  • سیگنال مسیر حیاتی کاربر
  • وابستگی و اشباع
  • نام‌گذاری و مالکیت یکنواخت
  • زمان نگه‌داری و کنترل هزینه
  • ارتباط شواهد رخداد

هشدار خوب باید به یک تصمیم یا اقدام برسد.

اگر تیم نداند بعد از دیدن هشدار چه کاری باید انجام دهد، هشدار هنوز کامل طراحی نشده است. شدت، مسئول، زمینه و مسیر ارجاع باید مشخص باشد.

FAQ

پرسش‌های مهم قبل از شروع

با چه ابزارهایی کار می‌کنید؟+

با ابزار موجود یا ترجیحی شما کار می‌کنیم؛ مدل سیگنال و کیفیت داده از نام فروشنده مهم‌تر است.

نویز هشدار را کم می‌کنید؟+

بله. تکرار، آستانه، مسیردهی و قابلیت اقدام را بررسی می‌کنیم.

SLO هم تعریف می‌کنید؟+

بله، وقتی بتواند تصمیم‌های پایداری و اولویت‌بندی را بهتر کند.

قدم بعدی

نویز را با سیگنال‌هایی جایگزین کنیم که تیم بتواند روی آن‌ها اقدام کند.

از رخدادهایی شروع کنیم که پیدا کردن علتشان بیش از حد طول می‌کشد.

شروع گفت‌وگو