DevOps Expert
3.33K subscribers
176 photos
4 videos
8 files
291 links
✔️ کانال آموزش دوآپس به فارسی

Contact:
@BobyCloud
@H_TESLA_S
@Majid_Aghamohamad
Download Telegram
⚡️Deep Dive Into Linux Page Cache⚡️
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبه‌های زندگی یک متخصص حوزه علوم کامپیوتر مخصوصا دوستان SRE حاضر هست و دونستن منطق پشتش خیلی می‌تونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث Linux Page Cache هست که توسط زیرسیستم و اینترفیس VFS در کرنل هندل میشه. شاید بگید کجاها بدردتون می‌خوره؟ دوستانی که در طراحی سسیستم‌های Data/Disk Intensive تجربه داشتن حتما می‌دونن که یکی از مباحث مهم در طراحی توجه به کانسپت Data Durability هست که در SLA مخصوصا سرویس‌های استوریج هم خیلی توجه بهش مهم هست.
تو این مقاله به شکل کامل در 10 قسمت با انواع مثال، مفاهیم و ابزار درگیر با این مبحث آشنا می‌شوید. پیشنهاد می‌کنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثال‌ها عمدتا با پایتون هست.
Link:
◾️https://biriukov.dev/docs/page-cache/0-linux-page-cache-for-sre/
Author:
◾️https://twitter.com/brk0v/
#Linux #SRE #Caching #OS #Data
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
در آخر اگر بخواهیم مثالی کاربردی از موارد بالا داشته باشیم بحث Socket ها در لینوکس هستند که اگر باز هم علاقه داشتید زیر و بم این موضوع رو تا عمق سورس کد کرنل هم بفهمید لینک زیر براتون باید جالب باشه:
◾️https://ops.tips/blog/how-linux-creates-sockets/
امیدوارم لذت ببرید🤘🌹
#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍9
چند وقت پیش آقای Sebastian Jambor یکسری سلسله مقالات در بحث معماری و Design Decision های گرفته شده پشت طراحی سرویس systemd در چندین قسمت شروع به نوشتن کردند که خب برای من جالب بود گفتم شما هم مطالعه بکنید تا الان 3 قسمت نوشته شده که لینکشون رو پایین تر قرار میدم:
◾️Part 1: Minimization
◾️Part 2: Dependencies
◾️Part 3: Defining Services
امیدوارم لذت ببرید🤘🌹
#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍6🔥4
⚡️Deep Dive Into GNU/Linux Shell Related Internals⚡️
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبه‌های زندگی کاری یک متخصص SRE و Linux System Engineer حاضر هست و دونستن منطق پشتش خیلی می‌تونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث internals شل‌ها، ترمینال‌ها و روابط بین فرآیندها هست! همه ما در درجه اول این موارد رو بدیهی تلقی می‌‌کنیم چون باهاشون همیشه درگیر هستیم ولی کانسپت هایی مثل File Descriptor ها و Pipes تو لینوکس از مهم‌ترین و پایه‌ای‌ترین مفاهیم کرنل لینوکس و BSD هستند. تو این سری مقاله به شکل کامل در 5 قسمت با انواع مثال، مفاهیم و ابزار های درگیر با این مبحث آشنا می‌شوید. پیشنهاد می‌کنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثال‌ها عمدتا با Python و Go هست.
Link:
◾️https://biriukov.dev/docs/fd-pipe-session-terminal/0-sre-should-know-about-gnu-linux-shell-related-internals-file-descriptors-pipes-terminals-user-sessions-process-groups-and-daemons/
Author:
◾️https://twitter.com/brk0v/
#Linux #SRE #Shell #OS #File_Descriptor
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍4🔥31
اصطلاحات مانیتورینگ که هر برنامه‌نویس و DevOps باید بداند

فرض کنید میانگین زمان پاسخ API شما فقط ۲۰۰ میلی‌ثانیه است؛ اما همچنان بعضی کاربران از کندی سرویس شکایت دارند.

مشکل کجاست؟

ممکن است Average وضعیت خوبی نشان دهد، اما p95 یا p99 مشخص کند بخشی از کاربران چند ثانیه منتظر پاسخ می‌مانند.

در محیط‌های حرفه‌ای، برای بررسی دقیق وضعیت سرویس از مفاهیمی مثل این‌ها استفاده می‌شود:

۱. p95 و p99 برای تشخیص کندی واقعی
۲. Error Rate برای اندازه‌گیری نرخ خطا
۳. Throughput و RPS برای بررسی حجم ترافیک
۴. SLO و Error Budget برای سنجش پایداری سرویس
۵. MTTR برای اندازه‌گیری سرعت بازیابی پس از خرابی

اما هرکدام دقیقاً چه معنایی دارند؟ چه زمانی باید از آن‌ها استفاده کنیم و چه عددی می‌تواند نشانه یک مشکل جدی باشد؟

در مقاله جدید Watchlog، مهم‌ترین اصطلاحات مانیتورینگ را با زبان ساده، مثال‌های عددی و کاربرد واقعی در محیط Production توضیح داده‌ایم:

👇 مطالعه مقاله
https://watchlog.ir/blogs/monitoring-terms-every-developer-should-know

اگر برنامه‌نویس، DevOps یا SRE هستید، این مقاله می‌تواند به شما کمک کند وضعیت واقعی سرویس‌ها را بهتر تحلیل کنید و Alertها و Dashboardهای دقیق‌تری بسازید.

#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
4
🚨 ۵ اشتباه پنهان که مانیتورینگ شما را بی‌اثر می‌کنند

تصور کنید همه نمودارها سبز هستند و هیچ هشدار مهمی هم دریافت نکرده‌اید؛ اما کاربران همچنان با کندی و خطا روبه‌رو هستند.

این اتفاق معمولاً یعنی داده دارید، اما مانیتورینگ شما تصویر کاملی از وضعیت واقعی سرویس ارائه نمی‌دهد.

پنج اشتباه رایج می‌توانند مشکلات مهم را از دید شما پنهان کنند:

۱. اعتماد به میانگین‌ها و نادیده‌گرفتن p95 و p99
۲. ساخت هشدار برای هر نوسان و ایجاد خستگی هشدار
۳. بررسی زیرساخت بدون توجه به تجربه واقعی کاربران
۴. جمع‌آوری متریک، لاگ و تریس بدون ارتباط میان آن‌ها
۵. نداشتن مسئول مشخص و فرایند واکنش پس از هشدار

در مقاله جدید Watchlog، هرکدام از این اشتباهات را با مثال‌های واقعی بررسی کرده‌ایم و برای اصلاح آن‌ها راهکارهای عملی ارائه داده‌ایم.

👇 مطالعه مقاله
https://watchlog.ir/blogs/common-monitoring-mistakes

به نظر شما رایج‌ترین اشتباه در مانیتورینگ چیست؟ اگر تجربه‌ای داشته‌اید که با وجود سبزبودن داشبوردها، کاربران با مشکل مواجه بوده‌اند، در کامنت‌ها بنویسید تا دیگران هم از تجربه شما استفاده کنند.

#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
👍2