⚡️Deep Dive Into Linux Page Cache⚡️
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبههای زندگی یک متخصص حوزه علوم کامپیوتر مخصوصا دوستان SRE حاضر هست و دونستن منطق پشتش خیلی میتونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث Linux Page Cache هست که توسط زیرسیستم و اینترفیس VFS در کرنل هندل میشه. شاید بگید کجاها بدردتون میخوره؟ دوستانی که در طراحی سسیستمهای Data/Disk Intensive تجربه داشتن حتما میدونن که یکی از مباحث مهم در طراحی توجه به کانسپت Data Durability هست که در SLA مخصوصا سرویسهای استوریج هم خیلی توجه بهش مهم هست.
تو این مقاله به شکل کامل در 10 قسمت با انواع مثال، مفاهیم و ابزار درگیر با این مبحث آشنا میشوید. پیشنهاد میکنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثالها عمدتا با پایتون هست.
Link:
◾️
◾️
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبههای زندگی یک متخصص حوزه علوم کامپیوتر مخصوصا دوستان SRE حاضر هست و دونستن منطق پشتش خیلی میتونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث Linux Page Cache هست که توسط زیرسیستم و اینترفیس VFS در کرنل هندل میشه. شاید بگید کجاها بدردتون میخوره؟ دوستانی که در طراحی سسیستمهای Data/Disk Intensive تجربه داشتن حتما میدونن که یکی از مباحث مهم در طراحی توجه به کانسپت Data Durability هست که در SLA مخصوصا سرویسهای استوریج هم خیلی توجه بهش مهم هست.
تو این مقاله به شکل کامل در 10 قسمت با انواع مثال، مفاهیم و ابزار درگیر با این مبحث آشنا میشوید. پیشنهاد میکنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثالها عمدتا با پایتون هست.
Link:
◾️
https://biriukov.dev/docs/page-cache/0-linux-page-cache-for-sre/
Author:◾️
https://twitter.com/brk0v/
#Linux #SRE #Caching #OS #Data〰️〰️〰️〰️〰️〰️
© @DevOpsEx
در آخر اگر بخواهیم مثالی کاربردی از موارد بالا داشته باشیم بحث Socket ها در لینوکس هستند که اگر باز هم علاقه داشتید زیر و بم این موضوع رو تا عمق سورس کد کرنل هم بفهمید لینک زیر براتون باید جالب باشه:
#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
◾️https://ops.tips/blog/how-linux-creates-sockets/
امیدوارم لذت ببرید🤘🌹#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍9
چند وقت پیش آقای Sebastian Jambor یکسری سلسله مقالات در بحث معماری و Design Decision های گرفته شده پشت طراحی سرویس systemd در چندین قسمت شروع به نوشتن کردند که خب برای من جالب بود گفتم شما هم مطالعه بکنید تا الان 3 قسمت نوشته شده که لینکشون رو پایین تر قرار میدم:
◾️Part 1: Minimization
◾️Part 2: Dependencies
◾️Part 3: Defining Services
امیدوارم لذت ببرید🤘🌹
#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
◾️Part 1: Minimization
◾️Part 2: Dependencies
◾️Part 3: Defining Services
امیدوارم لذت ببرید🤘🌹
#Linux #SRE #Unix #OS #Kernel
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍6🔥4
⚡️Deep Dive Into GNU/Linux Shell Related Internals⚡️
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبههای زندگی کاری یک متخصص SRE و Linux System Engineer حاضر هست و دونستن منطق پشتش خیلی میتونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث internals شلها، ترمینالها و روابط بین فرآیندها هست! همه ما در درجه اول این موارد رو بدیهی تلقی میکنیم چون باهاشون همیشه درگیر هستیم ولی کانسپت هایی مثل File Descriptor ها و Pipes تو لینوکس از مهمترین و پایهایترین مفاهیم کرنل لینوکس و BSD هستند. تو این سری مقاله به شکل کامل در 5 قسمت با انواع مثال، مفاهیم و ابزار های درگیر با این مبحث آشنا میشوید. پیشنهاد میکنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثالها عمدتا با Python و Go هست.
Link:
◾️
◾️
〰️〰️〰️〰️〰️〰️
© @DevOpsEx
خب بعد یک مقداری خاموشی بریم با یک تاپیک جذاب که تو تمام جنبههای زندگی کاری یک متخصص SRE و Linux System Engineer حاضر هست و دونستن منطق پشتش خیلی میتونه تو مباحثی چون Tuning و Debugging بهتون کمک کنه اونم بحث internals شلها، ترمینالها و روابط بین فرآیندها هست! همه ما در درجه اول این موارد رو بدیهی تلقی میکنیم چون باهاشون همیشه درگیر هستیم ولی کانسپت هایی مثل File Descriptor ها و Pipes تو لینوکس از مهمترین و پایهایترین مفاهیم کرنل لینوکس و BSD هستند. تو این سری مقاله به شکل کامل در 5 قسمت با انواع مثال، مفاهیم و ابزار های درگیر با این مبحث آشنا میشوید. پیشنهاد میکنم حتما بخونیدش و لذتشو ببرید :)
پ.ن مثالها عمدتا با Python و Go هست.
Link:
◾️
https://biriukov.dev/docs/fd-pipe-session-terminal/0-sre-should-know-about-gnu-linux-shell-related-internals-file-descriptors-pipes-terminals-user-sessions-process-groups-and-daemons/
Author:◾️
https://twitter.com/brk0v/
#Linux #SRE #Shell #OS #File_Descriptor〰️〰️〰️〰️〰️〰️
© @DevOpsEx
👍4🔥3❤1
Forwarded from Watchlog | مانیتورینگ حرفهای سرور و اپلیکیشن
اصطلاحات مانیتورینگ که هر برنامهنویس و DevOps باید بداند
فرض کنید میانگین زمان پاسخ API شما فقط ۲۰۰ میلیثانیه است؛ اما همچنان بعضی کاربران از کندی سرویس شکایت دارند.
مشکل کجاست؟
ممکن است Average وضعیت خوبی نشان دهد، اما p95 یا p99 مشخص کند بخشی از کاربران چند ثانیه منتظر پاسخ میمانند.
در محیطهای حرفهای، برای بررسی دقیق وضعیت سرویس از مفاهیمی مثل اینها استفاده میشود:
۱. p95 و p99 برای تشخیص کندی واقعی
۲. Error Rate برای اندازهگیری نرخ خطا
۳. Throughput و RPS برای بررسی حجم ترافیک
۴. SLO و Error Budget برای سنجش پایداری سرویس
۵. MTTR برای اندازهگیری سرعت بازیابی پس از خرابی
اما هرکدام دقیقاً چه معنایی دارند؟ چه زمانی باید از آنها استفاده کنیم و چه عددی میتواند نشانه یک مشکل جدی باشد؟
در مقاله جدید Watchlog، مهمترین اصطلاحات مانیتورینگ را با زبان ساده، مثالهای عددی و کاربرد واقعی در محیط Production توضیح دادهایم:
👇 مطالعه مقاله
https://watchlog.ir/blogs/monitoring-terms-every-developer-should-know
اگر برنامهنویس، DevOps یا SRE هستید، این مقاله میتواند به شما کمک کند وضعیت واقعی سرویسها را بهتر تحلیل کنید و Alertها و Dashboardهای دقیقتری بسازید.
#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
فرض کنید میانگین زمان پاسخ API شما فقط ۲۰۰ میلیثانیه است؛ اما همچنان بعضی کاربران از کندی سرویس شکایت دارند.
مشکل کجاست؟
ممکن است Average وضعیت خوبی نشان دهد، اما p95 یا p99 مشخص کند بخشی از کاربران چند ثانیه منتظر پاسخ میمانند.
در محیطهای حرفهای، برای بررسی دقیق وضعیت سرویس از مفاهیمی مثل اینها استفاده میشود:
۱. p95 و p99 برای تشخیص کندی واقعی
۲. Error Rate برای اندازهگیری نرخ خطا
۳. Throughput و RPS برای بررسی حجم ترافیک
۴. SLO و Error Budget برای سنجش پایداری سرویس
۵. MTTR برای اندازهگیری سرعت بازیابی پس از خرابی
اما هرکدام دقیقاً چه معنایی دارند؟ چه زمانی باید از آنها استفاده کنیم و چه عددی میتواند نشانه یک مشکل جدی باشد؟
در مقاله جدید Watchlog، مهمترین اصطلاحات مانیتورینگ را با زبان ساده، مثالهای عددی و کاربرد واقعی در محیط Production توضیح دادهایم:
👇 مطالعه مقاله
https://watchlog.ir/blogs/monitoring-terms-every-developer-should-know
اگر برنامهنویس، DevOps یا SRE هستید، این مقاله میتواند به شما کمک کند وضعیت واقعی سرویسها را بهتر تحلیل کنید و Alertها و Dashboardهای دقیقتری بسازید.
#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
واچلاگ
اصطلاحات مهم مانیتورینگ که هر برنامهنویس و DevOps باید بداند
از p95 و p99 تا SLI، SLO، Error Budget، Apdex، Cardinality و MTTR؛ مهمترین اصطلاحات مانیتورینگ را با مثالهای واقعی و کاربردشان در محیط Production یاد بگیرید.
❤4
Forwarded from Watchlog | مانیتورینگ حرفهای سرور و اپلیکیشن
🚨 ۵ اشتباه پنهان که مانیتورینگ شما را بیاثر میکنند
تصور کنید همه نمودارها سبز هستند و هیچ هشدار مهمی هم دریافت نکردهاید؛ اما کاربران همچنان با کندی و خطا روبهرو هستند.
این اتفاق معمولاً یعنی داده دارید، اما مانیتورینگ شما تصویر کاملی از وضعیت واقعی سرویس ارائه نمیدهد.
پنج اشتباه رایج میتوانند مشکلات مهم را از دید شما پنهان کنند:
۱. اعتماد به میانگینها و نادیدهگرفتن
۲. ساخت هشدار برای هر نوسان و ایجاد خستگی هشدار
۳. بررسی زیرساخت بدون توجه به تجربه واقعی کاربران
۴. جمعآوری متریک، لاگ و تریس بدون ارتباط میان آنها
۵. نداشتن مسئول مشخص و فرایند واکنش پس از هشدار
در مقاله جدید Watchlog، هرکدام از این اشتباهات را با مثالهای واقعی بررسی کردهایم و برای اصلاح آنها راهکارهای عملی ارائه دادهایم.
👇 مطالعه مقاله
https://watchlog.ir/blogs/common-monitoring-mistakes
به نظر شما رایجترین اشتباه در مانیتورینگ چیست؟ اگر تجربهای داشتهاید که با وجود سبزبودن داشبوردها، کاربران با مشکل مواجه بودهاند، در کامنتها بنویسید تا دیگران هم از تجربه شما استفاده کنند.
#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
تصور کنید همه نمودارها سبز هستند و هیچ هشدار مهمی هم دریافت نکردهاید؛ اما کاربران همچنان با کندی و خطا روبهرو هستند.
این اتفاق معمولاً یعنی داده دارید، اما مانیتورینگ شما تصویر کاملی از وضعیت واقعی سرویس ارائه نمیدهد.
پنج اشتباه رایج میتوانند مشکلات مهم را از دید شما پنهان کنند:
۱. اعتماد به میانگینها و نادیدهگرفتن
p95 و p99۲. ساخت هشدار برای هر نوسان و ایجاد خستگی هشدار
۳. بررسی زیرساخت بدون توجه به تجربه واقعی کاربران
۴. جمعآوری متریک، لاگ و تریس بدون ارتباط میان آنها
۵. نداشتن مسئول مشخص و فرایند واکنش پس از هشدار
در مقاله جدید Watchlog، هرکدام از این اشتباهات را با مثالهای واقعی بررسی کردهایم و برای اصلاح آنها راهکارهای عملی ارائه دادهایم.
👇 مطالعه مقاله
https://watchlog.ir/blogs/common-monitoring-mistakes
به نظر شما رایجترین اشتباه در مانیتورینگ چیست؟ اگر تجربهای داشتهاید که با وجود سبزبودن داشبوردها، کاربران با مشکل مواجه بودهاند، در کامنتها بنویسید تا دیگران هم از تجربه شما استفاده کنند.
#مانیتورینگ #Observability #DevOps #SRE #برنامه_نویسی #Watchlog
واچلاگ
۵ اشتباه مانیتورینگ که باعث میشوند مشکلات را دیر تشخیص دهید
ممکن است داشبوردها سبز باشند، اما کاربران همچنان کندی و خطا را تجربه کنند. در این مقاله پنج اشتباه مهم مانیتورینگ و روش اصلاح عملی آنها را بررسی میکنیم.
👍2