883 subscribers
44 photos
3 videos
1 file
1.39K links
🕸 Database Academy

حمایت مالی:
https://www.coffeete.ir/mrbardia72

ادمین:
@mrbardia72
Download Telegram
🔵 عنوان مقاله
Probably (Tool)

🟢 خلاصه مقاله:
پروابیلی یکی از ابزارهای قدرتمند در حوزه تحلیل داده‌های محلی است که به صورت ویژه برای استخراج و تجزیه و تحلیل داده‌های زبان طبیعی طراحی شده است. این ابزار قادر است اطلاعات موجود در فایل‌ها و انبارهای داده مختلف را در قالبی منسجم و قابل فهم برای سیستم‌های مختلف تحلیل کند، که این امر در فرآیند استخراج معنای پنهان در متن‌ها بسیار مؤثر است. با توجه به نیاز روزافزون به تحلیل زبان طبیعی در تجارت، تحقیقات علمی، و هوش مصنوعی، پروابیلی می‌تواند نقش مهمی در تسهیل این فرآیند ایفا کند و به کسب و کارها کمک کند تا تصمیمات مؤثرتری بر پایه داده‌های دقیقی بگیرند.

ابزار پروابیلی علاوه بر ساده‌سازی روند تجزیه و تحلیل، امکانات متنوعی در زمینه مدیریت و تفسیر داده‌های زبان طبیعی فراهم می‌کند. با استفاده از این ابزار، کاربران به راحتی می‌توانند فایل‌های متنی مختلف را تحلیل کرده و الگوهای پنهان در داده‌ها را شناسایی کنند. این قابلیت برای شرکت‌هایی که نیازمند درک عمیق از نظرات مشتریان، اسناد داخلی، یا داده‌های متنی بزرگ هستند، بسیار حیاتی است. به این ترتیب، پروابیلی نه تنها فرآیند تحلیل را سریع‌تر می‌کند، بلکه دقت و کاربری آن در پروژه‌های مختلف در مقام مقایسه با دیگر ابزارها برتری دارد.

در نهایت، پروابیلی یک راهکار خاص برای تحلیل داده‌های زبانی است که قابلیت انطباق با نیازهای مختلف سازمان‌ها و مجموعه‌های داده‌ای مختلف را داراست. این ابزار با امکانات پیشرفته و کاربردی، به تیم‌ها این امکان را می‌دهد تا با اطمینان بیشتری در دنیای پیچیده و انبوه داده‌های زبان طبیعی حرکت کنند و نتایج دقیق و کاربردی به دست آورند. در دنیای امروز، که تحلیل عمیق داده‌ها اهمیت زیادی یافته است، استفاده از ابزارهای کارآمد مانند پروابیلی می‌تواند تفاوت قابل توجهی در موفقیت کسب‌وکارها و پروژه‌ها ایجاد کند.

#تحلیل_متن #داده_پایگاه #هوش_مصنوعی #پروابیلی

🟣لینک مقاله:
https://www.probably.dev/?utm_source=tldrdata


👑 @Database_Academy
🔵 عنوان مقاله
Datum: Local-First Spatial Syncing for PostGIS

🟢 خلاصه مقاله:
در دنیای بی‌وقفه داده‌های مکانی، نیاز به سیستم‌هایی داریم که بتوانند همواره همگام و به‌روزرسانی‌های لحظه‌ای را به صورت موثری مدیریت کنند. یکی از راه‌حل‌های نوآورانه که اخیراً مورد توجه قرار گرفته است، لایه همگام‌سازی محلی- اول است. این لایه به گونه‌ای طراحی شده است که جداول پایگاه داده‌های Postgres و PostGIS را مستقیماً در داخل مرورگر به نمونه‌ای محلی و مبتنی بر وب از PostGIS تبدیل می‌کند، و این امر با استفاده از فناوری WebAssembly و ابزار PGlite امکان‌پذیر شده است.

در این رویکرد نوآورانه، نسخه‌ای محلی و دقیقا هم‌زمان از داده‌های مکانی ایجاد می‌شود که می‌تواند تغییرات و بروزرسانی‌ها را در همان لحظه دریافت کند. این کار از طریق مکانیزم NOTIFY در Postgres انجام می‌گیرد که به صورت بلادرنگ تغییرات را اطلاع‌رسانی می‌کند و این اطلاعات سریعاً بر روی نمونه محلی به‌روزرسانی می‌شود. بنابراین، کاربران بدون نیاز به ارتباط مداوم با سرور مرکزی، همواره با داده‌های تازه و دقیق کار می‌کنند، و این امر امکانی فوق‌العاده برای برنامه‌های مبتنی بر نقشه و تحلیل‌های زمانی واقعی فراهم می‌آورد.

در مجموع، این فناوری، پلی بی‌نظیر بین پایگاه داده‌های سنتی و برنامه‌های مدرن مبتنی بر مرورگر است که بهره‌وری، دقت و انعطاف‌پذیری در مدیریت داده‌های مکانی را به طور قابل توجهی افزایش می‌دهد. لذا، استفاده از این سیستم ممکن است تاثیرات زیادی در پروژه‌های شهری، محیط‌زیستی و کاربردهای زمان-واقعی داشته باشد و راهکارهای مؤثری برای بهبود کارایی و واکنش‌پذیری در سامانه‌های مکانی ارائه دهد.

#مکانیزم_همگام_سازی #پایگاه_داده_مکانی #نقشه_پیشرفته #تکنولوژی_وب

🟣لینک مقاله:
https://a-saed.github.io/datum/


👑 @Database_Academy
🔵 عنوان مقاله
pg_durable: Durable Execution Inside Postgres

🟢 خلاصه مقاله:
در دنیای پایگاه‌های داده، راهکارهایی برای اجرای مطمئن و ماندگار عملیات‌ها اهمیت زیادی دارد. شرکت مایکروسافت اخیراً این نیاز را جدی گرفته و موتور گردش‌کار مقاوم و پایدار خود را که در سرویس Azure HorizonDB به کار می‌برند، متن باز کرده است. این اقدام به توسعه‌دهندگان این امکان را می‌دهد تا بتوانند فناوری‌های مشابه را در محیط‌های مختلف، حتی خارج از سرویس‌های ابری، پیاده‌سازی و آزمایش کنند.

در حال حاضر،دو تصویر داکر (Docker) برای اجرای این موتور روی نسخه‌های PostgreSQL 17 و 18 در دسترس است که کاربران و توسعه‌دهندگان می‌توانند برای آزمایش‌های شخصی خود از آن‌ها بهره ببرند. این تصاویر، قابلیت‌های پیشرفته‌ای را برای توسعه برنامه‌های مقاوم و ایمن فراهم می‌کنند و اسناد کامل این پروژه نیز در دسترس قرار گرفته است تا فرآیند راه‌اندازی و استفاده به سادگی صورت گیرد.

این پروژه، به عنوان گامی مهم در جهت ارتقاء قابلیت‌های پایدار و مقاوم در بانک‌های اطلاعاتی مبتنی بر PostgreSQL است و نشان می‌دهد که چگونه فناوری‌های متن باز می‌توانند نوآوری‌های بزرگی در صنعت پایگاه داده‌ها ایجاد کنند. با توجه به اینکه این ابزارها امکان ساخت سیستم‌های توکار و بدون توقف را فراهم می‌آورند، می‌توان انتظار داشت که در آینده‌ای نزدیک، توسعه‌دهندگان بیشتری از این فناوری بهره‌مند شوند و راه‌کارهای پیشرفته‌تری برای نیازهای حیاتی خود توسعه دهند.

#پایگاه_داده #PostgreSQL #فناوری_متن_باز #پایداری

🟣لینک مقاله:
https://github.com/microsoft/pg_durable


👑 @Database_Academy
🔵 عنوان مقاله
pg_hardstorage 1.0: A New Backup and Recovery Approach

🟢 خلاصه مقاله:
نسخه جدید pg_hardstorage 1.0 ارائه شده است، راهکاری نوین برای پشتیبان‌گیری و بازیابی داده‌ها که تحولی در مدیریت نسخه‌های پشتیبان محسوب می‌شود. این ابزار، که اولین ابزار پشتیبان‌گیری مبتنی بر استریم است، بدون نیاز به سرور میزبان و بدون پیروی از زنجیره‌های قدیمی، در قالب یک فایل باینری واحد عرضه می‌شود. وظیفه اصلی این ابزار، انتقال دقیق و بدون شکاف لاگ‌های WAL از طریق یک اتصال رپلیکیشن عادی است، بنابراین امکان بازیابی نقطه‌ای (PITR) با دقت بایت به بایت و بدون لکزش را فراهم می‌کند.

این سیستم به گونه‌ای طراحی شده است که بتواند در محیط‌های مختلف به راحتی جایگزین ابزارهای موجود مانند pgBackRest و Barman شود، بدون نیاز به تغییر در فرآیندهای خودکار و اسکریپت‌های مهندسی شده‌تان. در واقع، این ابزار توانسته است ویژگی‌های برتری مانند سادگی، کارایی و سازگاری بالا را در کنار حفظ قابلیت‌های پیشرفته ارائه دهد، تا کاربران بتوانند عملیات پشتیبان‌گیری و بازیابی داده‌های خود را با اطمینان بیشتری انجام دهند.

در نتیجه، نسخه ۱.۰ pg_hardstorage، راهکاری مدرن، قابل اعتماد و سریع است که می‌تواند نیازهای مختلف کسب‌وکارها و تیم‌های مدیریت پایگاه داده‌های PostgreSQL را برآورده کند و تجربه‌ای بهتر و بی‌وقفه در حوزه حفاظت و بازیابی داده‌ها فراهم آورد.

#پشتیبان‌گیری #پایگاه_داده #پشتیبان‌گیری_پایدار #PostgreSQL

🟣لینک مقاله:
https://www.pghardstorage.org/


👑 @Database_Academy
🔵 عنوان مقاله
Postgres 18 Performance Enhancements

🟢 خلاصه مقاله:
نسخه ۱۸ پستگرس با بهبودهای متعددی در عملکرد و بهینه‌سازی همراه شده است که بررسی آن‌ها می‌تواند نقش مهمی در افزایش کارایی سیستم‌های پایگاه‌داده ایفا کند. در این نسخه، توسعه‌دهندگان امکانات جدیدی برای بهبود سرعت و کارایی عملیات داده‌ کاوی، بهبود فرآیندهای نگهداری و کاهش هزینه‌های عملیاتی ارائه داده‌اند. این به‌روزرسانی‌ها شامل بهبودهای فنی زیادی هستند که می‌تواند به مدیران پایگاه‌داده کمک کند تا کارایی سیستم‌های خود را افزایش دهند و فرآیندهای روزمره را بهینه‌تر مدیریت کنند.

در میان این تغییرات، بهینه‌سازی جست‌وجوهای skip scan، که امکان اجرای سریع‌تر پرس‌وجوهای خاص را فراهم می‌کند، یکی از موارد برجسته است. همچنین، حذف خودکار joinهای بی‌فایده و اضافه شدن قابلیت‌های جدید در تنظیمات خودکار vacuum، توانسته است فرآیند نگهداری و جمع‌آوری اطلاعات را بهبود ببخشد و از انباشت داده‌های زائد جلوگیری کند. این موارد در کنار دیگر بهبودها، نشان می‌دهند که تیم توسعه پستگرس تمرکز زیادی بر توسعه ویژگی‌هایی دارد که باعث کاهش بار سیستم و افزایش سرعت پاسخگویی می‌شود.

در نهایت، با بهره‌مندی از این به‌روزرسانی‌ها، کاربران و مدیران پایگاه‌داده می‌توانند به شکل موثرتری منابع سیستم را مدیریت کنند و عملیات داده‌کاوی را سریع‌تر و مطمئن‌تر انجام دهند. بررسی کامل این تغییرات و ارزیابی کاربردی آن‌ها، در جهت بهره‌برداری بهتر از نسخه جدید پستگرس ۱۸ اهمیت زیادی دارد و می‌تواند در ارتقای عملکرد سیستم‌های مبتنی بر آن تاثیرگذار باشد.

#پستگرس #بهبود_عملکرد #پایگاه‌داده #پیشرفت_فنی

🟣لینک مقاله:
https://aws.amazon.com/blogs/database/postgresql-18-on-amazon-aurora-and-amazon-rds-performance-enhancements/


👑 @Database_Academy
🔵 عنوان مقاله
pg_stats: How Postgres Internal Stats Work

🟢 خلاصه مقاله:
در دنیای پایگاه‌های داده، آگاهی از عملکرد داخلی سیستم نقش بسیار مهمی در بهبود کارایی و بهینه‌سازی است. یکی از ابزارهای قدرتمند در این حوزه، بخش "pg_stats" در PostgreSQL است که به ما امکان می‌دهد تا نگاهی دقیق به آمار و اطلاعات داخلی این سیستم بیندازیم. این بخش، به عنوان یک منبع مهم برای تحلیل و بررسی رفتار پایگاه داده، مستقیماً بر تصمیم‌گیری‌های بخش برنامه‌ریزی پرس‌وجو تأثیر می‌گذارد.

با درک نحوه کار "pg_stats"، می‌توانیم نحوه جمع‌آوری، نگهداری و استفاده از این آمارها را بهتر بشناسیم. اطلاعاتی که این بخش ارائه می‌دهد، شامل جزئیاتی درباره توزیع داده‌ها، میزان استفاده از فهرست‌ها و توابع آماری مرتبط است. این داده‌ها، به برنامه‌ریزی پرس‌وجو کمک می‌کند تا انتخاب بهینه‌ترین مسیر را برای اجرای عملیات‌ها داشته باشد، و در نتیجه، کارایی کلی سیستم ارتقا یابد.

در نهایت، دانستن نحوه عملکرد و تأثیر "pg_stats" جهت بهبود استراتژی‌های بهینه‌سازی و تقویت عملکرد پایگاه داده‌های PostgreSQL، امری حیاتی است. با آگاهی از این جزئیات، توسعه‌دهندگان و مدیران سیستم قادر خواهند بود تا تصمیمات مؤثرتری در زمینه طراحی، تنظیم و بهبود پایگاه‌های داده خود اتخاذ کنند. این مجموعه اطلاعات، ابزاری قدرتمند است که نقش کلیدی در موفقیت پروژه‌های داده‌محور ایفا می‌کند.

#پستگرس #آمارپایگاهداده #بهینه‌سازی #توسعهپایگاهداده

🟣لینک مقاله:
https://richyen.com/postgres/2026/06/22/pg_stats_how_postgres_internal_stats_work.html


👑 @Database_Academy
🔵 عنوان مقاله
The Only Scalable Delete in Postgres is DROP TABLE

🟢 خلاصه مقاله:
در دنیای مدیریت پایگاه داده‌ها، یکی از چالش‌های رایج و مهم، عملیات حذف داده‌ها است. به‌ویژه در سیستم‌هایی مانند پستگرس، عملیات حذف دسته‌جمعی ممکن است هزینه‌های قابل توجهی به سیستم وارد کند، چرا که اجرای یک DELETE بزرگ معمولاً زمان‌بر و مصرف‌ منابع است. در بسیاری از موارد، بهتر است به جای حذف تدریجی و با ردیف‌های جداگانه، از عملیات‌های جایگزین مانند DROP TABLE یا TRUNCATE استفاده شود که می‌توانند تأثیر قابل توجهی در بهبود کارایی داشته باشند.

به یاد داشته باشید که عملیات DELETE در حجم‌های بزرگ، نه تنها زمان بر است بلکه باعث بروز حجم قابل توجهی از لاگ‌ها و سربارهای سیستم می‌شود، که این موضوع ممکن است سیستم را کند کرده و منابع را هرچه بیشتر مصرف کند. در مقابل، عملیات‌هایی مانند DROP TABLE یا TRUNCATE، که در واقع یک حذف کلی و سریع هستند، اغلب در کاهش هزینه و زمان عملیات بسیار موثرند. به همین دلیل، در مواردی که نیاز به حذف سریع و بی‌حاشیه دارید، بهتر است روند کار را بازنگری کنید و از این روش‌ها بهره ببرید.

در نهایت، توجه به این نکته حائز اهمیت است که تنها روش قابل توسعه‌پذیر و موثر برای حذف دسته‌جمعی در پستگرس، عملیات DROP TABLE است. این روش، در برخی موارد، مسیر صرفه‌جویی چشمگیری در زمان و منابع سیستم را ارائه می‌دهد و باعث می‌شود عملیات حذف در حداقل زمان ممکن صورت گیرد. بنابراین، شناخت و بهره‌برداری صحیح از این امکانات می‌تواند به مدیریت بهتر و بهینه‌تر پایگاه داده‌ها کمک کند.

#پایگاه_داده #مدیریت_پستگرس #حذف_داده #کارایی

🟣لینک مقاله:
https://planetscale.com/blog/the-only-scalable-delete


👑 @Database_Academy
🔵 عنوان مقاله
The Identity Crisis: Why Entity Resolution Is the Missing Foundation of Every Data Product Stack (10 minute read)

🟢 خلاصه مقاله:
بحران هویت: چرا حل‌وفصل هویت اصلی‌ترین زیرساخت گم‌شده در هر مجموعه داده است

در دنیای داده‌های امروزی، شناسایی دقیق هویت افراد و عناصر مختلف امری حیاتی است. حل‌وفصل هویت یا «اینتیتی ریزولوشن» و مدیریت داده‌های اصلی (MDM) محلی، جزو زیرساخت‌های اصلی برای ساخت محصولات داده مطمئن، هوش مصنوعی و پیروی از مقررات هستند. در سطح سازمانی، تکیه بر بررسی‌های کوچک و محلی کافی نیست و ممکن است منجر به تکرار مشتریان، موجودیت‌های نامرئی و خطر آسیب زدن به مدل‌های پیش‌بینی شود. بنابراین، راهکارهای جامع و پیشرفته‌تری برای حل‌وفصل هویت نیاز است که به صورت داخلی و در خود مخزن داده‌ها اجرا شوند.

در این فرآیند، مجموعه‌ای از روش‌ها و فناوری‌ها کنار هم قرار می‌گیرند تا به دقت هر چه بیشتر هویت‌ها را شناسایی و مدیریت کنند. این مجموعه شامل بلاک کردن یا جلوگیری از تکرار، تطابق بر اساس قوانین و الگوریتم‌های یادگیری ماشین، خوشه‌بندی گراف و همچنین بازبینی‌های انسانی است که در داخل مخزن داده‌ها انجام می‌شود. این ترکیب قوی، دقت و صحت اطلاعات را افزایش می‌دهد و از بروز خطاهای ناشی از داده‌های تکراری یا نادرست جلوگیری می‌کند.

در نتیجه، این رویکرد چندلایه و جامع، نقش کلیدی در ساختاردهی و اعتمادپذیری داده‌ها دارد و راه را برای توسعه محصولاتی پایدار و قابل اعتماد هموار می‌کند. اهمیت این فناوری در حجم انبوه داده‌های امروزی و نیاز به اطمینان از صحت اطلاعات بی‌نظیر است و بدون آن نمی‌توان به‌طور کامل به پیشرفت‌های حوزه هوش مصنوعی و تحلیل داده‌های بزرگ دست یافت.

#اینتیتی_ریزولوشن #مدیریت_داده #هوش_مصنوعی #امنیت_داده

🟣لینک مقاله:
https://moderndata101.substack.com/p/the-identity-crisis-entity-resolution?utm_source=tldrdata


👑 @Database_Academy
🔵 عنوان مقاله
Migration Autopilot: GitHub Action to Review DB Migration PRs

🟢 خلاصه مقاله:
در دنیای توسعه نرم‌افزار، مدیریت و بررسی تغییرات در پایگاه داده نقش بسیار حیاتی دارد. یکی از چالش‌های معمول، بررسی درخواست‌های اصلاح پایگاه داده یا همان PRهای مربوط به مهاجرت دیتابیس است که شامل تغییراتی مانند تغییر نام ستون‌ها یا جداول، حذف آن‌ها، یا کاهش حجم داده‌ها است. این فرآیند، به ویژه در پروژه‌های بزرگ و تداوم‌پذیر، نیازمند دقت و زمان زیادی است تا از بروز خطاهای احتمالی جلوگیری شود.

برای حل این مشکل، ابزارهای هوشمند و خودکار می‌توانند نقش مؤثری ایفا کنند. یکی از این ابزارها، اکشنی در GitHub است که با هدف بررسی و ارزیابی درخواست‌های تغییر پایگاه داده طراحی شده است. این اکشن به صورت خودکار شرایط مختلفی را در تغییرات دیتابیس شناسایی می‌کند؛ مانند تغییر نام جداول و ستون‌ها، حذف آن‌ها، یا عملیات مشابه دیگر. این سیستم، به توسعه‌دهندگان کمک می‌کند تا قبل از ادغام نهایی، خطاهای احتمالی و ناهماهنگی‌های موجود در فایل‌های مهاجرت را تشخیص دهند.

با این رویکرد، فرآیند بررسی درخواست‌های اصلاح پایگاه داده سریع‌تر و مطمئن‌تر انجام می‌شود و توسعه‌دهندگان می‌توانند با اطمینان بیشتری تغییرات خود را ثبت و منتشر کنند. در نتیجه، کیفیت و امنیت پایگاه داده در پروژه‌های نرم‌افزاری افزایش یافته و خطر بروز خطاهای بزرگ کاهش می‌یابد.

#مهاجرت_پایگاه_داده #اتوماسیون_نرم‌افزار #مدیریت_پروژه #GitHub

🟣لینک مقاله:
https://migration.useautopilot.dev/


👑 @Database_Academy
🔵 عنوان مقاله
Scaling Postgres to 226k TPS: A Christmas Day Retrospective

🟢 خلاصه مقاله:
در این مقاله، به بررسی دقیق و جامع چگونگی افزایش ظرفیت پایگاه داده پستگرس می‌پردازیم که توانست در روزهای تعطیلات کریسمس، با عبور از مرز ۲۲۶ هزار تراکنش در ثانیه (TPS)، عملکرد بی‌نظیری را به نمایش بگذارد. ابتدا به وضعیتی اشاره می‌کنیم که در سال ۲۰۲۴، زمان اوج تعطیلات، سیستم شرکت به دلیل محدودیت‌های ساختاری و زیرساختی، ناگهان دچار خرابی و کاهش کارایی شد. این مشکل، شرکت را وادار کرد تا به سرعت راهکارهای اصلاح و بهبود را اجرا کند تا در آینده بتواند پاسخگوی نیازهای رو به رشد خود باشد.

سپس، با مرور روند تغییراتی که در معماری بانک‌های اطلاعاتی، تنظیمات سرور، و تکنیک‌های مقیاس‌پذیری اتخاذ شد، نشان می‌دهیم چگونه تیم فنی با برنامه‌ریزی دقیق و اجرای اصلاحات موثر، توانست توان عملیاتی سیستم را به شکل قابل توجهی افزایش دهد و در نهایت، در روزهای تعطیلات سال ۲۰۲۵، بدون هیچ مشکلی، حجم ترافیک بی‌سابقه‌ای را مدیریت کند. این موفقیت نه تنها از دید فنی، بلکه از نظر استراتژیک، یادآور اهمیت آمادگی و انعطاف‌پذیری در مواجهه با زمان‌های پرترافیک است.

در پایان، دستاوردهای این تغییرات و استراتژی‌ها را جمع‌بندی کرده و بر اهمیت پیوستگی و بهبود مداوم در زیرساخت‌های فناوری تأکید می‌نماییم. نتایج حاصله نشان می‌دهد که با برنامه‌ریزی و اجرای دقیق، می‌توان از پس چالش‌های سنگین در زمینه‌های مقیاس‌پذیری و پایداری برآمد و سیستم‌هایی پایدارتر و مقیاس‌پذیرتر ساخت.

#پایگاهداده #پستگرس #مقیاسپذیری #تکنولوژی

🟣لینک مقاله:
https://andyatkinson.com/postgresql-rds-scaling-aws-christmas-day-peak


👑 @Database_Academy
🔵 عنوان مقاله
How I Got Started Running a Postgres User Group

🟢 خلاصه مقاله:
در این مقاله، جریمی اشر نقشه راه خودش برای شروع و مدیریت یک گروه کاربری پستگرس را به اشتراک می‌گذارد. او با همکاری کلر جیوردانو، به اهمیت گروه‌های محلی پستگرس در پیشرفت حرفه‌ای اشاره می‌کند و توضیح می‌دهد که چرا تلاش و زحمتی که برای برپایی و اداره این گروه‌ها صرف می‌شود، ارزشمند است. این گروه‌ها نه تنها فرصت‌های شبکه‌سازی و یادگیری را فراهم می‌کنند، بلکه به توسعه مهارت‌های فنی و شخصی اعضا نیز کمک می‌کنند، و برای کسانی که قصد دارند در حوزه پایگاه داده‌های متن‌باز فعالیت کنند، مسیرهای سریع‌تر و موثرتری فراهم می‌آورند.

در ادامه، جریمی اشر درباره تجربیات شخصی‌اش صحبت می‌کند و چطور شروع این مسیر به او کمک کرده است تا با افراد متخصص و علاقه‌مند در این حوزه آشنا شود. او بر اهمیت پشتکار و تعهد در راه‌اندازی چنین گروه‌هایی تأکید می‌کند و می‌گوید این تلاش‌ها تاثیر طولانی‌مدتی بر رشد حرفه‌ای و شبکه ارتباطات شخصی‌اش داشته‌اند. در نهایت، او خطاب به علاقه‌مندان می‌گوید که با ادامه دادن، می‌توانند فرصت‌های شغلی و یادگیری بی‌نظیری را تجربه کنند و جامعه کاربری پستگرس را تقویت کنند.

این گفت‌وگو الهام‌بخشی است برای همه کسانی که می‌خواهند وارد دنیای متن‌باز و توسعه حرفه‌ای شوند، و نشان می‌دهد که فعالیت در گروه‌های محلی چقدر می‌تواند در مسیر حرفه‌ای فزاینده نقش مؤثری ایفا کند.

#پستگرس #گروهکاربری #توسعه_حرفه‌ای #شبکه‌سازی

🟣لینک مقاله:
https://talkingpostgres.com/episodes/how-i-got-started-running-a-postgres-user-group-with-jeremy-schneider


👑 @Database_Academy
🔵 عنوان مقاله
the slides in PDF form.

🟢 خلاصه مقاله:
در آخرین نسخه از خبرنامه هفتگی PostgreSQL، مجموعه‌ای از اسلایدها در قالب فایل PDF منتشر شد که موضوعات مختلف مرتبط با این پایگاه داده قدرتمند را پوشش می‌دهد. این مجموعه اسلایدها، فرصت مناسبی است برای توسعه‌دهندگان، مدیران سیستم و علاقه‌مندان به PostgreSQL تا نگاهی عمیق‌تر به جدیدترین ویژگی‌ها، بهبودها و نکات فنی این سیستم بدهند. با مطالعه این فایل‌ها، کاربران می‌توانند به‌روزتر باشند و بهترین روش‌های استفاده از PostgreSQL را بیاموزند، دوره‌های آموزشی، نکات تخصصی و راهنمایی‌های کاربردی در دسترس قرار می‌گیرد تا بهره‌وری در مدیریت و توسعه بانک‌های اطلاعاتی افزایش یابد. بنابراین، اگر به دنبال به‌روز نگه‌داشتن دانش خود در زمینه PostgreSQL هستید، این اسلایدهای PDF یکی از منابع ارزشمند برای پیگیری آخرین تحولات و ابزارهای این حوزه است.

#PostgreSQL #توسعه_نرم‌افزار #مدیریت_دیتابیس #آموزش

🟣لینک مقاله:
https://momjian.us/main/writings/pgsql/missing.pdf


👑 @Database_Academy
🔵 عنوان مقاله
Looking Ahead to Postgres 19

🟢 خلاصه مقاله:
در آینده نزدیک، نسخه ۱۹ پایگاه داده Postgres قرار است معرفی شود و انتظار می‌رود که امکانات و بهبودهای زیادی را به همراه داشته باشد. «Postgres 19 حس می‌کند یکی از نسخه‌هایی است که در آن همه چیز کمی وجود دارد»، این جمله از کریگ است که تمرکز خاصی بر روی بهبودهای کیفیت زندگی کاربران در حین کار روزمره با پایگاه داده دارد. هدف اصلی توسعه‌دهندگان در این نسخه، ارائه امکاناتی است که در عملیات روزمره، کاربرپسند و کارآمدتر باشد، تا بهره‌وری و سهولت استفاده در محیط‌های مختلف به طور قابل توجهی افزایش یابد. این تغییرات، نه تنها در سطح عملکرد و امنیت، بلکه در تجربه کاربری نیز تحولی چشمگیر خواهند بود و قطعا طرفداران منتظر نسخه جدید هستند تا بتوانند از امکانات بی‌نظیر آن بهره‌مند شوند.

پایگاه داده پوسټگرس با تمرکز بر بهبودهای مستمر، در تلاش است تا نیازهای متنوع کسب‌وکارها و توسعه‌دهندگان را پاسخ دهد و نسخه ۱۹ نیز از این قاعده مستثنی نیست. انتظار می‌رود این نسخه امکاناتی برای ساده‌سازی فرآیندهای مدیریتی، بهبود عملکرد در عملیات سنگین، و افزودن قابلیت‌های جدید برای توسعه برنامه‌های کاربردی ارائه کند. این به‌روزرسانی‌ها، در کنار حفظ پایداری و امنیت، تجربه کاربری را ارتقاء می‌دهند و باعث می‌شوند که کاربران بتوانند با اطمینان بیشتری از این سیستم قدرتمند استفاده کنند. در کل، نسخه ۱۹ پایگاه داده Postgres نویدبخش فرصت‌های جدید و امکانات پیشرفته‌ای است که نقش مهمی در توسعه و بهبود سیستم‌های مبتنی بر دیتابیس ایفا خواهد کرد.

#پایگاهداده #پستگرس #کدمنحصر #توسعهپایدار

🟣لینک مقاله:
https://www.snowflake.com/en/blog/engineering/postgresql-19-features-beta/


👑 @Database_Academy
🔵 عنوان مقاله
What's Missing in Postgres?

🟢 خلاصه مقاله:
در حال حاضر، پایگاه داده‌های مبتنی بر پستگرس به طور مداوم ویژگی‌ها و امکانات جدیدی را به خود اضافه می‌کنند که توسعه‌دهندگان زیادی را راضی می‌کند. اما در کنار این پیشرفت‌ها، همیشه سوال‌هایی درباره قابلیت‌هایی وجود دارد که هنوز در این سیستم قرار نگرفته یا کامل نیستند و چرایی این کمبودها مورد توجه است. در این مقاله، بروش برک، به موضوعاتی متنوع و مهم از جمله تقسیم‌بندی داده‌ها (sharding)، مدیریت اتصال‌ها (connection pooling)، ذخیره‌سازی ستونی (columnar storage) و رمزنگاری شفاف داده‌ها (transparent data encryption) می‌پردازد. او نکاتی را مطرح می‌کند که نشان می‌دهد چرا این ویژگی‌ها هنوز در دسترس نیستند یا در حال توسعه هستند و چه مسائلی مانع پیاده‌سازی سریع‌تر آنها می‌شود. اگر فرصت تماشا ندارید، اسلایدهای ارائه در قالب فایل PDF نیز در دسترس است تا بتوانید جزئیات بیشتری از این موضوعات را دریافت کنید.

در مجموع، مقاله بر بهبودهای مداوم و چالش‌هایی که پستگرس با آنها روبه‌رو است تمرکز دارد، و نگاهی دقیق به مسائلی می‌اندازد که شاید در آینده نزدیک برطرف شوند یا نیاز به حمایت جامعه توسعه‌دهندگان دارند تا این سیستم قدرتمند به شکل کامل‌تر و کارآمدتری عمل کند.

#پستگرس #پایگاه‌داده #توسعه_نرم‌افزار #تکنولوژی

🟣لینک مقاله:
https://www.youtube.com/watch?v=ppGO7r2sEkE


👑 @Database_Academy
Forwarded from Software Engineer
📖 واژه‌نامه مفاهیم تخصصی
اگر هنگام مطالعه درباره Copy Fail و Dirty Frag با اصطلاحات ناشناخته روبه‌رو شدید، این واژه‌نامه می‌تواند کمک کند.
━━━━━━━━━━━━━━
🔐 مفاهیم پایه
🆔 CVE (Common Vulnerabilities and Exposures)
تعریف کوتاه: شناسه جهانی آسیب‌پذیری‌های امنیتی.
هر آسیب‌پذیری پس از ثبت، یک شماره منحصربه‌فرد مانند CVE-2026-31431 دریافت می‌کند تا پژوهشگران و شرکت‌ها درباره یک باگ مشخص با نامی یکسان صحبت کنند.
چرا مهم است؟
تمام گزارش‌های امنیتی و وصله‌های رسمی بر اساس شماره CVE منتشر می‌شوند.
━━━━━━━━━━━━━━
📊 CVSS (Common Vulnerability Scoring System)
تعریف کوتاه: معیار سنجش شدت یک آسیب‌پذیری.
امتیازها بین ۰ تا ۱۰ هستند.
• ۰ تا ۳.۹ → Low
• ۴ تا ۶.۹ → Medium
• ۷ تا ۸.۹ → High
• ۹ تا ۱۰ → Critical
چرا مهم است؟
هرچه امتیاز بالاتر باشد، اولویت نصب وصله نیز بیشتر است.
━━━━━━━━━━━━━━
🔓 Local Privilege Escalation (LPE)
تعریف کوتاه: ارتقای دسترسی از کاربر عادی به مدیر سیستم.
فرض کنید فردی با کارت ورود یک کارمند وارد ساختمان شده است؛ اگر بتواند کارت مدیرکل را به دست آورد، دقیقاً همان اتفاقی است که در یک حمله LPE رخ می‌دهد.
چرا مهم است؟
هر دو آسیب‌پذیری Copy Fail و Dirty Frag از همین نوع هستند.
━━━━━━━━━━━━━━
👑 Root
تعریف کوتاه: بالاترین سطح دسترسی در لینوکس.
کاربر Root می‌تواند هر تغییری روی سیستم انجام دهد؛ از حذف فایل‌ها گرفته تا نصب نرم‌افزار و تغییر تنظیمات امنیتی.
━━━━━━━━━━━━━━
💾 مفاهیم حافظه
🧠 Page Cache
تعریف کوتاه: نسخه‌ای از فایل‌ها که لینوکس برای افزایش سرعت در RAM نگه می‌دارد.
به‌جای خواندن مداوم فایل از دیسک، سیستم نسخه‌ای از آن را در حافظه ذخیره می‌کند.
چرا مهم است؟
Copy Fail و Dirty Frag فایل روی دیسک را تغییر نمی‌دهند؛ بلکه نسخه موجود در Page Cache را دستکاری می‌کنند.
━━━━━━━━━━━━━━
🗂 Scatterlist
تعریف کوتاه: فهرستی از بخش‌های پراکنده حافظه.
کرنل به‌جای جابه‌جایی داده‌ها، محل قرارگیری آن‌ها را در یک لیست ثبت می‌کند تا عملیات‌هایی مانند رمزنگاری سریع‌تر انجام شوند.
━━━━━━━━━━━━━━
✏️ Scratch Buffer (Scratch Pad)
تعریف کوتاه: فضای موقت برای انجام محاسبات.
مانند چرک‌نویسی که هنگام حل یک مسئله استفاده می‌کنید.
چرا مهم است؟
در Copy Fail این فضای موقت به اشتباه روی حافظه‌ای قرار گرفت که نباید تغییر می‌کرد.
━━━━━━━━━━━━━━
⚙️ In-place Processing
تعریف کوتاه: پردازش داده در همان محل ذخیره‌سازی.
به‌جای ایجاد یک نسخه جدید، همان داده اصلی تغییر می‌کند.
مزیت: سرعت بیشتر.
ریسک: اگر مرزهای حافظه درست مدیریت نشوند، ممکن است داده‌های حساس تغییر کنند.
━━━━━━━━━━━━━━
🐧 مفاهیم کرنل لینوکس
🧩 Kernel
هسته سیستم‌عامل که ارتباط بین نرم‌افزار و سخت‌افزار را مدیریت می‌کند.
هر آسیب‌پذیری در کرنل می‌تواند کل سیستم را تحت تأثیر قرار دهد.
━━━━━━━━━━━━━━
🔌 Kernel Module
افزونه‌ای برای کرنل که بدون راه‌اندازی مجدد سیستم قابل بارگذاری یا حذف است.
در این آسیب‌پذیری‌ها، ماژول‌های زیر درگیر بودند:
algif_aead
esp4
esp6
rxrpc
━━━━━━━━━━━━━━
🔐 AF_ALG
رابطی از نوع Socket که به برنامه‌های معمولی اجازه می‌دهد از قابلیت‌های رمزنگاری کرنل استفاده کنند.
در Copy Fail مسیر حمله از همین رابط آغاز می‌شود.
━━━━━━━━━━━━━━
🔄 splice()
یک فراخوان سیستمی (System Call) برای انتقال مستقیم داده بین بخش‌های مختلف کرنل، بدون عبور از فضای کاربر.
همین ویژگی باعث می‌شود عملیات سریع‌تر انجام شود.
━━━━━━━━━━━━━━
🌐 IPsec / ESP
IPsec مجموعه‌ای از پروتکل‌های امنیت شبکه است.
ESP بخش رمزنگاری داده‌ها در IPsec را بر عهده دارد.
Dirty Frag از همین مسیر سوءاستفاده می‌کند.
━━━━━━━━━━━━━━
📡 RxRPC
یک پروتکل ارتباطی در کرنل لینوکس که بیشتر در سیستم فایل توزیع‌شده AFS استفاده می‌شود.
یکی از دو آسیب‌پذیری Dirty Frag در همین بخش قرار داشت.
━━━━━━━━━━━━━━
🏗 مفاهیم زیرساخت
🏁 Race Condition
وقتی نتیجه اجرای برنامه به ترتیب یا زمان‌بندی اجرای چند عملیات هم‌زمان وابسته باشد.
نکته مهم:
Copy Fail و Dirty Frag برخلاف آسیب‌پذیری‌هایی مانند Dirty COW به Race Condition وابسته نیستند.
━━━━━━━━━━━━━━
🧪 Proof of Concept (PoC)
نمونه کدی که نشان می‌دهد یک آسیب‌پذیری واقعاً قابل بهره‌برداری است.
انتشار PoC معمولاً باعث می‌شود مهاجمان سریع‌تر بتوانند حمله را بازسازی کنند.
━━━━━━━━━━━━━━
☁️ Multi-tenant
محیطی که چند کاربر یا سازمان از یک زیرساخت مشترک استفاده می‌کنند.
به همین دلیل، یک حمله LPE می‌تواند روی داده‌های سایر کاربران نیز اثر بگذارد.
━━━━━━━━━━━━━━
📦 Container / Kubernetes
Container محیطی ایزوله برای اجرای برنامه است و Kubernetes مدیریت تعداد زیادی Container را انجام می‌دهد.
نکته مهم:
2
🔵 عنوان مقاله
The Hitchhiker’s Guide to PostgreSQL Hacking

🟢 خلاصه مقاله:
در دنیای فناوری و پایگاه‌های داده، PostgreSQL یکی از قدرتمندترین و پرکاربردترین سیستم‌های مدیریت پایگاه داده است که میلیون‌ها کاربر در سراسر جهان از آن استفاده می‌کنند. آشنایی با نحوه کار و هک کردن ساختار این سیستم، نه تنها دانش فنی عمیقی به فرد می‌بخشد، بلکه باعث درک بهتر نقاط ضعف و قوت آن می‌شود. در این مقاله، راهنمایی کاربردی برای کسانی ارائه می‌شود که قصد دارند با کد base PostgreSQL کار کرده و بیشتر در جریان امنیت و نحوه هک کردن این پایگاه داده قرار بگیرند.

در ادامه، به مطالعه و درک اصول اولیه، ابزارهای مورد نیاز، و ترفندهای ابتدایی برای شروع می‌پردازیم. این راهنما، مانند یک دفترچه راهنمای سفر برای هکرهای اخلاقی و توسعه‌دهندگان امنیت است که می‌خواهند در مسیر بهبود امنیت سیستم‌های پایگاه داده قدم بگذارند. با تمرکز بر مباحث جذاب و چالش‌برانگیز، سعی شده تمامی خوانندگان بتوانند به شکل اصولی و عملی وارد حوزه هک و تست نفوذ PostgreSQL شوند و مهارت‌های لازم را کسب نمایند.

در نهایت، هدف این است که بتوانید درک عمیقی نسبت به ساختار داخلی PostgreSQL پیدا کنید، آسیب‌پذیری‌های احتمالی را شناسایی کنید و راهکارهای مقابله با آن‌ها را بیاموزید. این مسیر، چالش‌بخش اما سودمند است و می‌تواند در ارتقای سطح امنیت و مهارت‌های فنی نقشی اساسی ایفا کند.

#پایگاه‌داده #امنیت #PostgreSQL #هک

🟣لینک مقاله:
https://www.youtube.com/watch?v=YY8UCINpe5c&list=PLOBORF8Y_l8g&index=38


👑 @Database_Academy
🔵 عنوان مقاله
Postgres 19 Hackers Panel

🟢 خلاصه مقاله:
در جلسه پنل هکرهای پستگرس ۱۹، چهار نفر از توسعه‌دهندگان این بانک اطلاعاتی محبوب در مورد فرآیند توسعه و انتشار آن صحبت کردند. آنها جزئیات نحوه انتخاب ویژگی‌ها و تغییرات را توضیح دادند و دلایل پشت این تصمیمات را بیان کردند. این گفتگو فرصتی بود برای فهم بهتر روند کاری تیم توسعه‌دهندگان و چالش‌هایی که در مسیر به‌روز‌رسانی‌های مهم پستگرس وجود دارد. همچنین، در این نشست، برخی ویژگی‌های آینده پستگرس، که قرار است به نسخه‌های بعدی افزوده شوند، به طور مختصر مورد بحث قرار گرفت و نگاه کلی به آینده این پروژه از دیدگاه تیم توسعه‌دهندگان ارائه شد.

پیشنهادهای جدید و امکانات آینده پستگرس، که می‌تواند پاسخگوی نیازهای رو به رشد کاربران باشد، مورد تحلیل قرار گرفت. شرکت‌کنندگان این پنل، با شفافیت درباره روند تصمیم‌گیری‌ها و اولویت‌بندی‌های تیم توسعه، نشان دادند که چگونه تلاش می‌کنند تا پستگرس همواره در خط مقدم فناوری بانک‌های اطلاعاتی قرار داشته باشد و بتواند انتظارات جامعه کاربری خود را برآورده کند. این گفتگو به علاقمندان و توسعه‌دهندگان کمک می‌کند تا درک بهتری از لایه‌های داخلی و چشم‌اندازهای توسعه پستگرس داشته باشند.

#پستگرس #توسعه_نرم_افزار #پروژه_بازمتن #فناوری_میزبانی

🟣لینک مقاله:
https://www.youtube.com/watch?v=Vw4WKeoxKq4&list=PLOBORF8Y_l8g&index=3


👑 @Database_Academy
🔵 عنوان مقاله
Biscuit: A High-Performance Pattern Matching Index

🟢 خلاصه مقاله:
در دنیای جست‌وجو و تحلیل داده‌ها، سرعت و دقت در یافتن الگوهای خاص اهمیت فراوانی دارد. یکی از چالش‌های رایج در این حوزه، اجرای عملیات‌های مقایسه الگو مانند LIKE و ILIKE است که در بانک‌های اطلاعاتی و سیستم‌های مدیریت داده‌ها کاربرد فراوانی دارند. این عملیات‌ها، به ویژه زمانی که دیتابیس‌ها بزرگ می‌شوند، ممکن است زمان‌بر و پردازش‌بر باشند و باعث کاهش کارایی سیستم شوند.

برای حل این مشکل، تیم توسعه‌دهندگان اقدام به معرفی نسخه‌ای آزمایشی و تخصصی از روش‌های دسترسی به ایندکس کرده‌اند که به صورت خاص برای این نوع عملیات‌ها طراحی شده است. این روش که نام آن "بیسکویت" (Biscuits) است، به عنوان یک ایندکس قدرتمند و بهینه، عملکرد بسیار بالایی در تشخیص سریع الگوهای مورد نظر دارد. هدف این ابتکار، کاهش زمان پاسخگویی و افزایش راندمان سیستم‌های پایگاه داده در عملیات‌های تطابق الگوهای پیچیده است.

این ایندکس جدید با بهره‌گیری از ساختارهای پیشرفته و فناوری‌های نوین، امکان جست‌وجوی سریع‌تر و دقیق‌تر در داده‌های بزرگ را فراهم می‌کند. در نتیجه، کاربران و توسعه‌دهندگان می‌توانند با اطمینان بیشتر و هزینه‌های کمتر، عملیات‌های تطابق الگو را اجرا و تحلیل کنند. در مجموع، "بیسکویت" نوآوری جدیدی است که می‌تواند تاثیر چشمگیری در بهبود کارایی سیستم‌های داده‌ای داشته باشد و راهکار سریع‌تری برای نیازهای روزمره در جست‌وجوهای پیچیده باشد.

#ایندکس_پایگاه‌داده #جست‌وجوی_پایدار #تحلیل_داده #پیشرفت_فناوری

🟣لینک مقاله:
https://github.com/CrystallineCore/Biscuit


👑 @Database_Academy
1
🔵 عنوان مقاله
‘backend killer’ workload

🟢 خلاصه مقاله:
در دنیای توسعه و مدیریت سیستم‌های بزرگ، چند نوع بار کاری می‌تواند چالش‌برانگیز باشد. یکی از این موارد، وظایف مرتبط با عملیات «کشتن فرانت‌اند» است، که معمولاً در اثر مصرف زیاد حافظه یا خطاهای سیستم بروزرسانی‌ها اتفاق می‌افتد. این نوع کار، که به «وظیفه کشنده Backend» معروف است، می‌تواند تاثیر زیادی بر عملکرد سرور و ثبات کل سیستم داشته باشد، زیرا مصرف بی‌رویه منابع سبب کندی و در نهایت توقف عملیات می‌شود.

از سوی دیگر، یک نوع بار کاری دیگر به نام «بار کار رزومه‌گذاری بیش از حد» یا «وظیفه پر شدن جایگاه‌ها» است که معمولاً در نتیجه تخصیص نادرست منابع و عدم مدیریت مناسب ظرفیت‌ها، بروز می‌کند. در این حالت، سیستم با درخواست‌ها یا وظایف اضافی مواجه می‌شود که منجر به اشغال غیرضروری و بی‌رویه فضای حافظه و منابع دیگر می‌گردد. این فشار اضافی نه تنها باعث کاهش کارایی سیستم می‌شود، بلکه ممکن است در موارد حاد، آن را به حالت آماده‌باش کامل یا «گرفتار شدن» ببرد.

در نتیجه، شناخت و مدیریت این نوع وظایف یکی از چالش‌های کلیدی توسعه‌دهندگان و مدیران فنی است. استراتژی‌های مؤثر برای کاهش این بارهای کاری، شامل بهبود برنامه‌ریزی منابع، استفاده از ابزارهای نظارتی دقیق، و طراحی مجدد سیستم‌ها برای مقابله بهتر با شرایط استرس‌زا است.

#مدیریت_منابع #سرعت_عملکرد #بهبود_سیستم #توسعه‌دهندگان

🟣لینک مقاله:
https://github.com/lesovsky/noisia/pull/12


👑 @Database_Academy
🔵 عنوان مقاله
Running pgvector in Production on Amazon Aurora

🟢 خلاصه مقاله:
در دنیای توسعه پایگاه‌های داده، افزودن قابلیت‌های پیشرفته و بهبود عملکرد برای مدیریت داده‌های بزرگ و پیچیده اهمیت فراوانی دارد. یکی از فناوری‌های نوین در این حوزه، افزونه pgvector است که امکان کار با وکتورهای چندبعدی را در پایگاه‌های داده PostgreSQL فراهم می‌کند. این ابزار به ویژه برای پروژه‌هایی که نیازمند تشخیص شباهت، جستجوی تطبیقی، یا تحلیل داده‌های تصویری و صوتی هستند، بسیار مفید است.

استفاده از pgvector در محیط‌های عملیاتی و در تولید، نیازمند دانش فنی دقیق در زمینه انتخاب شاخص‌های مناسب، تنظیمات کوانتایزاسیون، عملیات پرس‌وجو و پیکربندی‌های بهینه است. در این راهنما، تمرکز بر نحوه اجرای موثر pgvector در سرویس‌های Amazon Aurora است؛ جایی که بهره‌وری، اطمینان‌پذیری و مقیاس‌پذیری اهمیت ویژه‌ای دارند. هرچند این راهنما به طور خاص برای Aurora تهیه شده، اما مفید بودن آن برای کاربرانی که در سایر محیط‌ها از این افزونه استفاده می‌کنند، قابل توجه است.

در نهایت، هدف اصلی ارائه راهنمایی است که بتواند توسعه‌دهندگان و مدیران پایگاه داده را در بهره‌برداری حداکثری از قابلیت‌های pgvector با تمرکز بر الزامات تولید، راهنمایی کند و مسیر پیاده‌سازی موثر و مسلط بر این فناوری را هموار سازد.

#پایگاه_داده #pgvector #آرورا #توسعه_نرم‌افزار

🟣لینک مقاله:
https://aws.amazon.com/blogs/database/running-pgvector-in-production-on-amazon-aurora-postgresql/


👑 @Database_Academy