هوش مصنوعی و علم داده به فارسی
6.06K subscribers
2.1K photos
516 videos
366 files
2.29K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
‏🤖 آموزش LLM از صفر با PyTorch

‏🚀 این مخزن PyTorch به نام "Train LLM From Scratch" یک راهنمای عملی برای ساخت، آموزش و استفاده از مدل زبان ترانسفورمر (Transformer Language Model) از پایه است.
‏💡 هدف آن تبدیل درک نظری از معماری ترانسفورمر به یک پایپ‌لاین آموزشی عملی و قابل اجرا، شامل کد مدل، اسکریپت‌های داده، پیکربندی و تولید متن است.

‏
‏⚙️ ویژگی‌های کلیدی:
‏🔹 اجزای ترانسفورمر: پیاده‌سازی ماژول‌های PyTorch جداگانه برای MLP (شبکه چندلایه پرسپترون)، Attention و بلاک‌های ترانسفورمر از صفر.
‏🔸 پایپ‌لاین داده: اسکریپت‌هایی برای دانلود و پیش‌پردازش فایل‌های The Pile (مجموعه داده بزرگ متنی) به فرمت HDF5 (فرمت فایل برای ذخیره‌سازی داده‌های عددی بزرگ) توکن‌گذاری شده.


📊 Data➕Science 🇮🇷 — هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#آموزش #PyTorch
‏💡 نقشه راه مهندسی هوش مصنوعی: گام‌های کلیدی

‏با وجود رشد ۳۰۰ درصدی بازار کار هوش مصنوعی، ۹۰ درصد مهندسان این حوزه به دلیل فقدان نقشه راه موفق نمی‌شوند. یک مسیر ۱۰ مرحله‌ای برای موفقیت در این حوزه پیشنهاد شده که گام‌های اصلی آن عبارتند از:

‏
‏🔹 مبانی پایتون: تسلط بر پایتون، Jupyter Notebook و Git.
‏📈 ریاضیات و آمار: یادگیری مفاهیم کلیدی با NumPy و SciPy (کتابخانه علمی و فنی).
‏🧠 الگوریتم‌های یادگیری ماشین: scikit-learn، pandas، XGBoost/LightGBM.
‏🚀 یادگیری عمیق: PyTorch، TensorFlow، Keras و Weights & Biases (پلتفرم ردیابی آزمایش‌های ML).



📊 Data➕Science 🇮🇷 — هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#آموزش #PyTorch
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 آموزش ساخت مدل شبه GPT در PyTorch با ۱۰ نوت‌بوک گام‌به‌گام

‏اگر به دنبال درک عمیق معماری داخلی LLM‌های مدرن هستید، یک مخزن گیت‌هاب عالی پیدا شده که شامل ۱۰ نوت‌بوک Jupyter با توضیحات دقیق و پیاده‌سازی عملی اجزای اصلی مدل‌های زبانی است. این مخزن از صفر تا صد مراحل ساخت یک مدل مشابه GPT را در PyTorch پوشش می‌دهد و برای یادگیری مفاهیمی مانند self-attention، transformer blocks، tokenization و آموزش گام‌به‌گام مناسب است.

‏🔗 مخزن llms-from-scratch در گیت‌هاب

📊 Data➕Science 🇮🇷 — هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#آموزش #PyTorch
❤2
🚀 ‏ گلچین منابع آموزشی PyTorch

⚡ ‏ اگر به دنبال تسلط بر PyTorch هستید، مخزن پیشنهادی شامل مجموعه‌ای جامع از بهترین منابع یادگیری برای این فریم‌ورک محبوب است. این لیست تمامی سطوح، از مفاهیم پایه تا کاربردهای پیشرفته در یادگیری عمیق را پوشش می‌دهد.

🧠 ‏ این منبع ارزشمند برای افرادی که می‌خواهند مهارت‌های خود را در پیاده‌سازی مدل‌های عصبی ارتقا دهند، بسیار کاربردی است. شما می‌توانید از طریق لینک زیر به این مخزن در GitHub دسترسی داشته باشید.

🔗 ‏ لینک مشاهده منابع PyTorch

📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#آموزش #PyTorch
🚀 ‏ آشنایی با فریم‌ورک‌های محبوب یادگیری عمیق

🧠 ‏ PyTorch یک کتابخانه متن‌باز (Open-source) برای یادگیری عمیق است که توسط Meta توسعه یافته و به دلیل انعطاف‌پذیری بالا و استفاده از گراف محاسباتی پویا، در پروژه‌های تحقیقاتی و صنعتی بسیار محبوب است. این ابزار به دلیل سازگاری کامل با Python، پشتیبانی عالی از عملیات دیباگینگ و بهره‌گیری از قدرت GPU Acceleration (شتاب‌دهنده گرافیکی)، انتخابی استاندارد برای توسعه مدل‌های پیشرفته هوش مصنوعی به شمار می‌رود.

‏
🔹 ‏ یادگیری آسان: منحنی یادگیری ملایم برای کاربران جدید.
🔹 ‏ جامعه کاربری گسترده: وجود اکوسیستم قوی تحقیقاتی و منابع آموزشی فراوان.
🔹 ‏ ساختار داینامیک: امکان تغییر رفتار مدل در زمان اجرا برای انعطاف بیشتر.
‏


⚡️ ‏ در مقابل، Keras یک API سطح بالا است که به عنوان رابط کاربری روی TensorFlow اجرا می‌شود تا فرآیند طراحی شبکه‌های عصبی را به شدت ساده کند. این ابزار با ارائه اینترفیس‌های بسیار ساده برای ساخت، آموزش و ارزیابی مدل‌ها، نیاز به نوشتن کدهای پیچیده را به حداقل می‌رساند.

📊 ‏ این فریم‌ورک گزینه‌ای ایده‌آل برای Fast Prototyping (نمونه‌سازی سریع) است و به‌طور بومی از معماری‌های CNN، RNN و مدل‌های پیشرفته Transformers پشتیبانی می‌کند. Keras به دلیل انتگراسیون کامل با تنسورفلو و کاهش حجم کدنویسی، بهترین نقطه شروع برای افرادی است که قصد ورود به دنیای یادگیری عمیق را دارند.



📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#PyTorch #Keras
‏🚀 یادگیری ماشین؛ از تئوری تا کاربرد

‏یادگیری ماشین یا Machine Learning، هسته اصلی تحولات تکنولوژیک در دنیای امروز است. این حوزه با ترکیب آمار، علوم کامپیوتر و ریاضیات، به سیستم‌ها اجازه می‌دهد بدون برنامه‌نویسی صریح، از داده‌ها بیاموزند و الگوهای پیچیده را شناسایی کنند.

‏در دنیای حرفه‌ای علم داده، تسلط بر ابزارها و مفاهیم زیر برای هر متخصص ضروری است:

‏- PyTorch: کتابخانه‌ای قدرتمند و انعطاف‌پذیر برای یادگیری عمیق که در میان محققان محبوبیت ویژه‌ای دارد.
‏- Scikit-learn: کتابخانه‌ای استاندارد و کاربردی برای اجرای الگوریتم‌های کلاسیک یادگیری ماشین.
‏- Pandas: ابزار حیاتی برای دست‌کاری، تحلیل و پیش‌پردازش داده‌های ساختاریافته.
‏- CUDA: پلتفرمی برای محاسبات موازی روی پردازنده‌های گرافیکی که سرعت آموزش مدل‌های بزرگ را به شدت افزایش می‌دهد.
‏- Hugging Face: مرجعی برای دسترسی به مدل‌های پیش‌آموزش‌دیده و ترنسفورمرها که مسیر توسعه اپلیکیشن‌های هوش مصنوعی را هموار کرده است.

📚 مطالعه با جزئیات بیشتر

📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#PyTorch #CUDA
‏🧠 پیاده‌سازی گام‌به‌گام مفاهیم عمیق یادگیری ماشین

‏اگر می‌خواهید بدانید مدل‌های بزرگ هوش مصنوعی در پشت صحنه چطور کار می‌کنند، مخزن Beyond-NanoGPT یک پل ارتباطی عالی بین کدهای ساده و سیستم‌های پیچیده است. این پروژه توسط یکی از دانشجویان دانشگاه استنفورد توسعه یافته و شامل پیاده‌سازی‌های دقیق و خط‌به‌خط مفاهیم مدرن دیپ لرنینگ در PyTorch است.

‏مهم‌ترین پیاده‌سازی‌های موجود در این مخزن:
‏• معماری‌های پیشرفته مانند Vision Transformer و Diffusion Transformer
‏• انواع مکانیزم‌های توجه از جمله Grouped-Query و cross-attention
‏• روش‌های بهینه‌سازی سرعت LLM مانند KV-caching و speculative decoding
‏• الگوریتم‌های یادگیری تقویتی کاربردی نظیر DQN و PPO

‏این پروژه بدون نیاز به کلاسترهای گران‌قیمت، روی یک GPU معمولی قابل اجراست و راهنمایی عالی برای درک عمیق مقالات علمی است.

📚 مطالعه با جزئیات بیشتر

📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Beyond_NanoGPT #PyTorch