Forwarded from آموزش LLM و VLM
آموزش LLM و VLM
پارت ۱ تو دورهی LLM مکتبخونه با مفهوم knowledge distillation آشنا شدیم؛ ایدهی ساده و آشنا: یه مدل معلمِ بزرگ و گرون، یه مدل دانشآموزِ کوچیکتر رو آموزش میده تا رفتارش رو تقلید کنه. اما واقعیت اینه که این روش خیلی متنوعتره. تو پست زیر نشون میده مدلهای…
پارت ۲
2️⃣ ادغام چند متخصص RL در یک مدل (on-policy distillation):
بهجای اینکه یک مدل رو با RL روی همهچی خوب کنیم (که باعث فراموشی مهارتهای قبلی میشه)، برای هر حوزه (ریاضی، کد، ایجنت) یه معلمِ متخصص جدا با RL میسازن، بعد همه رو تو یه دانشآموز واحد distill میکنن؛ در حالی که خودِ دانشآموز داره rollout تولید میکنه. جالبه که این معلمها لزوماً بزرگتر نیستن، فقط تخصصیترن. این الگو رو DeepSeek-V4، MiMo (با نام MOPD)، GLM-5 و Nemotron 3 Ultra استفاده کردن.
3️⃣ خود مدل، معلم خودش (self-distillation):
مثل Cursor Composer 2.5 که یه hint به context اضافه میکنه، نسخهی hintدار مدل میشه معلم نسخهی بدونhint. یا روش Thinking Machines که برای جلوگیری از فراموشی، از چکپوینتِ قبل از fine-tune بهعنوان معلم استفاده میکنن.
نکتهی مشترک همهشون: معلم لزوماً بزرگتر نیست، فقط تو یه context یا حوزه بهتره. گاهی اون معلم، خودِ مدله.
🔗 منبع: huggingface.co/blog/sergiopaniego/distillation-2026
2️⃣ ادغام چند متخصص RL در یک مدل (on-policy distillation):
بهجای اینکه یک مدل رو با RL روی همهچی خوب کنیم (که باعث فراموشی مهارتهای قبلی میشه)، برای هر حوزه (ریاضی، کد، ایجنت) یه معلمِ متخصص جدا با RL میسازن، بعد همه رو تو یه دانشآموز واحد distill میکنن؛ در حالی که خودِ دانشآموز داره rollout تولید میکنه. جالبه که این معلمها لزوماً بزرگتر نیستن، فقط تخصصیترن. این الگو رو DeepSeek-V4، MiMo (با نام MOPD)، GLM-5 و Nemotron 3 Ultra استفاده کردن.
3️⃣ خود مدل، معلم خودش (self-distillation):
مثل Cursor Composer 2.5 که یه hint به context اضافه میکنه، نسخهی hintدار مدل میشه معلم نسخهی بدونhint. یا روش Thinking Machines که برای جلوگیری از فراموشی، از چکپوینتِ قبل از fine-tune بهعنوان معلم استفاده میکنن.
نکتهی مشترک همهشون: معلم لزوماً بزرگتر نیست، فقط تو یه context یا حوزه بهتره. گاهی اون معلم، خودِ مدله.
🔗 منبع: huggingface.co/blog/sergiopaniego/distillation-2026
👍11❤2
https://blog.google/innovation-and-ai/products/gemini-notebook/notebooklm-gemini-notebook/
👍1
Forwarded from آموزش LLM و VLM
🚀 موشنشات از کیمی K3 رونمایی کرد
شرکت چینی Moonshot AI امروز قدرتمندترین مدل پرچمدار خودش، Kimi K3، رو رسما معرفی کرد.
🔹 پنجرهی زمینه تا ۱ میلیون توکن
🔹 بهبود قابلتوجه در کدنویسی، تولید سهبعدی و وظایف دانشی پیچیده
🔹 طبق برخی نشتها و تستهای کاربران، حدود ۲.۵ تریلیون پارامتر دارد (این رقم هنوز رسما تأیید نشده)
🔹 در برخی بنچمارکهای کدنویسی از GPT-5.5 جلو زده
این عرضه فقط ۳ ماه بعد از متنباز شدن K2.6 اتفاق افتاد و نشوندهندهی شتاب چشمگیر در چرخهی توسعهی موشنشاته.
💰 همزمان، موشنشات دور جدید تأمین مالی با ارزشگذاری ۲۰ میلیارد دلاری رو بسته و درآمد سالانهی خانوادهی مدلهای کیمی از ۳۰۰ میلیون دلار عبور کرده.
بازار پیشبینی Polymarket پیش از رونمایی، احتمال عرضهی K3 در جولای رو تا ۹۸٪ برآورد کرده بود.
📎 منبع: finance.biggo.com
شرکت چینی Moonshot AI امروز قدرتمندترین مدل پرچمدار خودش، Kimi K3، رو رسما معرفی کرد.
🔹 پنجرهی زمینه تا ۱ میلیون توکن
🔹 بهبود قابلتوجه در کدنویسی، تولید سهبعدی و وظایف دانشی پیچیده
🔹 طبق برخی نشتها و تستهای کاربران، حدود ۲.۵ تریلیون پارامتر دارد (این رقم هنوز رسما تأیید نشده)
🔹 در برخی بنچمارکهای کدنویسی از GPT-5.5 جلو زده
این عرضه فقط ۳ ماه بعد از متنباز شدن K2.6 اتفاق افتاد و نشوندهندهی شتاب چشمگیر در چرخهی توسعهی موشنشاته.
💰 همزمان، موشنشات دور جدید تأمین مالی با ارزشگذاری ۲۰ میلیارد دلاری رو بسته و درآمد سالانهی خانوادهی مدلهای کیمی از ۳۰۰ میلیون دلار عبور کرده.
بازار پیشبینی Polymarket پیش از رونمایی، احتمال عرضهی K3 در جولای رو تا ۹۸٪ برآورد کرده بود.
📎 منبع: finance.biggo.com
❤8
🔥 یه خبر فوقالعاده برای دیزاینرها و تولیدکنندههای محتوا!
نسخه جدید هوش مصنوعی Qwen-Image-3.0 معرفی شد و این بار قرار نیست فقط عکسهای قشنگ تحویلمون بده!
این مدل یه ابزار کاملاً کاربردی و حرفهایه که میتونه طرحهای پیچیده و دقیق بزنه؛ از جمله: 📰 طراحی صفحات روزنامه و مجله 🎬 ساخت استوریبورد برای ویدیوها 💻 طراحی رابط کاربری (UI) وبسایت
💡 نکته جذابتر؟ از ۱۲ زبان مختلف پشتیبانی میکنه و دقتش توی درک جزئیات واقعاً بالاست.
📌 اگه دیزاینری یا محتوا میسازی، حتماً این ابزار جدید رو تست کن!
نسخه جدید هوش مصنوعی Qwen-Image-3.0 معرفی شد و این بار قرار نیست فقط عکسهای قشنگ تحویلمون بده!
این مدل یه ابزار کاملاً کاربردی و حرفهایه که میتونه طرحهای پیچیده و دقیق بزنه؛ از جمله: 📰 طراحی صفحات روزنامه و مجله 🎬 ساخت استوریبورد برای ویدیوها 💻 طراحی رابط کاربری (UI) وبسایت
💡 نکته جذابتر؟ از ۱۲ زبان مختلف پشتیبانی میکنه و دقتش توی درک جزئیات واقعاً بالاست.
📌 اگه دیزاینری یا محتوا میسازی، حتماً این ابزار جدید رو تست کن!
❤16
Media is too big
VIEW IN TELEGRAM
مقدمه کورس Agentic AI که در روزهای پیش رو منتشر خواهد شد...
🔥25❤6👍4❤🔥2
Forwarded from آموزش LLM و VLM
🧠 مایکروسافت مدل جدید Mage-VL رو منتشر کرد؛ یک مدل چندوجهیِ «کدک-محور» برای درک ویدیو و استریم زنده
مایکروسافت دو مدل بههممرتبط رو روی HuggingFace منتشر کرده:
🔹 مدل Mage-VL — مدل چندوجهیِ ۴ میلیارد پارامتری (بر پایهی Qwen3-4B) که همزمان تصویر، ویدیوی کوتاه/بلند و استریم زنده رو درک میکنه.
🔹 مدل Mage-ViT — انکودر بصری همین مدل، که کاملاً از صفر (بدون هیچ پیشآموزش تصویر-متنِ میلیاردی) آموزش دیده.
✨ ایده
بهجای اینکه ویدیو رو به فریمهای یکنواخت تبدیل کنن و همهشون رو به مدل بدن (که پرهزینهست)، از منطق کدکهای ویدیویی (مثل H.264/HEVC) الهام گرفتن: فقط فریمهای کلیدی (I-frame) کامل نگه داشته میشن و از فریمهای پیشبینیشده (P-frame) فقط بخشهایی که واقعاً حرکت/تغییر دارن انتخاب میشن. نتیجه؟
• کاهش بیش از ۷۵٪ در تعداد توکنهای بصری
• تا ۳.۵ برابر سرعت بیشتر در inference
• آموزش روی ویدیوهایی تا ۸ برابر طولانیتر با همون بودجهی محاسباتی
📊 عملکرد:
با همون بکبون ۴B، در تقریباً همهی بنچمارکهای ویدیویی و درک مکانی از Qwen3-VL-4B جلوتره (مثلاً +۲۲.۵ در QVHighlight و +۱۱ در VSI-Bench)، و در تصاویر استاتیک همسطح یا کمی بهتره.
🎙️ یه قابلیت جالب دیگه: یک «گیت شناختی» سبک داره که مدل رو در حالت استریم فقط وقتی «رویداد قابلتوجهی» رخ بده فعال میکنه (مثلاً روی گزارش زندهی فوتبال تست شده) — بدون نیاز به چند مدل جدا.
🔗 Mage-VL: https://huggingface.co/microsoft/Mage-VL
🔗 Mage-ViT: https://huggingface.co/microsoft/Mage-ViT
مایکروسافت دو مدل بههممرتبط رو روی HuggingFace منتشر کرده:
🔹 مدل Mage-VL — مدل چندوجهیِ ۴ میلیارد پارامتری (بر پایهی Qwen3-4B) که همزمان تصویر، ویدیوی کوتاه/بلند و استریم زنده رو درک میکنه.
🔹 مدل Mage-ViT — انکودر بصری همین مدل، که کاملاً از صفر (بدون هیچ پیشآموزش تصویر-متنِ میلیاردی) آموزش دیده.
✨ ایده
بهجای اینکه ویدیو رو به فریمهای یکنواخت تبدیل کنن و همهشون رو به مدل بدن (که پرهزینهست)، از منطق کدکهای ویدیویی (مثل H.264/HEVC) الهام گرفتن: فقط فریمهای کلیدی (I-frame) کامل نگه داشته میشن و از فریمهای پیشبینیشده (P-frame) فقط بخشهایی که واقعاً حرکت/تغییر دارن انتخاب میشن. نتیجه؟
• کاهش بیش از ۷۵٪ در تعداد توکنهای بصری
• تا ۳.۵ برابر سرعت بیشتر در inference
• آموزش روی ویدیوهایی تا ۸ برابر طولانیتر با همون بودجهی محاسباتی
📊 عملکرد:
با همون بکبون ۴B، در تقریباً همهی بنچمارکهای ویدیویی و درک مکانی از Qwen3-VL-4B جلوتره (مثلاً +۲۲.۵ در QVHighlight و +۱۱ در VSI-Bench)، و در تصاویر استاتیک همسطح یا کمی بهتره.
🎙️ یه قابلیت جالب دیگه: یک «گیت شناختی» سبک داره که مدل رو در حالت استریم فقط وقتی «رویداد قابلتوجهی» رخ بده فعال میکنه (مثلاً روی گزارش زندهی فوتبال تست شده) — بدون نیاز به چند مدل جدا.
🔗 Mage-VL: https://huggingface.co/microsoft/Mage-VL
🔗 Mage-ViT: https://huggingface.co/microsoft/Mage-ViT
huggingface.co
microsoft/Mage-VL · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
👏5
Forwarded from َAgenticAI
Media is too big
VIEW IN TELEGRAM
🤖 دوره «Agentic AI با پایتون» منتشر شد!
اگه دنبال این هستی که از حرف زدن با یه مدل زبانی، بری سراغ ساختن عاملهایی (Agent) که واقعاً کار انجام میدن، ابزار صدا میزنن، با هم تیم میشن و پروژههای واقعی رو پیش میبرن، این دوره برای شماست!
توی ۸ فصل، از صفر تا ساخت یک پروژهی نهایی کامل جلو میریم:
📘 مقدمه 📗 فصل ۱ - مقدمهای بر گردشکارهای عاملمحور 📗 فصل ۲ - الگوی طراحی Reflection 📗 فصل ۳ - استفاده از ابزار (Tool Use) 📗 فصل ۴ - MCP (پروتکل ارتباط مدل با ابزارها) 📗 فصل ۵ - نکات عملی برای ساخت Agentic AI 📗 فصل ۶ - الگوهای عاملهای با خودمختاری بالا 📗 فصل ۷ - سیستمهای چندعامله با crewAI 📗 فصل ۸ - LangChain
🎯 پروژه نهایی: پیادهسازی سامانهی Text-to-SQL
تمام کدهای دوره روی گیتهاب در دسترس است:
👉 github.com/Alireza-Akhavan/agentic_ai
🎁 تخفیف ویژه
1️⃣برای ۱۰۰ نفر اول، کد تخفیف ۷۰٪ی:
2️⃣ برای ۱۰۰ نفر بعدی، کد تخفیف ۶۰٪ی:
تعداد کدها محدوده، پس اگر میخواهی Agentic AI را اصولی یاد بگیری، همین امروز ثبتنام کن.
سرفصلهای این دوره |برای مشاهده اسلاید؛ تمرین، پروژه 👈 @agentic_llm
اگه دنبال این هستی که از حرف زدن با یه مدل زبانی، بری سراغ ساختن عاملهایی (Agent) که واقعاً کار انجام میدن، ابزار صدا میزنن، با هم تیم میشن و پروژههای واقعی رو پیش میبرن، این دوره برای شماست!
توی ۸ فصل، از صفر تا ساخت یک پروژهی نهایی کامل جلو میریم:
📘 مقدمه 📗 فصل ۱ - مقدمهای بر گردشکارهای عاملمحور 📗 فصل ۲ - الگوی طراحی Reflection 📗 فصل ۳ - استفاده از ابزار (Tool Use) 📗 فصل ۴ - MCP (پروتکل ارتباط مدل با ابزارها) 📗 فصل ۵ - نکات عملی برای ساخت Agentic AI 📗 فصل ۶ - الگوهای عاملهای با خودمختاری بالا 📗 فصل ۷ - سیستمهای چندعامله با crewAI 📗 فصل ۸ - LangChain
🎯 پروژه نهایی: پیادهسازی سامانهی Text-to-SQL
تمام کدهای دوره روی گیتهاب در دسترس است:
👉 github.com/Alireza-Akhavan/agentic_ai
🎁 تخفیف ویژه
1️⃣برای ۱۰۰ نفر اول، کد تخفیف ۷۰٪ی:
COUPON-EAA612️⃣ برای ۱۰۰ نفر بعدی، کد تخفیف ۶۰٪ی:
COUPON-6EE77تعداد کدها محدوده، پس اگر میخواهی Agentic AI را اصولی یاد بگیری، همین امروز ثبتنام کن.
سرفصلهای این دوره |برای مشاهده اسلاید؛ تمرین، پروژه 👈 @agentic_llm
❤🔥9❤5🔥1
Forwarded from َAgenticAI
🔥10❤2
Forwarded from َAgenticAI
در صورتی که به مدرک مکتبخونه نیاز ندارید، میتوانید کوییزها، و تمرینها و پروژهها را از طریق کانال دانلود کنید:
لینک کانال: https://xn--r1a.website/agentic_llm
لینک دوره: https://mktb.me/m6tt/
هنگام خرید، کافیست گزینهی «دسترسی پایه» را تیک بزنید تا فقط به ویدیوها دسترسی داشته باشید و بتوانید با هزینهی کمتری ثبتنام کنید.
@agentic_llm
لینک کانال: https://xn--r1a.website/agentic_llm
لینک دوره: https://mktb.me/m6tt/
هنگام خرید، کافیست گزینهی «دسترسی پایه» را تیک بزنید تا فقط به ویدیوها دسترسی داشته باشید و بتوانید با هزینهی کمتری ثبتنام کنید.
@agentic_llm
❤15👍3
skill.md
9.1 KB
اسکیل پیشنهادی:
📝 درباره این ابزار: این اسکیل بر پایه یک چارچوب ۷ لایهای و حرفهای برای نوشتن پرامپتهای قدرتمند طراحی شده است. کارکرد اصلی آن، آموزش به ایجنت (Agent) برای تنظیم دقیق جزئیاتی مانند توصیفات فیزیکی، نورپردازی، ساختار چهره و فرمتهای JSON است. نتیجه این دقت، خلق تصاویر پایدار با حفظ ثبات (Consistency) در تمامی زوایا خواهد بود
video-prompt-generator (توسعهیافته توسط Liangdabiao)📝 درباره این ابزار: این اسکیل بر پایه یک چارچوب ۷ لایهای و حرفهای برای نوشتن پرامپتهای قدرتمند طراحی شده است. کارکرد اصلی آن، آموزش به ایجنت (Agent) برای تنظیم دقیق جزئیاتی مانند توصیفات فیزیکی، نورپردازی، ساختار چهره و فرمتهای JSON است. نتیجه این دقت، خلق تصاویر پایدار با حفظ ثبات (Consistency) در تمامی زوایا خواهد بود
❤6🙏2
📢 اگر پست دیروز را ندیدید...
دوره Agentic AI با پایتون منتشر شده و از مفاهیم پایه تا ساخت Agentهای حرفهای، MCP، Tool Use، سیستمهای چندعامله با crewAI، LangChain و پروژهی نهایی Text-to-SQL را بهصورت عملی آموزش میدهد.
🎁 هنوز کد تخفیف ۶۰٪ برای تعداد محدودی از ثبتنامها فعال است:
https://mktb.me/m6tt/
اگر قصد یادگیری Agentic AI را دارید، پیشنهاد میکنم فرصت باقیمانده را از دست ندهید.
📚 سرفصلها، اسلایدها، تمرینها و پروژهها:
👉 @agentic_llm
دوره Agentic AI با پایتون منتشر شده و از مفاهیم پایه تا ساخت Agentهای حرفهای، MCP، Tool Use، سیستمهای چندعامله با crewAI، LangChain و پروژهی نهایی Text-to-SQL را بهصورت عملی آموزش میدهد.
🎁 هنوز کد تخفیف ۶۰٪ برای تعداد محدودی از ثبتنامها فعال است:
COUPON-6EE77https://mktb.me/m6tt/
اگر قصد یادگیری Agentic AI را دارید، پیشنهاد میکنم فرصت باقیمانده را از دست ندهید.
📚 سرفصلها، اسلایدها، تمرینها و پروژهها:
👉 @agentic_llm
👍12🔥1🙏1👌1
Forwarded from 🚀 کلاسویژن | یادگیری هوش مصنوعی از پایه تا پیشرفته
🔥 فرصت طلایی یادگیری هوش مصنوعی از امروز شروع میشه!
اگه دنبال یه بهونه بودین که بالاخره وارد دنیای AI و LLM بشین، بهترین زمانشه ⚡️
به مناسبت انتشار دوره جدید، 70 درصد تخفیف روی همه دورههای #هوش_مصنوعی، #LLM و پردازش_تصویر
آموزش هوش مصنوعی مولد با مدلهای زبانی بزرگ (LLM)
https://mktb.me/04dr/
آموزش مدلهای زبانی-تصویری (VLM): از درک تصویر و ویدیو تا فاینتیون پیشرفته
https://mktb.me/e3gx/
آموزش جامع یادگیری عمیق (Deep Learning) با Tensorflow و keras
https://mktb.me/2klm/
آموزش پردازش تصویر و بینایی ماشین با OpenCV
https://mktb.me/81nt/
دورهی آموزشی ویدیویی Graph Neural Network
https://class.vision/product/graph-neural-network/
⚡️ زمان محدود - فرصتو از دست ندین! (فقط تا دوشنبه)
اگه دنبال یه بهونه بودین که بالاخره وارد دنیای AI و LLM بشین، بهترین زمانشه ⚡️
به مناسبت انتشار دوره جدید، 70 درصد تخفیف روی همه دورههای #هوش_مصنوعی، #LLM و پردازش_تصویر
آموزش هوش مصنوعی مولد با مدلهای زبانی بزرگ (LLM)
https://mktb.me/04dr/
COUPON-D9D48آموزش مدلهای زبانی-تصویری (VLM): از درک تصویر و ویدیو تا فاینتیون پیشرفته
https://mktb.me/e3gx/
COUPON-A7E3Cآموزش جامع یادگیری عمیق (Deep Learning) با Tensorflow و keras
https://mktb.me/2klm/
COUPON-17464آموزش پردازش تصویر و بینایی ماشین با OpenCV
https://mktb.me/81nt/
COUPON-8A401دورهی آموزشی ویدیویی Graph Neural Network
https://class.vision/product/graph-neural-network/
gnn_enagen⚡️ زمان محدود - فرصتو از دست ندین! (فقط تا دوشنبه)
🔥4
اگر کسی وب و کلاینت کار میکنه، این دوره را نیز به مدت محدود میتوانید رایگان ببینید:
مینی دوره ساخت هوش مصنوعی شخصی در مرورگر
مینی دوره ساخت هوش مصنوعی شخصی در مرورگر
COUPON-B7F7Cمکتبخونه
مینی دوره ساخت هوش مصنوعی شخصی در مرورگر با Web AI
با «مینی دوره ساخت هوش مصنوعی شخصی در مرورگر» مکتبخونه، اجرای Local LLM/VLM، پرامپتنویسی و ساخت یک AI خصوصی بدون سرور را قدمبهقدم یاد بگیرید.
❤6