ابزارها و کاربردهای هوش مصنوعی
4.81K subscribers
1.07K photos
764 videos
1.02K files
1.61K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🤯 کلود کد در ۴ ساعت برای یک پرینتر درایور مک ساخت!

یک برنامه‌نویس ۱۹ ساله با کمک Claude Code توانست زبان اختصاصی پرینتر HP Laser 1008a را مهندسی معکوس کند و از صفر یک درایور قابل‌استفاده برای Mac بسازد. 🖨️🍎

🔹 پرینتر به‌صورت رسمی از Mac یا AirPrint پشتیبانی نمی‌کرد.
🔹 Claude Code فرمت اختصاصی چاپ را تحلیل و دستورات macOS را به زبان قابل‌فهم برای پرینتر تبدیل کرد.
🔹 نتیجه بعد از حدود ۴ ساعت به یک درایور عملیاتی رسید.
🔹 پروژه و حتی متن کامل تعامل با Claude Code هم در GitHub منتشر شده است.

📌 نکته جالب اینجاست که AI دیگر فقط کد می‌نویسد؛ می‌تواند در مهندسی معکوس، دیباگ و ساخت ابزارهایی که مستندات رسمی ندارند هم نقش جدی داشته باشد. 🤖🔥
🤯 گوگل مدل Qwen4 را لو داد!

Alibaba با انتشار Qwen3.8-Flash-Next عملاً نگاهی اولیه به معماری نسل بعدی Qwen4 ارائه کرده است. 🧠

🔥 مشخصات جذاب:

۱۲۵ میلیارد پارامتر؛ اما فقط ۶B پارامتر برای هر بخش از متن فعال می‌شود.

حدود ۹ برابر هزینه آموزش کمتر از Qwen3.7-Plus

عملکرد بهتر در کدنویسی، استفاده از ابزارها و کارهای طولانی Agentی

پشتیبانی از ۲۶۲ هزار توکن و در حالت Extended تا ۱ میلیون توکن 🤯

وزن‌های مدل همین حالا به‌صورت Open Weight منتشر شده‌اند.


📌 ایده اصلی ساده است: مدل را بزرگ نگه دار، اما همه پارامترها را هم‌زمان فعال نکن.

اگر این معماری در Qwen4 نهایی شود، Alibaba می‌تواند مدل‌های بسیار بزرگ را با هزینه محاسباتی بسیار پایین‌تری اجرا کند. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🤯 OpenAI:
نسل بعدی Codex کاملاً ابری می‌شود!

OpenAI
در حال آماده‌سازی نسل جدید Codex است؛ ایجنت‌هایی که قرار است بخش بزرگی از پردازش خود را در فضای ابری انجام دهند. ☁️🤖

نکات مهم:

ایجنت‌های مبتنی بر Astra می‌توانند هم‌زمان پردازش‌های بسیار بیشتری نسبت به یک لپ‌تاپ اجرا کنند.

سرعت Codex می‌تواند به ۷۵۰+ توکن در ثانیه برسد و این سرعت به حالت عادی تبدیل شود.

Codex
و ChatGPT به‌تدریج از یک Harness مشترک برای انجام وظایف مختلف استفاده خواهند کرد.


🎯 هدف نهایی OpenAI: چیزی که آن را Personal AGI می‌نامد؛ یک اپلیکیشن شخصی که رابط کاربری و ابزارهایش را بر اساس کاری که انجام می‌دهید، تغییر می‌دهد.

📌 یعنی Codex آینده فقط یک ابزار کدنویسی نیست؛ قرار است به یک ایجنت عمومی و همیشه‌در‌دسترس در فضای ابری تبدیل شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🏎️🤖 ربات انسان‌نما حالا راننده مسابقه شده!

یک ربات انسان‌نما توانسته کاملاً خودران وارد کابین خودرو شود، فرمان را کنترل کند، با پدال‌ها کار کند و یک مسابقه کامل را به پایان برساند؛ حتی جلوتر از راننده انسانی به خط پایان برسد! 😳

🧠 این سیستم از مدل Direct Perception Control شرکت Symbiosis Robotics استفاده می‌کند.

جالب‌تر اینکه ربات باید هم‌زمان بینایی، هر دو دست، هر دو پا، تعادل و کنترل کل بدن را هماهنگ کند.

📌 اگر این فناوری پیشرفت کند، شاید روزی مسابقات اتومبیل‌رانی شاهد رقابت انسان و ربات پشت فرمان باشیم. 🏁🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨🤩 ساخت پک استیکر حالا داخل ChatGPT!

ChatGPT حالا امکان ساخت استیکر را هم به کاربران می‌دهد. 🧩

کافی است وارد بخش Image در سایت یا اپ ChatGPT شوید و گزینه Stickers را انتخاب کنید.

📸 می‌توانید تصاویر خودتان را به مجموعه‌ای از استیکرهای آماده برای استفاده در مسنجرهای مختلف تبدیل کنید.

📌 یعنی ساخت پک استیکر شخصی، حالا فقط چند کلیک با شما فاصله دارد! 😎🔥
🎬🤯 گوگل Gemini Omni 1.1 Flash را معرفی کرد؛ ویدیو تا ۴۰ ثانیه و 4K!

گوگل نسخه جدید Gemini Omni 1.1 Flash را معرفی کرده که کنترل بسیار بیشتری روی تولید ویدیو می‌دهد.

🔹 ادامه دادن ویدیو در بخش‌های ۱۰ ثانیه‌ای تا مجموع ۴۰ ثانیه
🔹 تولید خروجی نهایی تا 4K
🔹 کنترل فریم اول و آخر برای ساخت حرکت بین دو نقطه
🔹 استفاده از ویدیوی مرجع برای حفظ شخصیت و محیط
🔹 حالت 360p برای تست سریع‌تر و ارزان‌تر ایده‌ها

این مدل از طریق Gemini API در دسترس توسعه‌دهندگان است و به Flow و اپ Gemini هم راه پیدا کرده؛ همچنین در ابزارهایی مثل Adobe Firefly ادغام شده است.

📌 نکته مهم: ویدیوها ابتدا می‌توانند با وضوح پایین‌تر ساخته شوند و بعد برای خروجی نهایی به 1080p یا 4K ارتقا پیدا کنند.

🔥 گوگل با این آپدیت، Gemini Omni را از یک ویدیوژنراتور ساده به سمت یک ابزار واقعی برای کارگردانی و ادیت ویدیو با دستور متنی می‌برد.
⚡️ H3 Max
تولید ویدیو سریع‌تر از زمان واقعی!

شرکت fal نسخه‌ای بهینه‌شده از MiniMax H3 با نام H3 Max منتشر کرده که می‌تواند یک ویدیوی ۵ ثانیه‌ای 768p را در کمتر از ۳ ثانیه تولید کند؛ یعنی سریع‌تر از زمان پخش خود ویدیو! 🤯

🔥 نکات مهم:

🎬 تولید ویدیو همراه با صدای همگام

حدود ۳۵ برابر throughput بیشتر از API رسمی H3

🏆 رتبه اول در Artificial Analysis برای Image-to-Video با صدا

🧠 با فاین‌تیون H3 روی داده‌های جدید، کیفیت و درک پرامپت هم بهبود یافته

📺 حداکثر رزولوشن فعلاً 768p و طول ویدیو ۵ تا ۱۵ ثانیه است.


💰 قیمت فعلی 768p حدود ۰.۰۴ دلار به‌ازای هر ثانیه با تخفیف لانچ است و نرخ عادی ۰.۰۸ دلار خواهد بود.

📌 نکته مهم اینجاست: وقتی تولید ویدیو از حالت «منتظر بمان» خارج شود و سریع‌تر از زمان واقعی انجام شود، ساخت و اصلاح ویدیو می‌تواند تقریباً مثل کار با یک ابزار تعاملی معمولی شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
پروژه متن‌باز Soup فرایند Fine-tuning و Post-training مدل‌های LLM را به یک فایل YAML و یک دستور تبدیل کرده است. [GitHub پروژه Soup](https://github.com/MakazhanAlpamys/Soup?utm_source=chatgpt.com)

🤯 قابلیت جذابش Layer Streaming است؛ لایه‌های مدل به‌صورت یکی‌یکی از RAM به GPU منتقل می‌شوند و در نتیجه کل مدل لازم نیست داخل VRAM قرار بگیرد.

📊 در تست توسعه‌دهندگان، Llama 3.1 8B Instruct با NF4 روی RTX 3050 لپ‌تاپی با فقط ۴GB VRAM اجرا شد و حداکثر مصرف VRAM حدود ۳.۳۲GB بود.

🔹 پشتیبانی از LoRA و QLoRA
🔹 DPO، ORPO، KTO، SimPO و روش‌های دیگر
🔹 تشخیص خودکار GPU و تنظیم Batch Size
🔹 اجرای کاملاً محلی و بدون نیاز به Cloud

📌 یعنی فاین‌تیون مدل‌های 8B دیگر الزاماً به GPUهای گران‌قیمت نیاز ندارد؛ البته روی سخت‌افزار ضعیف‌تر، زمان آموزش بسیار بیشتر خواهد بود.

هوش مصنوعی روی لپ‌تاپ‌های معمولی هم دارد جدی‌تر می‌شود. 🥣🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 MeiGen
؛ گالری پرامپت‌های آماده برای AI

اگه برای ساخت عکس و ویدئو با هوش مصنوعی ایده یا پرامپت نداری، MeiGen می‌تونه خیلی به کارت بیاد.

🔹 گالری نمونه‌های ساخته‌شده با AI
🔹 پرامپت‌های آماده برای Nano Banana، GPT Image 2 و مدل‌های دیگه
🔹 تبدیل تصویر به پرامپت (Image to Prompt)
🔹 ایده برای پوستر، پرتره، والپیپر، تبلیغات و...
🔹 امکان شخصی‌سازی پرامپت‌ها و ساخت محتوای خودت

🌐 "MeiGen" (https://www.meigen.ai/)

#هوش_مصنوعی #
2
🎓 یه سایت برای پیدا کردن تخفیف‌های دانشجویی!

اگه ایمیل دانشگاهی داری، این سایت می‌تونه خیلی به دردت بخوره 👀

توی nav.edumails.cn کلی سرویس و ابزار مختلف رو جمع کرده که برای دانشجوها تخفیف یا پلن رایگان دارن؛ از ابزارهای هوش مصنوعی و برنامه‌نویسی گرفته تا سرویس‌های ابری و طراحی.



🔗 https://nav.edumails.cn


من یه ترفند میگم بعضی از این آفرها رو میشه با فیک میل دانشجویی گرفت


https://imail.edu.vn/

https://temp-mail.edu.rs/

https://nullsto.edu.pl/
This media is not supported in your browser
VIEW IN TELEGRAM
🎬 یه خبر خوب برای عاشقای تولید ویدیو با AI!
از این به بعد می‌تونید با استفاده از مدل MiniMax H3 Max، روزانه تا ۱۵ ویدیوی ۱۰ ثانیه‌ای تولید کنید. 😍
برای امتحان کردنش کافیه برید اینجا:
MiniMax H3 Max در fal.ai
🤖 یه گزینه خوب برای ساخت کلیپ‌های کوتاه، تست ایده‌ها و تولید محتوای سریع با هوش مصنوعی.
#AI #هوش_مصنوعی
Media is too big
VIEW IN TELEGRAM
🦆🤖 Hugging Face
ربات اردکی ۳۹۹
دلاری ساخت!

MicroDuck یک ربات دوپای متن‌باز و کوچک است که با قیمت ۳۹۹ دلار عرضه شده و برای آموزش و آزمایش Physical AI طراحی شده است.

🔥 می‌تواند:

راه برود، بنشیند و بعد از افتادن بلند شود

اشیا را با منقار بردارد

غلت بزند و حتی اسکیت‌سواری کند 🛼

رفتارهای جدید را با Reinforcement Learning یاد بگیرد


🧠 نکته جذاب این است که می‌توانید رفتار را ابتدا در شبیه‌ساز MuJoCo آموزش دهید و بعد مستقیماً روی ربات واقعی اجرا کنید؛ بدون نیاز به فاین‌تیون مجدد. استک نرم‌افزاری و کد آموزش RL هم متن‌باز است.

📏 فقط ۲۵ سانتی‌متر ارتفاع و حدود ۸۰۰ گرم وزن دارد.

📌 هدفش جایگزین ربات‌های خانگی نیست؛ بیشتر یک پلتفرم ارزان برای یادگیری و توسعه رباتیک و Physical AI است.

و ظاهراً استقبال هم جدی بوده؛ طبق گزارش‌های اخیر، فروش MicroDuck در روز اول از ۲.۶ میلیون دلار عبور کرده است. 😳
This media is not supported in your browser
VIEW IN TELEGRAM
🤯 ChatGPT Work
حالا می‌تواند وارد سایت‌ها شود!

قابلیت جدید ChatGPT Work به ایجنت اجازه می‌دهد روی سایت‌های نیازمند ورود، کارهای واقعی را انجام دهد؛ در حالی که فرایند احراز هویت جدا از خود مدل انجام می‌شود.

🔹 رزرو نوبت و انجام کارهای اداری
🔹 ثبت درخواست مرجوعی یا تکمیل فرم‌ها
🔹 انتقال اطلاعات و فاکتورها از ایمیل به نرم‌افزار حسابداری
🔹 ادامه کار روی سایت‌هایی که قبلاً واردشان شده‌اید

🔐 نکته مهم: هنگام ورود، خود کاربر اطلاعات ورود را وارد می‌کند و مدل رمز عبور را نمی‌بیند. نشست احراز هویت نیز می‌تواند برای استفاده‌های بعدی حفظ شود.

📌 این قابلیت برای کاربران Plus، Pro و Business در حال عرضه است.

یعنی ChatGPT دیگر فقط سایت‌ها را نمی‌خواند؛ می‌تواند واقعاً داخل آن‌ها کار انجام دهد. 🤖🌐
🛍️🤖 Alibaba
هم وارد رقابت ایجنت‌های همه‌کاره شد!

QwenWork
حالا در نسخه بین‌المللی به‌صورت Public Beta عرضه شده و روی وب و دسکتاپ در دسترس است.

🔹 فقط کارتان را با زبان طبیعی توضیح می‌دهید؛ Agent خودش مراحل را انجام می‌دهد.
🔹 با گذشت زمان، عادت‌ها و نحوه کار شما را یاد می‌گیرد و در جلسات بعدی از آن‌ها استفاده می‌کند.
🔹 ساخت و Deploy اپلیکیشن وب بدون کدنویسی و سرور
🔹 تولید تصویر، ویدیو و صدا با مدل‌های مختلف
🔹 انجام کارهای چندمرحله‌ای روی سایت‌ها و حتی کامپیوتر، با اجازه کاربر.

📌 در واقع QwenWork ترکیبی از چند ابزار Alibaba برای اتوماسیون، ساخت نرم‌افزار و کنترل کامپیوتر است که حالا در یک محیط واحد جمع شده‌اند.

🔥 به نظر می‌رسد رقابت اصلی AI حالا از «چه کسی چت‌بات بهتری دارد؟» به سمت «چه کسی Agent بهتری برای انجام کارهای واقعی می‌سازد؟» رفته است.
🤖🔥 Perplexity
حالا یک AI Agent کاملاً محلی دارد!

Portable Computer
نسخه جدید Perplexity Computer است که بخش اصلی Agent را مستقیماً روی کامپیوتر خود کاربر اجرا می‌کند؛ یعنی فایل‌ها، کدها و فرایندهای طولانی لازم نیست برای پردازش به Cloud فرستاده شوند.

🧠 مدل‌های محلی:

Qwen 3.8 27B

PPLX 27B، نسخه Post-trained مدل Qwen


🔹 جست‌وجوی فایل‌ها و کدهای شخصی
🔹 اجرای دستورات و Workflowهای طولانی
🔹 اتصال به Google Drive، Gmail، Slack و GitHub
🔹 کارهای محلی بدون مصرف Credit
🔹 اگر وظیفه به اینترنت یا مدل قدرتمندتری نیاز داشته باشد، Agent قبل از ارسال اطلاعات به Cloud اجازه می‌گیرد.

📊 فعلاً دسترسی برای کاربران Pro و Max روی NVIDIA DGX Spark ارائه شده و پشتیبانی از سیستم‌های RTX نیز در حال گسترش است.

📌 نکته مهم اینجاست: Perplexity فقط یک مدل را لوکال نکرده؛ کل Agent Stack شامل orchestrator، planner، tool router و harness را روی دستگاه آورده است.

به نظر می‌رسد عصر «AI روی کامپیوتر خودت» جدی‌تر از همیشه شروع شده؛ بدون اینکه برای هر کار مجبور باشی داده‌هایت را به Cloud بفرستی. 🔥💻🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🔥 Gemini Omni 1.1 Flash
حالا رسماً عرضه شد!

گوگل نسخه Stable/GA مدل ویدیویی Gemini Omni 1.1 Flash را منتشر کرد و حالا قابلیت‌های جدید آن برای استفاده عمومی در اکوسیستم توسعه‌دهندگان در دسترس است.

🎬 مهم‌ترین قابلیت‌ها:

⏱️ ادامه ویدیو در قطعات ۱۰ ثانیه‌ای تا حداکثر ۴۰ ثانیه

🧠 برای ادامه صحنه، ۱۰ ثانیه قبلی را در نظر می‌گیرد، نه فقط فریم یا ثانیه پایانی

حالت Draft با کیفیت 360p برای تست سریع‌تر

💰 قیمت‌ها: 0.03 دلار/ثانیه در 360p، 0.10 دلار در 720p، 0.15 دلار در 1080p و 0.30 دلار در 4K

🎞️ امکان تعیین فریم اول و آخر برای ساخت انتقال‌های نرم

📺 خروجی 1080p و 4K از طریق Upscaling؛ این وضوح‌ها به‌صورت native تولید نمی‌شوند.


📌 نکته مهم این آپدیت، فقط 4K نیست؛ کنترل بیشتر + تولید ارزان‌تر Draft + حفظ بهتر پیوستگی صحنه است که Omni 1.1 را برای workflowهای حرفه‌ای ویدیو کاربردی‌تر می‌کند. 🚀
🦆💰 تلگرام Gram Wallet را راه‌اندازی کرد!

تلگرام عرضه Gram Wallet را آغاز کرده؛ یک کیف پول غیرامانی (Non-Custodial) که کنترل دارایی و کلیدها را در اختیار خود کاربر قرار می‌دهد. فعلاً دسترسی برای گروه محدودی فعال شده و قرار است طی چند هفته برای کاربران بیشتری عرضه شود.

🔹 کیف پول مستقیماً داخل اکوسیستم تلگرام قرار می‌گیرد
🔹 کاربر کنترل دارایی‌های خودش را در اختیار دارد
🔹 عرضه عمومی به‌صورت مرحله‌ای انجام می‌شود
🔹 تلگرام آن را یکی از بزرگ‌ترین عرضه‌های کیف پول غیرامانی معرفی کرده است.

📈 بعد از اعلام خبر، قیمت GRAM حدود ۴ تا ۵٪ رشد کرد.

📌 اگر تلگرام واقعاً بتواند این کیف پول را به پایگاه کاربری میلیاردی خود برساند، می‌تواند یکی از بزرگ‌ترین ورودهای کاربران عادی به کریپتو و پرداخت‌های غیرمتمرکز باشد. 🤯
2