ابزارها و کاربردهای هوش مصنوعی
4.81K subscribers
1.07K photos
764 videos
1.02K files
1.61K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🎬🔥 FLUX
حالا ویدیوها را هم
Upscale
می‌کند!

شرکت BFL مدل جدید FLUX Video Upscale را معرفی کرده؛ یک مدل تخصصی برای افزایش کیفیت ویدیو که برخلاف Upscalerهای معمول، فریم‌به‌فریم کار نمی‌کند و کل ویدیو را به‌صورت یک مدل ویدیویی پردازش می‌کند.

🎥 ورودی:

حداکثر ۲۰ ثانیه

تا 2560×1440


⚙️ دو حالت دارد:

🔹 Precise — ۴ مرحله، سریع‌تر و مناسب حفظ چهره و جزئیات اصلی
🔹 Creative — ۸ مرحله، جزئیات بیشتری تولید می‌کند اما ممکن است ظاهر چهره‌ها یا اشیای مهم را تغییر دهد.

💰 هزینه تقریبی هر ثانیه: Full HD: حدود ۰.۱۴ تا ۰.۲۰ دلار
4K: حدود ۰.۵۵ تا ۰.۷۹ دلار

📌 این مدل مخصوصاً برای ویدیوهای ساخته‌شده با اکوسیستم FLUX طراحی شده و می‌تواند کیفیت خروجی‌های AI را یک مرحله بالاتر ببرد. 🚀
1
This media is not supported in your browser
VIEW IN TELEGRAM
💬🤖 ChatGPT
حالا می‌تواند iMessage شما را مدیریت کند!

OpenAI
یک پلاگین جدید برای Apple Messages روی Mac منتشر کرده که ChatGPT را مستقیماً به پیام‌های شما متصل می‌کند.

🔹 جست‌وجو و خلاصه‌کردن گفتگوها
🔹 پیدا کردن پیام‌هایی که از دست داده‌اید
🔹 نوشتن پاسخ
🔹 ارسال پیام از طرف شما با تأیید کاربر
🔹 پیدا کردن اطلاعاتی مثل تولدها در چت و ارتباط آن با تقویم
🔹 شناسایی گفتگوهای مشکوک به اسپم

⚠️ این قابلیت فعلاً برای Macهای Apple Silicon و در محیط‌های ChatGPT Work و Codex ارائه شده است. طبق توضیح OpenAI، پردازش پلاگین روی خود مک انجام می‌شود و کاربر برای دسترسی و ارسال پیام باید مجوز بدهد.

📌 نکته حساس: برای ارسال پیام، بهتر است تأیید هر پیام فعال بماند؛ چون در غیر این صورت AI می‌تواند بدون بررسی نهایی شما پیام بفرستد. OpenAI خودش هم درباره فعال‌کردن تأیید دائمی هشدار داده است.

یعنی ChatGPT دیگر فقط پیام‌ها را نمی‌خواند؛ کم‌کم دارد تبدیل به دستیار ارتباطی واقعی شما می‌شود. 😳📱
1👍1
🦆 Duck.ai
چند هوش مصنوعی، یک‌جا با تمرکز روی حریم خصوصی

اگه دوست داری بدون ساختن چندتا اکانت مختلف، با چند مدل هوش مصنوعی کار کنی، Duck.ai گزینه جالبیه.

🔹 دسترسی به چند مدل هوش مصنوعی از یک محیط
🔹 امکان مقایسه جواب مدل‌های مختلف
🔹 حذف اطلاعاتی مثل IP قبل از ارسال درخواست به ارائه‌دهنده مدل
🔹 چت‌ها به‌صورت پیش‌فرض برای آموزش مدل‌ها استفاده نمی‌شن
🔹 تاریخچه چت به‌صورت پیش‌فرض روی دستگاه خودت ذخیره می‌شه

یعنی به‌جای اینکه برای هر مدل بری سراغ یه سرویس جدا، می‌تونی همه رو از داخل Duck.ai امتحان کنی. 🦆

🤖 مدل‌های رایگان: • GPT-5.4 nano
• GPT-5.4 mini
• Claude 4.5 Haiku
• Mistral Small 4
• GPT-oss 120B
• Gemma 4 31B
📌 برای ترجمه، خلاصه‌کردن، نوشتن متن و کارهای روزمره هوش مصنوعی هم کاربردیه.

🌐 Duck.ai:
https://duck.ai/

#هوش_مصنوعی #حریم_خصوصی
2
🤖 Tandem Browser
؛ مرورگری که هوش مصنوعی رو می‌ذاره پشت فرمون!


تا حالا شده به هوش مصنوعی بگی «برو این سایت رو باز کن، این فرم رو پر کن، این اطلاعات رو پیدا کن» و آخرش فقط یه مشت دستورالعمل تحویلت بده؟ 😄
Tandem Browser دقیقاً می‌خواد این قضیه رو عوض کنه.
این یه مرورگر مبتنی بر Chromium/Electron هست که AI رو مستقیماً داخل مرورگر میاره؛ یعنی هوش مصنوعی می‌تونه با تب‌ها، کوکی‌ها، سشن‌های لاگین‌شده و خود صفحات وب کار کنه.
🔹 باز کردن سایت و تب

🔹 کلیک و تایپ و پر کردن فرم‌ها

🔹 کار با سایت‌هایی که API ندارن

🔹 خواندن محتوای صفحات و استخراج اطلاعات

🔹 بررسی API و ترافیک شبکه

🔹 اجرای کارهای چندمرحله‌ای

🔹 کار همزمان انسان و چند Agent داخل یک مرورگر

🔹 پشتیبانی از Claude، GPT، Gemini، Ollama، LM Studio و...

🔹 امکان اتصال از راه دور با Tailscale
مثلاً می‌تونی به Agent بگی:
«برو این سایت رو بررسی کن، قیمت محصولات رو دربیار و مقایسه‌شون کن.»

و به‌جای اینکه فقط راهنماییت کنه، خودش مرورگر رو کنترل می‌کنه و کار رو انجام می‌ده. 😎
از اون جالب‌تر اینکه پروژه Open Source و MITـه و فعلاً به‌صورت Developer Preview منتشر شده.
📌 GitHub:

Tandem Browser
#اوپن_سورس
1
🚨 بالاخره مشخص شد پشت مدل مرموز Ox Alpha کیه!

چند روز پیش یه مدل ناشناس به اسم Ox Alpha روی OpenRouter ظاهر شد و حسابی سر و صدا کرد؛ بدون اسم سازنده، ولی با عملکرد خیلی خوب در کدنویسی و استدلال، پشتیبانی از متن، تصویر و ویدئو و کانتکست حدود ۱ میلیون توکن. 🤯

همین باعث شده بود همه دنبال این باشن که ببینن این مدل کار کدوم شرکت بزرگه؛ از DeepSeek و مایکروسافت گرفته تا بقیه اسم‌ها مطرح شده بود.

حالا معما حل شده:
🧠 Ox Alpha متعلق به Z.ai، سازنده خانواده مدل‌های GLM، بوده.

جالب‌تر اینکه Z.ai عمداً مدل رو بدون معرفی رسمی منتشر کرده بود تا کاربرا بدون اینکه تحت تأثیر اسم برند قرار بگیرن، خودشون مدل رو امتحان و ارزیابی کنن.

حالا Z.ai اعلام کرده وزن‌های Ox Alpha قراره منتشر بشه تا توسعه‌دهنده‌ها بتونن ازش استفاده کنن و روی اون مدل‌های خودشون رو بسازن.

البته فعلاً نباید گفت Ox Alpha همه مدل‌های مطرح دنیا رو شکست داده؛ ولی عملکردش نشون میده مدل‌های چینی مخصوصاً در حوزه کدنویسی، Reasoning و Agentها دارن خیلی جدی وارد رقابت میشن. 🔥

در واقع داستان Ox Alpha بیشتر از اینکه «یک مدل ناشناس عجیب» باشه، یه جور تست مخفی Z.ai روی دنیای واقعی بود. 😄

🔗 منبع: TechCrunch

#هوش_مصنوعی
1
🤯 کلود کد در ۴ ساعت برای یک پرینتر درایور مک ساخت!

یک برنامه‌نویس ۱۹ ساله با کمک Claude Code توانست زبان اختصاصی پرینتر HP Laser 1008a را مهندسی معکوس کند و از صفر یک درایور قابل‌استفاده برای Mac بسازد. 🖨️🍎

🔹 پرینتر به‌صورت رسمی از Mac یا AirPrint پشتیبانی نمی‌کرد.
🔹 Claude Code فرمت اختصاصی چاپ را تحلیل و دستورات macOS را به زبان قابل‌فهم برای پرینتر تبدیل کرد.
🔹 نتیجه بعد از حدود ۴ ساعت به یک درایور عملیاتی رسید.
🔹 پروژه و حتی متن کامل تعامل با Claude Code هم در GitHub منتشر شده است.

📌 نکته جالب اینجاست که AI دیگر فقط کد می‌نویسد؛ می‌تواند در مهندسی معکوس، دیباگ و ساخت ابزارهایی که مستندات رسمی ندارند هم نقش جدی داشته باشد. 🤖🔥
🤯 گوگل مدل Qwen4 را لو داد!

Alibaba با انتشار Qwen3.8-Flash-Next عملاً نگاهی اولیه به معماری نسل بعدی Qwen4 ارائه کرده است. 🧠

🔥 مشخصات جذاب:

۱۲۵ میلیارد پارامتر؛ اما فقط ۶B پارامتر برای هر بخش از متن فعال می‌شود.

حدود ۹ برابر هزینه آموزش کمتر از Qwen3.7-Plus

عملکرد بهتر در کدنویسی، استفاده از ابزارها و کارهای طولانی Agentی

پشتیبانی از ۲۶۲ هزار توکن و در حالت Extended تا ۱ میلیون توکن 🤯

وزن‌های مدل همین حالا به‌صورت Open Weight منتشر شده‌اند.


📌 ایده اصلی ساده است: مدل را بزرگ نگه دار، اما همه پارامترها را هم‌زمان فعال نکن.

اگر این معماری در Qwen4 نهایی شود، Alibaba می‌تواند مدل‌های بسیار بزرگ را با هزینه محاسباتی بسیار پایین‌تری اجرا کند. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🤯 OpenAI:
نسل بعدی Codex کاملاً ابری می‌شود!

OpenAI
در حال آماده‌سازی نسل جدید Codex است؛ ایجنت‌هایی که قرار است بخش بزرگی از پردازش خود را در فضای ابری انجام دهند. ☁️🤖

نکات مهم:

ایجنت‌های مبتنی بر Astra می‌توانند هم‌زمان پردازش‌های بسیار بیشتری نسبت به یک لپ‌تاپ اجرا کنند.

سرعت Codex می‌تواند به ۷۵۰+ توکن در ثانیه برسد و این سرعت به حالت عادی تبدیل شود.

Codex
و ChatGPT به‌تدریج از یک Harness مشترک برای انجام وظایف مختلف استفاده خواهند کرد.


🎯 هدف نهایی OpenAI: چیزی که آن را Personal AGI می‌نامد؛ یک اپلیکیشن شخصی که رابط کاربری و ابزارهایش را بر اساس کاری که انجام می‌دهید، تغییر می‌دهد.

📌 یعنی Codex آینده فقط یک ابزار کدنویسی نیست؛ قرار است به یک ایجنت عمومی و همیشه‌در‌دسترس در فضای ابری تبدیل شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🏎️🤖 ربات انسان‌نما حالا راننده مسابقه شده!

یک ربات انسان‌نما توانسته کاملاً خودران وارد کابین خودرو شود، فرمان را کنترل کند، با پدال‌ها کار کند و یک مسابقه کامل را به پایان برساند؛ حتی جلوتر از راننده انسانی به خط پایان برسد! 😳

🧠 این سیستم از مدل Direct Perception Control شرکت Symbiosis Robotics استفاده می‌کند.

جالب‌تر اینکه ربات باید هم‌زمان بینایی، هر دو دست، هر دو پا، تعادل و کنترل کل بدن را هماهنگ کند.

📌 اگر این فناوری پیشرفت کند، شاید روزی مسابقات اتومبیل‌رانی شاهد رقابت انسان و ربات پشت فرمان باشیم. 🏁🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨🤩 ساخت پک استیکر حالا داخل ChatGPT!

ChatGPT حالا امکان ساخت استیکر را هم به کاربران می‌دهد. 🧩

کافی است وارد بخش Image در سایت یا اپ ChatGPT شوید و گزینه Stickers را انتخاب کنید.

📸 می‌توانید تصاویر خودتان را به مجموعه‌ای از استیکرهای آماده برای استفاده در مسنجرهای مختلف تبدیل کنید.

📌 یعنی ساخت پک استیکر شخصی، حالا فقط چند کلیک با شما فاصله دارد! 😎🔥
🎬🤯 گوگل Gemini Omni 1.1 Flash را معرفی کرد؛ ویدیو تا ۴۰ ثانیه و 4K!

گوگل نسخه جدید Gemini Omni 1.1 Flash را معرفی کرده که کنترل بسیار بیشتری روی تولید ویدیو می‌دهد.

🔹 ادامه دادن ویدیو در بخش‌های ۱۰ ثانیه‌ای تا مجموع ۴۰ ثانیه
🔹 تولید خروجی نهایی تا 4K
🔹 کنترل فریم اول و آخر برای ساخت حرکت بین دو نقطه
🔹 استفاده از ویدیوی مرجع برای حفظ شخصیت و محیط
🔹 حالت 360p برای تست سریع‌تر و ارزان‌تر ایده‌ها

این مدل از طریق Gemini API در دسترس توسعه‌دهندگان است و به Flow و اپ Gemini هم راه پیدا کرده؛ همچنین در ابزارهایی مثل Adobe Firefly ادغام شده است.

📌 نکته مهم: ویدیوها ابتدا می‌توانند با وضوح پایین‌تر ساخته شوند و بعد برای خروجی نهایی به 1080p یا 4K ارتقا پیدا کنند.

🔥 گوگل با این آپدیت، Gemini Omni را از یک ویدیوژنراتور ساده به سمت یک ابزار واقعی برای کارگردانی و ادیت ویدیو با دستور متنی می‌برد.
⚡️ H3 Max
تولید ویدیو سریع‌تر از زمان واقعی!

شرکت fal نسخه‌ای بهینه‌شده از MiniMax H3 با نام H3 Max منتشر کرده که می‌تواند یک ویدیوی ۵ ثانیه‌ای 768p را در کمتر از ۳ ثانیه تولید کند؛ یعنی سریع‌تر از زمان پخش خود ویدیو! 🤯

🔥 نکات مهم:

🎬 تولید ویدیو همراه با صدای همگام

حدود ۳۵ برابر throughput بیشتر از API رسمی H3

🏆 رتبه اول در Artificial Analysis برای Image-to-Video با صدا

🧠 با فاین‌تیون H3 روی داده‌های جدید، کیفیت و درک پرامپت هم بهبود یافته

📺 حداکثر رزولوشن فعلاً 768p و طول ویدیو ۵ تا ۱۵ ثانیه است.


💰 قیمت فعلی 768p حدود ۰.۰۴ دلار به‌ازای هر ثانیه با تخفیف لانچ است و نرخ عادی ۰.۰۸ دلار خواهد بود.

📌 نکته مهم اینجاست: وقتی تولید ویدیو از حالت «منتظر بمان» خارج شود و سریع‌تر از زمان واقعی انجام شود، ساخت و اصلاح ویدیو می‌تواند تقریباً مثل کار با یک ابزار تعاملی معمولی شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
پروژه متن‌باز Soup فرایند Fine-tuning و Post-training مدل‌های LLM را به یک فایل YAML و یک دستور تبدیل کرده است. [GitHub پروژه Soup](https://github.com/MakazhanAlpamys/Soup?utm_source=chatgpt.com)

🤯 قابلیت جذابش Layer Streaming است؛ لایه‌های مدل به‌صورت یکی‌یکی از RAM به GPU منتقل می‌شوند و در نتیجه کل مدل لازم نیست داخل VRAM قرار بگیرد.

📊 در تست توسعه‌دهندگان، Llama 3.1 8B Instruct با NF4 روی RTX 3050 لپ‌تاپی با فقط ۴GB VRAM اجرا شد و حداکثر مصرف VRAM حدود ۳.۳۲GB بود.

🔹 پشتیبانی از LoRA و QLoRA
🔹 DPO، ORPO، KTO، SimPO و روش‌های دیگر
🔹 تشخیص خودکار GPU و تنظیم Batch Size
🔹 اجرای کاملاً محلی و بدون نیاز به Cloud

📌 یعنی فاین‌تیون مدل‌های 8B دیگر الزاماً به GPUهای گران‌قیمت نیاز ندارد؛ البته روی سخت‌افزار ضعیف‌تر، زمان آموزش بسیار بیشتر خواهد بود.

هوش مصنوعی روی لپ‌تاپ‌های معمولی هم دارد جدی‌تر می‌شود. 🥣🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 MeiGen
؛ گالری پرامپت‌های آماده برای AI

اگه برای ساخت عکس و ویدئو با هوش مصنوعی ایده یا پرامپت نداری، MeiGen می‌تونه خیلی به کارت بیاد.

🔹 گالری نمونه‌های ساخته‌شده با AI
🔹 پرامپت‌های آماده برای Nano Banana، GPT Image 2 و مدل‌های دیگه
🔹 تبدیل تصویر به پرامپت (Image to Prompt)
🔹 ایده برای پوستر، پرتره، والپیپر، تبلیغات و...
🔹 امکان شخصی‌سازی پرامپت‌ها و ساخت محتوای خودت

🌐 "MeiGen" (https://www.meigen.ai/)

#هوش_مصنوعی #
2
🎓 یه سایت برای پیدا کردن تخفیف‌های دانشجویی!

اگه ایمیل دانشگاهی داری، این سایت می‌تونه خیلی به دردت بخوره 👀

توی nav.edumails.cn کلی سرویس و ابزار مختلف رو جمع کرده که برای دانشجوها تخفیف یا پلن رایگان دارن؛ از ابزارهای هوش مصنوعی و برنامه‌نویسی گرفته تا سرویس‌های ابری و طراحی.



🔗 https://nav.edumails.cn


من یه ترفند میگم بعضی از این آفرها رو میشه با فیک میل دانشجویی گرفت


https://imail.edu.vn/

https://temp-mail.edu.rs/

https://nullsto.edu.pl/