🎬🔥 FLUX
حالا ویدیوها را هم
Upscale
میکند!
شرکت BFL مدل جدید FLUX Video Upscale را معرفی کرده؛ یک مدل تخصصی برای افزایش کیفیت ویدیو که برخلاف Upscalerهای معمول، فریمبهفریم کار نمیکند و کل ویدیو را بهصورت یک مدل ویدیویی پردازش میکند.
🎥 ورودی:
حداکثر ۲۰ ثانیه
تا 2560×1440
⚙️ دو حالت دارد:
🔹 Precise — ۴ مرحله، سریعتر و مناسب حفظ چهره و جزئیات اصلی
🔹 Creative — ۸ مرحله، جزئیات بیشتری تولید میکند اما ممکن است ظاهر چهرهها یا اشیای مهم را تغییر دهد.
💰 هزینه تقریبی هر ثانیه: Full HD: حدود ۰.۱۴ تا ۰.۲۰ دلار
4K: حدود ۰.۵۵ تا ۰.۷۹ دلار
📌 این مدل مخصوصاً برای ویدیوهای ساختهشده با اکوسیستم FLUX طراحی شده و میتواند کیفیت خروجیهای AI را یک مرحله بالاتر ببرد. 🚀
حالا ویدیوها را هم
Upscale
میکند!
شرکت BFL مدل جدید FLUX Video Upscale را معرفی کرده؛ یک مدل تخصصی برای افزایش کیفیت ویدیو که برخلاف Upscalerهای معمول، فریمبهفریم کار نمیکند و کل ویدیو را بهصورت یک مدل ویدیویی پردازش میکند.
🎥 ورودی:
حداکثر ۲۰ ثانیه
تا 2560×1440
⚙️ دو حالت دارد:
🔹 Precise — ۴ مرحله، سریعتر و مناسب حفظ چهره و جزئیات اصلی
🔹 Creative — ۸ مرحله، جزئیات بیشتری تولید میکند اما ممکن است ظاهر چهرهها یا اشیای مهم را تغییر دهد.
💰 هزینه تقریبی هر ثانیه: Full HD: حدود ۰.۱۴ تا ۰.۲۰ دلار
4K: حدود ۰.۵۵ تا ۰.۷۹ دلار
📌 این مدل مخصوصاً برای ویدیوهای ساختهشده با اکوسیستم FLUX طراحی شده و میتواند کیفیت خروجیهای AI را یک مرحله بالاتر ببرد. 🚀
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
💬🤖 ChatGPT
حالا میتواند iMessage شما را مدیریت کند!
OpenAI
یک پلاگین جدید برای Apple Messages روی Mac منتشر کرده که ChatGPT را مستقیماً به پیامهای شما متصل میکند.
🔹 جستوجو و خلاصهکردن گفتگوها
🔹 پیدا کردن پیامهایی که از دست دادهاید
🔹 نوشتن پاسخ
🔹 ارسال پیام از طرف شما با تأیید کاربر
🔹 پیدا کردن اطلاعاتی مثل تولدها در چت و ارتباط آن با تقویم
🔹 شناسایی گفتگوهای مشکوک به اسپم
⚠️ این قابلیت فعلاً برای Macهای Apple Silicon و در محیطهای ChatGPT Work و Codex ارائه شده است. طبق توضیح OpenAI، پردازش پلاگین روی خود مک انجام میشود و کاربر برای دسترسی و ارسال پیام باید مجوز بدهد.
📌 نکته حساس: برای ارسال پیام، بهتر است تأیید هر پیام فعال بماند؛ چون در غیر این صورت AI میتواند بدون بررسی نهایی شما پیام بفرستد. OpenAI خودش هم درباره فعالکردن تأیید دائمی هشدار داده است.
یعنی ChatGPT دیگر فقط پیامها را نمیخواند؛ کمکم دارد تبدیل به دستیار ارتباطی واقعی شما میشود. 😳📱
حالا میتواند iMessage شما را مدیریت کند!
OpenAI
یک پلاگین جدید برای Apple Messages روی Mac منتشر کرده که ChatGPT را مستقیماً به پیامهای شما متصل میکند.
🔹 جستوجو و خلاصهکردن گفتگوها
🔹 پیدا کردن پیامهایی که از دست دادهاید
🔹 نوشتن پاسخ
🔹 ارسال پیام از طرف شما با تأیید کاربر
🔹 پیدا کردن اطلاعاتی مثل تولدها در چت و ارتباط آن با تقویم
🔹 شناسایی گفتگوهای مشکوک به اسپم
⚠️ این قابلیت فعلاً برای Macهای Apple Silicon و در محیطهای ChatGPT Work و Codex ارائه شده است. طبق توضیح OpenAI، پردازش پلاگین روی خود مک انجام میشود و کاربر برای دسترسی و ارسال پیام باید مجوز بدهد.
📌 نکته حساس: برای ارسال پیام، بهتر است تأیید هر پیام فعال بماند؛ چون در غیر این صورت AI میتواند بدون بررسی نهایی شما پیام بفرستد. OpenAI خودش هم درباره فعالکردن تأیید دائمی هشدار داده است.
یعنی ChatGPT دیگر فقط پیامها را نمیخواند؛ کمکم دارد تبدیل به دستیار ارتباطی واقعی شما میشود. 😳📱
❤1👍1
🦆 Duck.ai
چند هوش مصنوعی، یکجا با تمرکز روی حریم خصوصی
اگه دوست داری بدون ساختن چندتا اکانت مختلف، با چند مدل هوش مصنوعی کار کنی، Duck.ai گزینه جالبیه.
🔹 دسترسی به چند مدل هوش مصنوعی از یک محیط
🔹 امکان مقایسه جواب مدلهای مختلف
🔹 حذف اطلاعاتی مثل IP قبل از ارسال درخواست به ارائهدهنده مدل
🔹 چتها بهصورت پیشفرض برای آموزش مدلها استفاده نمیشن
🔹 تاریخچه چت بهصورت پیشفرض روی دستگاه خودت ذخیره میشه
یعنی بهجای اینکه برای هر مدل بری سراغ یه سرویس جدا، میتونی همه رو از داخل Duck.ai امتحان کنی. 🦆
🤖 مدلهای رایگان: • GPT-5.4 nano
• GPT-5.4 mini
• Claude 4.5 Haiku
• Mistral Small 4
• GPT-oss 120B
• Gemma 4 31B
📌 برای ترجمه، خلاصهکردن، نوشتن متن و کارهای روزمره هوش مصنوعی هم کاربردیه.
🌐 Duck.ai:
https://duck.ai/
#هوش_مصنوعی #حریم_خصوصی
چند هوش مصنوعی، یکجا با تمرکز روی حریم خصوصی
اگه دوست داری بدون ساختن چندتا اکانت مختلف، با چند مدل هوش مصنوعی کار کنی، Duck.ai گزینه جالبیه.
🔹 دسترسی به چند مدل هوش مصنوعی از یک محیط
🔹 امکان مقایسه جواب مدلهای مختلف
🔹 حذف اطلاعاتی مثل IP قبل از ارسال درخواست به ارائهدهنده مدل
🔹 چتها بهصورت پیشفرض برای آموزش مدلها استفاده نمیشن
🔹 تاریخچه چت بهصورت پیشفرض روی دستگاه خودت ذخیره میشه
یعنی بهجای اینکه برای هر مدل بری سراغ یه سرویس جدا، میتونی همه رو از داخل Duck.ai امتحان کنی. 🦆
🤖 مدلهای رایگان: • GPT-5.4 nano
• GPT-5.4 mini
• Claude 4.5 Haiku
• Mistral Small 4
• GPT-oss 120B
• Gemma 4 31B
📌 برای ترجمه، خلاصهکردن، نوشتن متن و کارهای روزمره هوش مصنوعی هم کاربردیه.
🌐 Duck.ai:
https://duck.ai/
#هوش_مصنوعی #حریم_خصوصی
Duck.ai
Use ChatGPT, Claude, and other AIs, privately. Protect chats from hackers, scammers, and companies. Keep info confidential. Free. No account required.
❤2
🤖 Tandem Browser
؛ مرورگری که هوش مصنوعی رو میذاره پشت فرمون!
تا حالا شده به هوش مصنوعی بگی «برو این سایت رو باز کن، این فرم رو پر کن، این اطلاعات رو پیدا کن» و آخرش فقط یه مشت دستورالعمل تحویلت بده؟ 😄
Tandem Browser دقیقاً میخواد این قضیه رو عوض کنه.
این یه مرورگر مبتنی بر Chromium/Electron هست که AI رو مستقیماً داخل مرورگر میاره؛ یعنی هوش مصنوعی میتونه با تبها، کوکیها، سشنهای لاگینشده و خود صفحات وب کار کنه.
🔹 باز کردن سایت و تب
🔹 کلیک و تایپ و پر کردن فرمها
🔹 کار با سایتهایی که API ندارن
🔹 خواندن محتوای صفحات و استخراج اطلاعات
🔹 بررسی API و ترافیک شبکه
🔹 اجرای کارهای چندمرحلهای
🔹 کار همزمان انسان و چند Agent داخل یک مرورگر
🔹 پشتیبانی از Claude، GPT، Gemini، Ollama، LM Studio و...
🔹 امکان اتصال از راه دور با Tailscale
مثلاً میتونی به Agent بگی:
و بهجای اینکه فقط راهنماییت کنه، خودش مرورگر رو کنترل میکنه و کار رو انجام میده. 😎
از اون جالبتر اینکه پروژه Open Source و MITـه و فعلاً بهصورت Developer Preview منتشر شده.
📌 GitHub:
Tandem Browser
#اوپن_سورس
؛ مرورگری که هوش مصنوعی رو میذاره پشت فرمون!
تا حالا شده به هوش مصنوعی بگی «برو این سایت رو باز کن، این فرم رو پر کن، این اطلاعات رو پیدا کن» و آخرش فقط یه مشت دستورالعمل تحویلت بده؟ 😄
Tandem Browser دقیقاً میخواد این قضیه رو عوض کنه.
این یه مرورگر مبتنی بر Chromium/Electron هست که AI رو مستقیماً داخل مرورگر میاره؛ یعنی هوش مصنوعی میتونه با تبها، کوکیها، سشنهای لاگینشده و خود صفحات وب کار کنه.
🔹 باز کردن سایت و تب
🔹 کلیک و تایپ و پر کردن فرمها
🔹 کار با سایتهایی که API ندارن
🔹 خواندن محتوای صفحات و استخراج اطلاعات
🔹 بررسی API و ترافیک شبکه
🔹 اجرای کارهای چندمرحلهای
🔹 کار همزمان انسان و چند Agent داخل یک مرورگر
🔹 پشتیبانی از Claude، GPT، Gemini، Ollama، LM Studio و...
🔹 امکان اتصال از راه دور با Tailscale
مثلاً میتونی به Agent بگی:
«برو این سایت رو بررسی کن، قیمت محصولات رو دربیار و مقایسهشون کن.»
و بهجای اینکه فقط راهنماییت کنه، خودش مرورگر رو کنترل میکنه و کار رو انجام میده. 😎
از اون جالبتر اینکه پروژه Open Source و MITـه و فعلاً بهصورت Developer Preview منتشر شده.
📌 GitHub:
Tandem Browser
#اوپن_سورس
GitHub
GitHub - hydro13/tandem-browser: AI-Human symbiotic browser — browse the web as one entity
AI-Human symbiotic browser — browse the web as one entity - hydro13/tandem-browser
❤1
🚨 بالاخره مشخص شد پشت مدل مرموز Ox Alpha کیه!
چند روز پیش یه مدل ناشناس به اسم Ox Alpha روی OpenRouter ظاهر شد و حسابی سر و صدا کرد؛ بدون اسم سازنده، ولی با عملکرد خیلی خوب در کدنویسی و استدلال، پشتیبانی از متن، تصویر و ویدئو و کانتکست حدود ۱ میلیون توکن. 🤯
همین باعث شده بود همه دنبال این باشن که ببینن این مدل کار کدوم شرکت بزرگه؛ از DeepSeek و مایکروسافت گرفته تا بقیه اسمها مطرح شده بود.
حالا معما حل شده:
🧠 Ox Alpha متعلق به Z.ai، سازنده خانواده مدلهای GLM، بوده.
جالبتر اینکه Z.ai عمداً مدل رو بدون معرفی رسمی منتشر کرده بود تا کاربرا بدون اینکه تحت تأثیر اسم برند قرار بگیرن، خودشون مدل رو امتحان و ارزیابی کنن.
حالا Z.ai اعلام کرده وزنهای Ox Alpha قراره منتشر بشه تا توسعهدهندهها بتونن ازش استفاده کنن و روی اون مدلهای خودشون رو بسازن.
البته فعلاً نباید گفت Ox Alpha همه مدلهای مطرح دنیا رو شکست داده؛ ولی عملکردش نشون میده مدلهای چینی مخصوصاً در حوزه کدنویسی، Reasoning و Agentها دارن خیلی جدی وارد رقابت میشن. 🔥
در واقع داستان Ox Alpha بیشتر از اینکه «یک مدل ناشناس عجیب» باشه، یه جور تست مخفی Z.ai روی دنیای واقعی بود. 😄
🔗 منبع: TechCrunch
#هوش_مصنوعی
چند روز پیش یه مدل ناشناس به اسم Ox Alpha روی OpenRouter ظاهر شد و حسابی سر و صدا کرد؛ بدون اسم سازنده، ولی با عملکرد خیلی خوب در کدنویسی و استدلال، پشتیبانی از متن، تصویر و ویدئو و کانتکست حدود ۱ میلیون توکن. 🤯
همین باعث شده بود همه دنبال این باشن که ببینن این مدل کار کدوم شرکت بزرگه؛ از DeepSeek و مایکروسافت گرفته تا بقیه اسمها مطرح شده بود.
حالا معما حل شده:
🧠 Ox Alpha متعلق به Z.ai، سازنده خانواده مدلهای GLM، بوده.
جالبتر اینکه Z.ai عمداً مدل رو بدون معرفی رسمی منتشر کرده بود تا کاربرا بدون اینکه تحت تأثیر اسم برند قرار بگیرن، خودشون مدل رو امتحان و ارزیابی کنن.
حالا Z.ai اعلام کرده وزنهای Ox Alpha قراره منتشر بشه تا توسعهدهندهها بتونن ازش استفاده کنن و روی اون مدلهای خودشون رو بسازن.
البته فعلاً نباید گفت Ox Alpha همه مدلهای مطرح دنیا رو شکست داده؛ ولی عملکردش نشون میده مدلهای چینی مخصوصاً در حوزه کدنویسی، Reasoning و Agentها دارن خیلی جدی وارد رقابت میشن. 🔥
در واقع داستان Ox Alpha بیشتر از اینکه «یک مدل ناشناس عجیب» باشه، یه جور تست مخفی Z.ai روی دنیای واقعی بود. 😄
🔗 منبع: TechCrunch
#هوش_مصنوعی
❤1
🤯 کلود کد در ۴ ساعت برای یک پرینتر درایور مک ساخت!
یک برنامهنویس ۱۹ ساله با کمک Claude Code توانست زبان اختصاصی پرینتر HP Laser 1008a را مهندسی معکوس کند و از صفر یک درایور قابلاستفاده برای Mac بسازد. 🖨️🍎
🔹 پرینتر بهصورت رسمی از Mac یا AirPrint پشتیبانی نمیکرد.
🔹 Claude Code فرمت اختصاصی چاپ را تحلیل و دستورات macOS را به زبان قابلفهم برای پرینتر تبدیل کرد.
🔹 نتیجه بعد از حدود ۴ ساعت به یک درایور عملیاتی رسید.
🔹 پروژه و حتی متن کامل تعامل با Claude Code هم در GitHub منتشر شده است.
📌 نکته جالب اینجاست که AI دیگر فقط کد مینویسد؛ میتواند در مهندسی معکوس، دیباگ و ساخت ابزارهایی که مستندات رسمی ندارند هم نقش جدی داشته باشد. 🤖🔥
یک برنامهنویس ۱۹ ساله با کمک Claude Code توانست زبان اختصاصی پرینتر HP Laser 1008a را مهندسی معکوس کند و از صفر یک درایور قابلاستفاده برای Mac بسازد. 🖨️🍎
🔹 پرینتر بهصورت رسمی از Mac یا AirPrint پشتیبانی نمیکرد.
🔹 Claude Code فرمت اختصاصی چاپ را تحلیل و دستورات macOS را به زبان قابلفهم برای پرینتر تبدیل کرد.
🔹 نتیجه بعد از حدود ۴ ساعت به یک درایور عملیاتی رسید.
🔹 پروژه و حتی متن کامل تعامل با Claude Code هم در GitHub منتشر شده است.
📌 نکته جالب اینجاست که AI دیگر فقط کد مینویسد؛ میتواند در مهندسی معکوس، دیباگ و ساخت ابزارهایی که مستندات رسمی ندارند هم نقش جدی داشته باشد. 🤖🔥
🤯 گوگل مدل Qwen4 را لو داد!
Alibaba با انتشار Qwen3.8-Flash-Next عملاً نگاهی اولیه به معماری نسل بعدی Qwen4 ارائه کرده است. 🧠
🔥 مشخصات جذاب:
۱۲۵ میلیارد پارامتر؛ اما فقط ۶B پارامتر برای هر بخش از متن فعال میشود.
حدود ۹ برابر هزینه آموزش کمتر از Qwen3.7-Plus
عملکرد بهتر در کدنویسی، استفاده از ابزارها و کارهای طولانی Agentی
پشتیبانی از ۲۶۲ هزار توکن و در حالت Extended تا ۱ میلیون توکن 🤯
وزنهای مدل همین حالا بهصورت Open Weight منتشر شدهاند.
📌 ایده اصلی ساده است: مدل را بزرگ نگه دار، اما همه پارامترها را همزمان فعال نکن.
اگر این معماری در Qwen4 نهایی شود، Alibaba میتواند مدلهای بسیار بزرگ را با هزینه محاسباتی بسیار پایینتری اجرا کند. 🚀
Alibaba با انتشار Qwen3.8-Flash-Next عملاً نگاهی اولیه به معماری نسل بعدی Qwen4 ارائه کرده است. 🧠
🔥 مشخصات جذاب:
۱۲۵ میلیارد پارامتر؛ اما فقط ۶B پارامتر برای هر بخش از متن فعال میشود.
حدود ۹ برابر هزینه آموزش کمتر از Qwen3.7-Plus
عملکرد بهتر در کدنویسی، استفاده از ابزارها و کارهای طولانی Agentی
پشتیبانی از ۲۶۲ هزار توکن و در حالت Extended تا ۱ میلیون توکن 🤯
وزنهای مدل همین حالا بهصورت Open Weight منتشر شدهاند.
📌 ایده اصلی ساده است: مدل را بزرگ نگه دار، اما همه پارامترها را همزمان فعال نکن.
اگر این معماری در Qwen4 نهایی شود، Alibaba میتواند مدلهای بسیار بزرگ را با هزینه محاسباتی بسیار پایینتری اجرا کند. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🤯 OpenAI:
نسل بعدی Codex کاملاً ابری میشود!
OpenAI
در حال آمادهسازی نسل جدید Codex است؛ ایجنتهایی که قرار است بخش بزرگی از پردازش خود را در فضای ابری انجام دهند. ☁️🤖
⚡ نکات مهم:
ایجنتهای مبتنی بر Astra میتوانند همزمان پردازشهای بسیار بیشتری نسبت به یک لپتاپ اجرا کنند.
سرعت Codex میتواند به ۷۵۰+ توکن در ثانیه برسد و این سرعت به حالت عادی تبدیل شود.
Codex
و ChatGPT بهتدریج از یک Harness مشترک برای انجام وظایف مختلف استفاده خواهند کرد.
🎯 هدف نهایی OpenAI: چیزی که آن را Personal AGI مینامد؛ یک اپلیکیشن شخصی که رابط کاربری و ابزارهایش را بر اساس کاری که انجام میدهید، تغییر میدهد.
📌 یعنی Codex آینده فقط یک ابزار کدنویسی نیست؛ قرار است به یک ایجنت عمومی و همیشهدردسترس در فضای ابری تبدیل شود. 🚀
نسل بعدی Codex کاملاً ابری میشود!
OpenAI
در حال آمادهسازی نسل جدید Codex است؛ ایجنتهایی که قرار است بخش بزرگی از پردازش خود را در فضای ابری انجام دهند. ☁️🤖
⚡ نکات مهم:
ایجنتهای مبتنی بر Astra میتوانند همزمان پردازشهای بسیار بیشتری نسبت به یک لپتاپ اجرا کنند.
سرعت Codex میتواند به ۷۵۰+ توکن در ثانیه برسد و این سرعت به حالت عادی تبدیل شود.
Codex
و ChatGPT بهتدریج از یک Harness مشترک برای انجام وظایف مختلف استفاده خواهند کرد.
🎯 هدف نهایی OpenAI: چیزی که آن را Personal AGI مینامد؛ یک اپلیکیشن شخصی که رابط کاربری و ابزارهایش را بر اساس کاری که انجام میدهید، تغییر میدهد.
📌 یعنی Codex آینده فقط یک ابزار کدنویسی نیست؛ قرار است به یک ایجنت عمومی و همیشهدردسترس در فضای ابری تبدیل شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
🏎️🤖 ربات انساننما حالا راننده مسابقه شده!
یک ربات انساننما توانسته کاملاً خودران وارد کابین خودرو شود، فرمان را کنترل کند، با پدالها کار کند و یک مسابقه کامل را به پایان برساند؛ حتی جلوتر از راننده انسانی به خط پایان برسد! 😳
🧠 این سیستم از مدل Direct Perception Control شرکت Symbiosis Robotics استفاده میکند.
جالبتر اینکه ربات باید همزمان بینایی، هر دو دست، هر دو پا، تعادل و کنترل کل بدن را هماهنگ کند.
📌 اگر این فناوری پیشرفت کند، شاید روزی مسابقات اتومبیلرانی شاهد رقابت انسان و ربات پشت فرمان باشیم. 🏁🤖
یک ربات انساننما توانسته کاملاً خودران وارد کابین خودرو شود، فرمان را کنترل کند، با پدالها کار کند و یک مسابقه کامل را به پایان برساند؛ حتی جلوتر از راننده انسانی به خط پایان برسد! 😳
🧠 این سیستم از مدل Direct Perception Control شرکت Symbiosis Robotics استفاده میکند.
جالبتر اینکه ربات باید همزمان بینایی، هر دو دست، هر دو پا، تعادل و کنترل کل بدن را هماهنگ کند.
📌 اگر این فناوری پیشرفت کند، شاید روزی مسابقات اتومبیلرانی شاهد رقابت انسان و ربات پشت فرمان باشیم. 🏁🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨🤩 ساخت پک استیکر حالا داخل ChatGPT!
ChatGPT حالا امکان ساخت استیکر را هم به کاربران میدهد. 🧩
کافی است وارد بخش Image در سایت یا اپ ChatGPT شوید و گزینه Stickers را انتخاب کنید.
📸 میتوانید تصاویر خودتان را به مجموعهای از استیکرهای آماده برای استفاده در مسنجرهای مختلف تبدیل کنید.
📌 یعنی ساخت پک استیکر شخصی، حالا فقط چند کلیک با شما فاصله دارد! 😎🔥
ChatGPT حالا امکان ساخت استیکر را هم به کاربران میدهد. 🧩
کافی است وارد بخش Image در سایت یا اپ ChatGPT شوید و گزینه Stickers را انتخاب کنید.
📸 میتوانید تصاویر خودتان را به مجموعهای از استیکرهای آماده برای استفاده در مسنجرهای مختلف تبدیل کنید.
📌 یعنی ساخت پک استیکر شخصی، حالا فقط چند کلیک با شما فاصله دارد! 😎🔥
🎬🤯 گوگل Gemini Omni 1.1 Flash را معرفی کرد؛ ویدیو تا ۴۰ ثانیه و 4K!
گوگل نسخه جدید Gemini Omni 1.1 Flash را معرفی کرده که کنترل بسیار بیشتری روی تولید ویدیو میدهد.
🔹 ادامه دادن ویدیو در بخشهای ۱۰ ثانیهای تا مجموع ۴۰ ثانیه
🔹 تولید خروجی نهایی تا 4K
🔹 کنترل فریم اول و آخر برای ساخت حرکت بین دو نقطه
🔹 استفاده از ویدیوی مرجع برای حفظ شخصیت و محیط
🔹 حالت 360p برای تست سریعتر و ارزانتر ایدهها
این مدل از طریق Gemini API در دسترس توسعهدهندگان است و به Flow و اپ Gemini هم راه پیدا کرده؛ همچنین در ابزارهایی مثل Adobe Firefly ادغام شده است.
📌 نکته مهم: ویدیوها ابتدا میتوانند با وضوح پایینتر ساخته شوند و بعد برای خروجی نهایی به 1080p یا 4K ارتقا پیدا کنند.
🔥 گوگل با این آپدیت، Gemini Omni را از یک ویدیوژنراتور ساده به سمت یک ابزار واقعی برای کارگردانی و ادیت ویدیو با دستور متنی میبرد.
گوگل نسخه جدید Gemini Omni 1.1 Flash را معرفی کرده که کنترل بسیار بیشتری روی تولید ویدیو میدهد.
🔹 ادامه دادن ویدیو در بخشهای ۱۰ ثانیهای تا مجموع ۴۰ ثانیه
🔹 تولید خروجی نهایی تا 4K
🔹 کنترل فریم اول و آخر برای ساخت حرکت بین دو نقطه
🔹 استفاده از ویدیوی مرجع برای حفظ شخصیت و محیط
🔹 حالت 360p برای تست سریعتر و ارزانتر ایدهها
این مدل از طریق Gemini API در دسترس توسعهدهندگان است و به Flow و اپ Gemini هم راه پیدا کرده؛ همچنین در ابزارهایی مثل Adobe Firefly ادغام شده است.
📌 نکته مهم: ویدیوها ابتدا میتوانند با وضوح پایینتر ساخته شوند و بعد برای خروجی نهایی به 1080p یا 4K ارتقا پیدا کنند.
🔥 گوگل با این آپدیت، Gemini Omni را از یک ویدیوژنراتور ساده به سمت یک ابزار واقعی برای کارگردانی و ادیت ویدیو با دستور متنی میبرد.
⚡️ H3 Max
تولید ویدیو سریعتر از زمان واقعی!
شرکت fal نسخهای بهینهشده از MiniMax H3 با نام H3 Max منتشر کرده که میتواند یک ویدیوی ۵ ثانیهای 768p را در کمتر از ۳ ثانیه تولید کند؛ یعنی سریعتر از زمان پخش خود ویدیو! 🤯
🔥 نکات مهم:
🎬 تولید ویدیو همراه با صدای همگام
⚡ حدود ۳۵ برابر throughput بیشتر از API رسمی H3
🏆 رتبه اول در Artificial Analysis برای Image-to-Video با صدا
🧠 با فاینتیون H3 روی دادههای جدید، کیفیت و درک پرامپت هم بهبود یافته
📺 حداکثر رزولوشن فعلاً 768p و طول ویدیو ۵ تا ۱۵ ثانیه است.
💰 قیمت فعلی 768p حدود ۰.۰۴ دلار بهازای هر ثانیه با تخفیف لانچ است و نرخ عادی ۰.۰۸ دلار خواهد بود.
📌 نکته مهم اینجاست: وقتی تولید ویدیو از حالت «منتظر بمان» خارج شود و سریعتر از زمان واقعی انجام شود، ساخت و اصلاح ویدیو میتواند تقریباً مثل کار با یک ابزار تعاملی معمولی شود. 🚀
تولید ویدیو سریعتر از زمان واقعی!
شرکت fal نسخهای بهینهشده از MiniMax H3 با نام H3 Max منتشر کرده که میتواند یک ویدیوی ۵ ثانیهای 768p را در کمتر از ۳ ثانیه تولید کند؛ یعنی سریعتر از زمان پخش خود ویدیو! 🤯
🔥 نکات مهم:
🎬 تولید ویدیو همراه با صدای همگام
⚡ حدود ۳۵ برابر throughput بیشتر از API رسمی H3
🏆 رتبه اول در Artificial Analysis برای Image-to-Video با صدا
🧠 با فاینتیون H3 روی دادههای جدید، کیفیت و درک پرامپت هم بهبود یافته
📺 حداکثر رزولوشن فعلاً 768p و طول ویدیو ۵ تا ۱۵ ثانیه است.
💰 قیمت فعلی 768p حدود ۰.۰۴ دلار بهازای هر ثانیه با تخفیف لانچ است و نرخ عادی ۰.۰۸ دلار خواهد بود.
📌 نکته مهم اینجاست: وقتی تولید ویدیو از حالت «منتظر بمان» خارج شود و سریعتر از زمان واقعی انجام شود، ساخت و اصلاح ویدیو میتواند تقریباً مثل کار با یک ابزار تعاملی معمولی شود. 🚀
This media is not supported in your browser
VIEW IN TELEGRAM
پروژه متنباز Soup فرایند Fine-tuning و Post-training مدلهای LLM را به یک فایل YAML و یک دستور تبدیل کرده است. [GitHub پروژه Soup](https://github.com/MakazhanAlpamys/Soup?utm_source=chatgpt.com)
🤯 قابلیت جذابش Layer Streaming است؛ لایههای مدل بهصورت یکییکی از RAM به GPU منتقل میشوند و در نتیجه کل مدل لازم نیست داخل VRAM قرار بگیرد.
📊 در تست توسعهدهندگان، Llama 3.1 8B Instruct با NF4 روی RTX 3050 لپتاپی با فقط ۴GB VRAM اجرا شد و حداکثر مصرف VRAM حدود ۳.۳۲GB بود.
🔹 پشتیبانی از LoRA و QLoRA
🔹 DPO، ORPO، KTO، SimPO و روشهای دیگر
🔹 تشخیص خودکار GPU و تنظیم Batch Size
🔹 اجرای کاملاً محلی و بدون نیاز به Cloud
📌 یعنی فاینتیون مدلهای 8B دیگر الزاماً به GPUهای گرانقیمت نیاز ندارد؛ البته روی سختافزار ضعیفتر، زمان آموزش بسیار بیشتر خواهد بود.
هوش مصنوعی روی لپتاپهای معمولی هم دارد جدیتر میشود. 🥣🤖
🤯 قابلیت جذابش Layer Streaming است؛ لایههای مدل بهصورت یکییکی از RAM به GPU منتقل میشوند و در نتیجه کل مدل لازم نیست داخل VRAM قرار بگیرد.
📊 در تست توسعهدهندگان، Llama 3.1 8B Instruct با NF4 روی RTX 3050 لپتاپی با فقط ۴GB VRAM اجرا شد و حداکثر مصرف VRAM حدود ۳.۳۲GB بود.
🔹 پشتیبانی از LoRA و QLoRA
🔹 DPO، ORPO، KTO، SimPO و روشهای دیگر
🔹 تشخیص خودکار GPU و تنظیم Batch Size
🔹 اجرای کاملاً محلی و بدون نیاز به Cloud
📌 یعنی فاینتیون مدلهای 8B دیگر الزاماً به GPUهای گرانقیمت نیاز ندارد؛ البته روی سختافزار ضعیفتر، زمان آموزش بسیار بیشتر خواهد بود.
هوش مصنوعی روی لپتاپهای معمولی هم دارد جدیتر میشود. 🥣🤖
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 MeiGen
؛ گالری پرامپتهای آماده برای AI
اگه برای ساخت عکس و ویدئو با هوش مصنوعی ایده یا پرامپت نداری، MeiGen میتونه خیلی به کارت بیاد.
🔹 گالری نمونههای ساختهشده با AI
🔹 پرامپتهای آماده برای Nano Banana، GPT Image 2 و مدلهای دیگه
🔹 تبدیل تصویر به پرامپت (Image to Prompt)
🔹 ایده برای پوستر، پرتره، والپیپر، تبلیغات و...
🔹 امکان شخصیسازی پرامپتها و ساخت محتوای خودت
🌐 "MeiGen" (https://www.meigen.ai/)
#هوش_مصنوعی #
؛ گالری پرامپتهای آماده برای AI
اگه برای ساخت عکس و ویدئو با هوش مصنوعی ایده یا پرامپت نداری، MeiGen میتونه خیلی به کارت بیاد.
🔹 گالری نمونههای ساختهشده با AI
🔹 پرامپتهای آماده برای Nano Banana، GPT Image 2 و مدلهای دیگه
🔹 تبدیل تصویر به پرامپت (Image to Prompt)
🔹 ایده برای پوستر، پرتره، والپیپر، تبلیغات و...
🔹 امکان شخصیسازی پرامپتها و ساخت محتوای خودت
🌐 "MeiGen" (https://www.meigen.ai/)
#هوش_مصنوعی #
❤2
🎓 یه سایت برای پیدا کردن تخفیفهای دانشجویی!
اگه ایمیل دانشگاهی داری، این سایت میتونه خیلی به دردت بخوره 👀
توی nav.edumails.cn کلی سرویس و ابزار مختلف رو جمع کرده که برای دانشجوها تخفیف یا پلن رایگان دارن؛ از ابزارهای هوش مصنوعی و برنامهنویسی گرفته تا سرویسهای ابری و طراحی.
🔗 https://nav.edumails.cn
من یه ترفند میگم بعضی از این آفرها رو میشه با فیک میل دانشجویی گرفت
https://imail.edu.vn/
https://temp-mail.edu.rs/
https://nullsto.edu.pl/
اگه ایمیل دانشگاهی داری، این سایت میتونه خیلی به دردت بخوره 👀
توی nav.edumails.cn کلی سرویس و ابزار مختلف رو جمع کرده که برای دانشجوها تخفیف یا پلن رایگان دارن؛ از ابزارهای هوش مصنوعی و برنامهنویسی گرفته تا سرویسهای ابری و طراحی.
🔗 https://nav.edumails.cn
من یه ترفند میگم بعضی از این آفرها رو میشه با فیک میل دانشجویی گرفت
https://imail.edu.vn/
https://temp-mail.edu.rs/
https://nullsto.edu.pl/
学生教育优惠项目导航
学生教育优惠项目导航 - edu邮箱认证
我们为学生收集整理了各类软件工具、购物优惠、娱乐服务和AI工具的学生专享福利,帮助学生节省费用,提高学习效率,永久更新全球教育优惠,欢迎投稿。