ابزارها و کاربردهای هوش مصنوعی
4.81K subscribers
1.07K photos
764 videos
1.02K files
1.61K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🚨 Fable 5.1
یه هیولای واقعی از Anthropic! 🤯

طرفدارای هوش مصنوعی همین الان دارن Fable رو زیر و رو می‌کنن و چیزایی که ازش درمیاد واقعاً عجیبه:

🧊 مدل‌های 3D واقع‌گرایانه و حتی دنیاهای سه‌بعدی کامل می‌سازه؛
🎮 همین الان بازی‌هایی با مسابقه، چیزی شبیه Mario Kart و نبرد تانکی ساخته شده؛
🌕 با داده‌های ناسا یه کره سه‌بعدی از زمین ساخته و حتی می‌تونه برای ماه‌نوردها مسیر امن پیدا کنه و مرحله‌به‌مرحله توضیح بده؛
✈️ یه کنترل‌کننده ترافیک هوایی برای macOS ساخته که پرواز هواپیماها بالای خونه رو با درنظرگرفتن عوارض زمین، موانع و حتی تأخیر صدا نمایش میده؛
📊 داده‌های شرکت‌ها رو تحلیل می‌کنه، درآمد آینده رو پیش‌بینی می‌کنه و جالب‌تر اینکه محاسبات و پیش‌بینی‌های قبلی خودش رو هم دوباره بررسی می‌کنه؛
🪐 یه نقشه سه‌بعدی فوق‌العاده دقیق از زهره بازسازی کرده؛ جزئیات سطح تقریباً ۶ برابر بهتر شده و ارتفاع عوارض سطحی هم حدود ۲۵٪ دقیق‌تر مشخص میشه.

🔥 خلاصه اینکه Fable 5.1 فقط یه چت‌بات معمولی نیست؛ داره نشون میده هوش مصنوعی می‌تونه خیلی فراتر از متن و چت بره.
1
شرکت OpenAI رسما نسل بعدی مدلهای این شرکت یعنی GPT‑6 Astra رو عرضه کرده که روی اتوماسیون، حل مسائل علمی و کار کردن با رابطهای کاربری مختلف بهینه شده.

این مدل در کنترل رابط کاربری و کار با نرم افزارهای مختلف بهبود بالایی داشته و علاوه بر افزایش دقت، سرعت اون دو برابر بیشتر شده و میتونه کارهای مختلف رو با نصف زمان مدلهای قبلی انجام بده و با نرم افزارهای با رابط پیچیده مثل نرم افزارهای مهندسی و فنی بسیار بهتر کار میکنه.

مدل استرا در تستهای علمی هم امتیاز بالایی کسب کرده و در حالی که مدل Sol در ARC-AGI-3 امتیاز 7.8 درصد رو کسب کرده بود، مدل استرا این تست رو عملا اشباع کرده و امتیاز 98.6 درصد رو گرفته که بالاترین امتیاز تاکنون هست، در تست FrontierMath Tier 4 هم به 97.6 درصد دست یافته که باز هم از هر مدل دیگه ای با اختلاف فاصله داره.

در بخش تستهای امنیتی هم به ادعای OpenAI این مدل عملکرد بسیار بالایی داره و و در تست توسعه و سواستفاده از حفره های امنیتی ExploitBench امتیاز 100 درصد رو گرفته و امتیاز اون در Exploit Gym بیش از هر مدل دیگه ای هست.
🎧 معرفی اپ موبایل LivDub؛ هر صدایی رو به زبان خودت بشنو! 🚀

با LivDub می‌تونید صدایی که روی گوشیتون در حال پخشه رو به زبان خودتون دوبله و ترجمه کنید؛ حتی می‌تونید صدای محیط اطرافتون رو هم از طریق هدفون، به زبان خودتون بشنوید! 🤯

📱 دوبله صدای گوشی

می‌تونید هنگام شروع دوبله، کل صفحه یا یک اپ خاص رو در اختیار LivDub قرار بدید تا صدای در حال پخش رو براتون ترجمه و دوبله کنه.

🎧 دوبله صدای محیط

یکی از قابلیت‌های جالب LivDub همین بخشه.
مثلاً فرض کنید تلویزیون داره به یه زبان دیگه صحبت می‌کنه؛ میکروفون گوشی رو نزدیک تلویزیون قرار می‌دید، هدفون رو می‌ذارید و LivDub صدای دریافتی رو ترجمه و دوبله‌شده براتون پخش می‌کنه.

یه چیزی شبیه همون سیستم‌های ترجمه همزمان که در کنفرانس‌های بین‌المللی استفاده میشه! 🌍

🔑 برای استفاده از LivDub، طبق توضیحات سازنده، می‌تونید کلید Gemini خودتون از Google رو تنظیم کنید.

💰 رایگانه؟
بله! نسخه رایگان LivDub روزانه دقایق بیشتری نسبت به افزونه در اختیارتون میذاره. برای امکانات بیشتر و استفاده نامحدود هم می‌تونید از نسخه Plus استفاده کنید.

📲 فعلاً نسخه Android در دسترسه و نسخه iOS هم در حال آماده‌شدنه.

🌐 سایت:
"livdub.com"
📥 دانلود از Google Play:
"LivDub در Google Play"

اگه به ترجمه و دوبله همزمان محتوا علاقه دارید، ارزش امتحان کردن داره. 🔥

🔑 برای LivDub به Gemini API Key نیاز داری؟

اگر LivDub ازت Gemini API Key خواست، می‌تونی از Google AI Studio کلید API خودت رو بسازی.

1️⃣ وارد Google AI Studio شو
2️⃣ با اکانت گوگل وارد شو
3️⃣ روی Create API key بزن
4️⃣ کلید ساخته‌شده رو کپی کن
5️⃣ داخل LivDub وارد کن

⚠️ API Key رو با کسی به اشتراک نذار؛ چون هر کسی به کلیدت دسترسی داشته باشه می‌تونه از سهمیه و اعتبار API استفاده کنه.

https://aistudio.google.com/api-keys

#هوش_مصنوعی
1
This media is not supported in your browser
VIEW IN TELEGRAM
🧬🤯 Claude Fable 5.1
؛ هوش مصنوعی وارد فاز «تحقیق علمی» شد!

Anthropic
مدل‌های Claude Fable 5.1 و Claude Mythos 5.1 را معرفی کرده؛ یک مدل پایه با دو سطح متفاوت از محدودیت‌های ایمنی. Fable برای عموم عرضه شده و Mythos فعلاً برای برنامه‌های دسترسی تأییدشده محدود است.

🔬 چند قابلیت چشمگیر:

🧪 در Terminal-Bench-Science امتیاز از 24.7٪ به 52.6٪ رسیده.

🧬 در آزمایش‌های طراحی پروتئین، Anthropic از نرخ موفقیت نزدیک به ۵۰٪ در ۱۲ هدف گزارش داده.

🪐 Claude
توانسته نقشه ارتفاعی بخشی از زهره را از تصاویر راداری Magellan بازسازی کند.

💰 هزینه معمولی حدود ۲۵٪ و هزینه کارهای Agentی پیچیده تا ۴۵٪ کاهش یافته؛ بخش مهمی از این کاهش از ارزان‌تر شدن Cache Read آمده است.


📌 نکته مهم: این‌ها عمدتاً نتایج و ادعاهای منتشرشده توسط Anthropic هستند و برخی آزمایش‌های علمی برای تکرار مستقل به داده و آزمایشگاه نیاز دارند.

به نظر می‌رسد Claude دیگر فقط برای «جواب دادن» ساخته نمی‌شود؛ هدف بعدی، انجام بخش‌هایی از فرایند تحقیق علمی است. 🧠🔬
🎧🔊 اسپیکری که صدا را مستقیم برای خودت می‌فرستد!

محققان POSTECH فناوری MiPAL را ساخته‌اند؛ اسپیکری که می‌تواند صدا را به شکل یک پرتو باریک به سمت یک شنونده هدایت کند، بدون اینکه اطرافیان صدای زیادی بشنوند.

🔹 فقط با یک مبدل اولتراسونیک و دو لایه متامتریال
🔹 پوشش فرکانسی ۵۰۰ هرتز تا ۱۰ کیلوهرتز
🔹 آزمایش موفق در شبیه‌سازی صندلی‌های هواپیما
🔹 ساختارهای متامتریال با پرینت سه‌بعدی قابل شخصی‌سازی هستند

این سیستم با هدایت امواج اولتراسونیک و استفاده از رفتار غیرخطی هوا، صدای قابل شنیدن را در یک مسیر باریک ایجاد می‌کند.

📌 کاربردهای احتمالی: سرگرمی شخصی در هواپیما و قطار، راهنمای صوتی موزه‌ها و سیستم‌های صوتی اختصاصی بدون نیاز به هدفون.
Media is too big
VIEW IN TELEGRAM
🌍🤯 Atlas؛ هوش مصنوعی که عکس را ب
ه یک دنیای سه‌بعدی تبدیل می‌کند!

"World Labs" (https://www.worldlabs.ai/?utm_source=chatgpt.com)
مدل جدید Atlas را معرفی کرده؛ یک مدل «World Model» که می‌تواند از متن، عکس و ویدیو، ساختار سه‌بعدی محیط را بازسازی کند. 

🔹 با چند عکس، فضای کامل سه‌بعدی ساخته می‌شود
🔹 حتی از یک تصویر بخش‌های پنهان محیط را حدس می‌زند
🔹 دوربین را می‌توان آزادانه حرکت داد، درحالی‌که هندسه صحنه حفظ می‌شود
🔹 تولید ویدیو تا ۱ دقیقه با کیفیت 1440p و مسیر دوربین قابل‌کنترل
🔹 تبدیل ویدئوی یک محیط واقعی به شبیه‌سازی برای آموزش ربات‌ها

📌 Atlas
فعلاً در دسترس شرکای منتخب و برنامه Early Access است و قرار است پایه نسل‌های بعدی Marble و محصولات دیگر World Labs باشد.
1
Media is too big
VIEW IN TELEGRAM
🎵🤖 Gemini
با Lyria 3.5 وارد فاز جدید موزیک‌سازی شد!

گوگل مدل جدید Lyria 3.5 را معرفی کرده؛ مدلی برای ساخت موسیقی با وکال بهتر، تنظیم‌های غنی‌تر و کیفیت بالاتر.

🔹 انتخاب یا توصیف سبک موسیقی
🔹 حالت با وکال یا بی‌کلام
🔹 تعیین طول آهنگ
🔹 قالب‌های آماده برای موزیک پس‌زمینه، جینگل و آهنگ شخصی
🔹 در دسترس روی Gemini وب و موبایل، Gemini API و Google AI Studio

📌 یعنی حالا با چند خط توضیح، Gemini می‌تواند یک قطعه موسیقی کامل‌تر و حرفه‌ای‌تر بسازد. 🎧🔥
🤯🎮 GPT-6 Astra
حالا می‌تواند دنیای بازی بسازد!

طبق گزارش‌ها، تسترهای اولیه از Astra برای ساخت مدل‌های سه‌بعدی در Blender و تولید بازی با Unreal Engine 5 و Unity استفاده می‌کنند.

🔹 بازسازی دقیق‌تر محیط‌ها و آبجکت‌ها با صدها متریال
🔹 تولید Cutscene برای بازی‌ها
🔹 ساخت نمونه‌های قابل‌بازی فقط با یک پرامپت
🔹 کدنویسی و طراحی بازی با توضیح ساده به سبک Vibe Coding

📌 اگر این روند ادامه پیدا کند، احتمالاً به‌زودی شاهد موجی از بازی‌های مستقل و پروژه‌های ساخته‌شده با AI روی Steam خواهیم بود. 🚀
🤯2