ابزارها و کاربردهای هوش مصنوعی
4.81K subscribers
1.07K photos
764 videos
1.02K files
1.61K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🎧 معرفی اپ موبایل LivDub؛ هر صدایی رو به زبان خودت بشنو! 🚀

با LivDub می‌تونید صدایی که روی گوشیتون در حال پخشه رو به زبان خودتون دوبله و ترجمه کنید؛ حتی می‌تونید صدای محیط اطرافتون رو هم از طریق هدفون، به زبان خودتون بشنوید! 🤯

📱 دوبله صدای گوشی

می‌تونید هنگام شروع دوبله، کل صفحه یا یک اپ خاص رو در اختیار LivDub قرار بدید تا صدای در حال پخش رو براتون ترجمه و دوبله کنه.

🎧 دوبله صدای محیط

یکی از قابلیت‌های جالب LivDub همین بخشه.
مثلاً فرض کنید تلویزیون داره به یه زبان دیگه صحبت می‌کنه؛ میکروفون گوشی رو نزدیک تلویزیون قرار می‌دید، هدفون رو می‌ذارید و LivDub صدای دریافتی رو ترجمه و دوبله‌شده براتون پخش می‌کنه.

یه چیزی شبیه همون سیستم‌های ترجمه همزمان که در کنفرانس‌های بین‌المللی استفاده میشه! 🌍

🔑 برای استفاده از LivDub، طبق توضیحات سازنده، می‌تونید کلید Gemini خودتون از Google رو تنظیم کنید.

💰 رایگانه؟
بله! نسخه رایگان LivDub روزانه دقایق بیشتری نسبت به افزونه در اختیارتون میذاره. برای امکانات بیشتر و استفاده نامحدود هم می‌تونید از نسخه Plus استفاده کنید.

📲 فعلاً نسخه Android در دسترسه و نسخه iOS هم در حال آماده‌شدنه.

🌐 سایت:
"livdub.com"
📥 دانلود از Google Play:
"LivDub در Google Play"

اگه به ترجمه و دوبله همزمان محتوا علاقه دارید، ارزش امتحان کردن داره. 🔥

🔑 برای LivDub به Gemini API Key نیاز داری؟

اگر LivDub ازت Gemini API Key خواست، می‌تونی از Google AI Studio کلید API خودت رو بسازی.

1️⃣ وارد Google AI Studio شو
2️⃣ با اکانت گوگل وارد شو
3️⃣ روی Create API key بزن
4️⃣ کلید ساخته‌شده رو کپی کن
5️⃣ داخل LivDub وارد کن

⚠️ API Key رو با کسی به اشتراک نذار؛ چون هر کسی به کلیدت دسترسی داشته باشه می‌تونه از سهمیه و اعتبار API استفاده کنه.

https://aistudio.google.com/api-keys

#هوش_مصنوعی
1
This media is not supported in your browser
VIEW IN TELEGRAM
🧬🤯 Claude Fable 5.1
؛ هوش مصنوعی وارد فاز «تحقیق علمی» شد!

Anthropic
مدل‌های Claude Fable 5.1 و Claude Mythos 5.1 را معرفی کرده؛ یک مدل پایه با دو سطح متفاوت از محدودیت‌های ایمنی. Fable برای عموم عرضه شده و Mythos فعلاً برای برنامه‌های دسترسی تأییدشده محدود است.

🔬 چند قابلیت چشمگیر:

🧪 در Terminal-Bench-Science امتیاز از 24.7٪ به 52.6٪ رسیده.

🧬 در آزمایش‌های طراحی پروتئین، Anthropic از نرخ موفقیت نزدیک به ۵۰٪ در ۱۲ هدف گزارش داده.

🪐 Claude
توانسته نقشه ارتفاعی بخشی از زهره را از تصاویر راداری Magellan بازسازی کند.

💰 هزینه معمولی حدود ۲۵٪ و هزینه کارهای Agentی پیچیده تا ۴۵٪ کاهش یافته؛ بخش مهمی از این کاهش از ارزان‌تر شدن Cache Read آمده است.


📌 نکته مهم: این‌ها عمدتاً نتایج و ادعاهای منتشرشده توسط Anthropic هستند و برخی آزمایش‌های علمی برای تکرار مستقل به داده و آزمایشگاه نیاز دارند.

به نظر می‌رسد Claude دیگر فقط برای «جواب دادن» ساخته نمی‌شود؛ هدف بعدی، انجام بخش‌هایی از فرایند تحقیق علمی است. 🧠🔬
🎧🔊 اسپیکری که صدا را مستقیم برای خودت می‌فرستد!

محققان POSTECH فناوری MiPAL را ساخته‌اند؛ اسپیکری که می‌تواند صدا را به شکل یک پرتو باریک به سمت یک شنونده هدایت کند، بدون اینکه اطرافیان صدای زیادی بشنوند.

🔹 فقط با یک مبدل اولتراسونیک و دو لایه متامتریال
🔹 پوشش فرکانسی ۵۰۰ هرتز تا ۱۰ کیلوهرتز
🔹 آزمایش موفق در شبیه‌سازی صندلی‌های هواپیما
🔹 ساختارهای متامتریال با پرینت سه‌بعدی قابل شخصی‌سازی هستند

این سیستم با هدایت امواج اولتراسونیک و استفاده از رفتار غیرخطی هوا، صدای قابل شنیدن را در یک مسیر باریک ایجاد می‌کند.

📌 کاربردهای احتمالی: سرگرمی شخصی در هواپیما و قطار، راهنمای صوتی موزه‌ها و سیستم‌های صوتی اختصاصی بدون نیاز به هدفون.
Media is too big
VIEW IN TELEGRAM
🌍🤯 Atlas؛ هوش مصنوعی که عکس را ب
ه یک دنیای سه‌بعدی تبدیل می‌کند!

"World Labs" (https://www.worldlabs.ai/?utm_source=chatgpt.com)
مدل جدید Atlas را معرفی کرده؛ یک مدل «World Model» که می‌تواند از متن، عکس و ویدیو، ساختار سه‌بعدی محیط را بازسازی کند. 

🔹 با چند عکس، فضای کامل سه‌بعدی ساخته می‌شود
🔹 حتی از یک تصویر بخش‌های پنهان محیط را حدس می‌زند
🔹 دوربین را می‌توان آزادانه حرکت داد، درحالی‌که هندسه صحنه حفظ می‌شود
🔹 تولید ویدیو تا ۱ دقیقه با کیفیت 1440p و مسیر دوربین قابل‌کنترل
🔹 تبدیل ویدئوی یک محیط واقعی به شبیه‌سازی برای آموزش ربات‌ها

📌 Atlas
فعلاً در دسترس شرکای منتخب و برنامه Early Access است و قرار است پایه نسل‌های بعدی Marble و محصولات دیگر World Labs باشد.
1
Media is too big
VIEW IN TELEGRAM
🎵🤖 Gemini
با Lyria 3.5 وارد فاز جدید موزیک‌سازی شد!

گوگل مدل جدید Lyria 3.5 را معرفی کرده؛ مدلی برای ساخت موسیقی با وکال بهتر، تنظیم‌های غنی‌تر و کیفیت بالاتر.

🔹 انتخاب یا توصیف سبک موسیقی
🔹 حالت با وکال یا بی‌کلام
🔹 تعیین طول آهنگ
🔹 قالب‌های آماده برای موزیک پس‌زمینه، جینگل و آهنگ شخصی
🔹 در دسترس روی Gemini وب و موبایل، Gemini API و Google AI Studio

📌 یعنی حالا با چند خط توضیح، Gemini می‌تواند یک قطعه موسیقی کامل‌تر و حرفه‌ای‌تر بسازد. 🎧🔥
🤯🎮 GPT-6 Astra
حالا می‌تواند دنیای بازی بسازد!

طبق گزارش‌ها، تسترهای اولیه از Astra برای ساخت مدل‌های سه‌بعدی در Blender و تولید بازی با Unreal Engine 5 و Unity استفاده می‌کنند.

🔹 بازسازی دقیق‌تر محیط‌ها و آبجکت‌ها با صدها متریال
🔹 تولید Cutscene برای بازی‌ها
🔹 ساخت نمونه‌های قابل‌بازی فقط با یک پرامپت
🔹 کدنویسی و طراحی بازی با توضیح ساده به سبک Vibe Coding

📌 اگر این روند ادامه پیدا کند، احتمالاً به‌زودی شاهد موجی از بازی‌های مستقل و پروژه‌های ساخته‌شده با AI روی Steam خواهیم بود. 🚀
🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
😺🧬 GPT-6 Astra
یک مدل سه‌بعدی با ۲۲۳۴ بخش آناتومی ساخته!

طبق این گزارش، Astra یک وب‌سایت سه‌بعدی ساخته که آناتومی مردانه را به ۲۲۳۴ بخش قابل‌مدل‌سازی تقسیم می‌کند.

🔹 برای داده‌های پایه از دیتابیس BodyParts3D استفاده شده
🔹 بنابراین کل مدل از صفر توسط Astra ساخته نشده
🔹 هنوز مشخص نیست دقت مدل توسط یک متخصص آناتومی بررسی شده یا نه
🔹 همچنین اصالت پروژه و میزان شباهتش به ابزارهای آموزشی موجود مشخص نیست

📌 نکته مهم: تعداد بالای جزئیات جذابه، اما دقت علمی و منبع داده‌ها مهم‌تر از ظاهر سه‌بعدی پروژه است.
🏆1
Media is too big
VIEW IN TELEGRAM
🤖💀 Astra
حتی «من ربات نیستم» را هم شکست داد!

طبق این گزارش، Astra موفق شده هر ۴۸ مرحله بازی معروف «I’m Not a Robot» را پشت سر بگذارد.

🚨 آخرین سنگر بشر هم سقوط کرد!

📌 اگر AI از این مرحله هم عبور کرده، دیگر باید برای ربات‌ها یک تست جدید پیدا کنیم! 😂

@aipost 🏴
🤯2
🚀 ساخت سایت با ChatGPT؛ بدون کدنویسی!

تصور کنید فقط ایده‌تان را برای ChatGPT توضیح بدهید و چند دقیقه بعد، یک سایت آماده و قابل انتشار تحویل بگیرید!

🟢 قابلیت جدید ChatGPT Sites حالا در مرحله بتای عمومی قرار دارد و به کاربران اجازه می‌دهد بدون نیاز به دانش برنامه‌نویسی، ایده‌های خود را به یک تجربه وب واقعی تبدیل کنند.

🔸 کافی است ایده‌تان را به‌صورت متنی توضیح دهید؛ حتی می‌توانید از نمونه‌ها یا پروژه‌های موجود هم کمک بگیرید.

🔸 از وب‌سایت و لندینگ‌پیج گرفته تا وب‌اپلیکیشن و بازی‌های ساده؛ ChatGPT می‌تواند بخش زیادی از فرایند ساخت را انجام دهد.

🔸 بعد از ساخته‌شدن سایت هم می‌توانید آن را بررسی، اصلاح، منتشر و با دیگران به اشتراک بگذارید.

⏱️ نکته جالب اینکه آماده‌سازی سایت بسته به پیچیدگی پروژه ممکن است حدود ۱۰ تا ۱۵ دقیقه زمان ببرد.

💡 یعنی دیگر برای شروع یک پروژه وب، لزوماً لازم نیست از همان ابتدا سراغ کدنویسی بروید؛ کافی است دقیق بدانید چه چیزی می‌خواهید بسازید.
🤖 Muse
؛ دستیار هوش مصنوعی جدید Meta که فقط جواب نمی‌دهد، کار انجام می‌دهد!


متا از Muse رونمایی کرده؛ یک دستیار #هوش_مصنوعی شخصی که برای انجام کارهای روزمره طراحی شده، نه فقط چت کردن و پاسخ دادن به سؤال‌ها.

Muse
می‌تواند با اجازه شما در اینترنت جست‌وجو کند، اطلاعات را بررسی کند و کارهای چندمرحله‌ای را انجام دهد؛ از برنامه‌ریزی سفر و پیدا کردن محصول مناسب گرفته تا مدیریت ایمیل‌ها و انجام بعضی کارهای آنلاین.

🧠 این سرویس با مدل Muse Spark کار می‌کند و هدفش این است که از یک «چت‌بات» معمولی به یک AI Agent تبدیل شود؛ یعنی شما هدف را مشخص می‌کنید و Muse مراحل انجام کار را دنبال می‌کند.

🔐 متا همچنین روی امنیت آن تأکید کرده و Muse را در محیط اختصاصی خودش اجرا می‌کند تا فعالیت‌های Agent کنترل‌شده‌تر باشند.

📱 Muse from Meta

🍎 نسخه iOS:
"دانلود از App Store"

🤖 نسخه Android:
"دانلود از Google Play"

🌐 نسخه وب:
"muse.ai"

⚡️ اگر AI Agentها قرار است نسل بعدی دستیارهای هوشمند باشند، Muse یکی از جدی‌ترین تلاش‌های Meta برای ورود به این حوزه است.
🟠 اگه با Google Flow برای ساخت ویدیو با هوش مصنوعی کار می‌کنید، ممکنه با خطای:

Flow is not available in your country yet

مواجه شده باشید.

یکی از چیزهایی که می‌تونه باعث این خطا بشه، Region مرتبط با اکانت گوگله.

🔸 اول با همون اکانتی که می‌خواید وارد Flow بشید، Region اکانت رو بررسی کنید. اگر کشور اشتباه ثبت شده، می‌تونید از فرم رسمی گوگل برای درخواست تغییر Region استفاده کنید:

https://policies.google.com/country-association-form

🔸 اگر با VPN وارد می‌شید، بهتره IP شما با همون کشوری که انتخاب کردید هماهنگ باشه و مرتب بین کشورهای مختلف جابه‌جا نشید.

⚠️ تغییر Region برای بعضی کاربران مشکل رو حل کرده، اما تضمینی نیست؛ چون دسترسی Flow به کشور پشتیبانی‌شده و شرایط اکانت هم بستگی داره.

لیست کشورهای پشتیبانی‌شده Flow:
https://support.google.com/flow/answer/16353544


کلاً برای ساخت اکانت توی این‌جور سایت‌ها، ترجیحاً از سرویس‌های VPN معتبر با پروتکل‌هایی مثل OpenVPN یا WireGuard استفاده کنید یا سراغ افزونه‌های VPN شناخته‌شده برید.


یه نکته مهم که متأسفانه خیلی‌ها بهش توجه نمی‌کنن، هماهنگی بین IP، مرورگر، زبان سیستم و Time Zoneـه.

مثلاً اگه IP شما مربوط به یه کشور باشه ولی زبان و Time Zone دستگاه چیز دیگه‌ای رو نشون بده، ممکنه بعضی سرویس‌ها این عدم تطابق رو به‌عنوان یکی از سیگنال‌های تشخیص موقعیت در نظر بگیرن.

پس تا جای ممکن این موارد رو با لوکیشن IP هماهنگ نگه دارید.
🚀 Meta
دوباره مدل Muse Spark را ارتقا داد؛ نسخه 1.3 منتشر شد!

متا از Muse Spark 1.3 رونمایی کرده؛ مدلی که این بار تمرکز ویژه‌ای روی کدنویسی و انجام وظایف چندمرحله‌ای دارد.

🔹 طبق اعلام متا، Muse Spark 1.3 در مقایسه با نسخه 1.2:

• حدود ۲۵٪ توکن کمتر مصرف می‌کند
• حدود ۲۰٪ Tool Call کمتری انجام می‌دهد
• در کارهای کدنویسی عملکرد سریع‌تر و کارآمدتری دارد
• در وظایف طولانی و چندمرحله‌ای، بهتر می‌تواند دستورها و محدودیت‌های کاربر را حفظ کند. 

📊 نکته جالب‌تر، عملکرد این مدل در بنچمارک‌هاست؛ Muse Spark 1.3 در برخی ارزیابی‌ها به جمع مدل‌های قدرتمند بازار نزدیک شده و همین موضوع رقابت Meta با دیگر شرکت‌های بزرگ AI را جدی‌تر می‌کند.

💰 قیمت‌گذاری هم تغییر نکرده و متا همچنان دو سطح دسترسی را ارائه می‌دهد؛ یکی با حفظ حریم خصوصی بیشتر و دیگری با اجازه استفاده از داده‌ها برای بهبود مدل.

🔓 متا همچنین اعلام کرده که انتشار نسخه Open Weights در نقشه راه قرار دارد؛ هرچند هنوز مشخص نیست این انتشار دقیقاً مربوط به کدام نسخه خواهد بود. 
This media is not supported in your browser
VIEW IN TELEGRAM
🎬 هوش مصنوعی حالا می‌تونه یک پخش زنده ویدیویی بسازه که همون لحظه کارگردانی‌اش کنید!

شرکت fal نسخه جدید H3 Max Director رو معرفی کرده؛ مدلی که به‌جای ساخت چند کلیپ جداگانه، یک ویدیوی پیوسته و زنده تولید می‌کنه و اتفاقات قبلی، شخصیت‌ها و فضای صحنه رو در طول پخش به خاطر می‌سپاره.

🔹 جذاب‌ترین بخش ماجرا اینه که می‌تونید در حین پخش، پرامپت رو تغییر بدید و مسیر اتفاقات رو همان لحظه عوض کنید؛ بدون اینکه ویدیو متوقف یا از اول ساخته بشه.

🔹 صدا هم همزمان با تصویر تولید می‌شه و می‌تونه شامل دیالوگ، افکت‌های صوتی و موسیقی باشه.

📺 نمونه واقعی این فناوری رو می‌شه در fal.live دید؛ جایی که بیننده‌ها انتخاب می‌کنن در ادامه چه اتفاقی بیفته و مدل، داستان رو بر اساس انتخاب آن‌ها جلو می‌بره.

💰 قیمت فعلی:
▫️ هر ثانیه: ۰٫۰۲ دلار
▫️ حداقل هزینه هر جلسه: ۱٫۲۰ دلار برای ۶۰ ثانیه
▫️ بعد از ۱۴ سپتامبر: ۰٫۰۸ دلار در هر ثانیه
▫️ جلسات عمومی فعلاً حداکثر ۲ دقیقه هستند و زمان‌های طولانی‌تر برای برخی پروژه‌های تأییدشده فعال می‌شوند.
🚀 Astra
به Codex رسید!

به‌نظر می‌رسه OpenAI عرضه Astra در Codex رو برای کاربران Pro شروع کرده و این مدل به‌تدریج در حال فعال‌شدن برای این کاربران است.

🔹 Astra مدل جدید OpenAI است که تمرکز ویژه‌ای روی انجام وظایف پیچیده، کار با کامپیوتر، کدنویسی و اجرای مستقل‌تر وظایف دارد.

🔹 عرضه Astra از ابتدا مرحله‌ای بوده و کاربران Pro جزو گروه‌هایی هستند که دسترسی آن‌ها در حال گسترش است.

🔥 حالا با ورود Astra به Codex، باید دید این مدل در محیط واقعی توسعه نرم‌افزار چقدر می‌تونه عملکرد Codex رو بهتر کنه.

برای شما هم Astra داخل Codex فعال شده؟ 👀
🔥 خبر خوب برای عاشقان 3D؛ Astra با Blender حسابی غوغا کرده!

به‌نظر می‌رسه GPT-6 Astra در کار با Blender عملکرد خیلی جذابی داره و می‌تونه از طریق اجرای اسکریپت‌های Python، صحنه‌های سه‌بعدی رو بسازه، ویرایش کنه و رندر بگیره.

🔹 یعنی به‌جای اینکه فقط درباره یک مدل سه‌بعدی توضیح بده، می‌تونه مستقیماً با Blender کار کنه و یک پروژه واقعی بسازه.

🔹 در نمونه‌های منتشرشده، Astra توانسته از تصاویر مرجع، صحنه‌های سه‌بعدی قابل ویرایش ایجاد کند و حتی آن‌ها را برای استفاده در پروژه‌های تعاملی آماده کند.

🤯 چیزی که ماجرا رو جذاب‌تر می‌کنه اینه که این روند می‌تونه بخشی از کارهای زمان‌بر مدل‌سازی و ساخت صحنه رو به یک Agent بسپره.

به‌نظر می‌رسه Blender داره به یکی از زمین‌های بازی جدی Agentهای هوش مصنوعی تبدیل می‌شه. 👀
Media is too big
VIEW IN TELEGRAM
🎨 OpenAI
حالا ChatGPT Images 2.5 را منتشر کرد؛ ویرایش تصاویر حالا دقیق‌تر شده!

OpenAI
نسخه جدید ChatGPT Images 2.5 را منتشر کرده؛ اما تمرکز اصلی این آپدیت فقط روی زیباتر شدن تصاویر نیست، بلکه روی کنترل بیشتر هنگام ویرایش است.

🔹 مهم‌ترین تغییر، ویرایش دقیق‌تر تصاویر است؛ یعنی وقتی چند بار پشت سر هم درخواست تغییر می‌دهید، مدل بهتر می‌تواند بخش موردنظر را تغییر دهد و سایر قسمت‌های تصویر را دست‌نخورده نگه دارد.

🔹 قابلیت جدید Sketch هم اضافه شده؛ می‌توانید یک طرح ساده و حتی یک نقاشی دست‌وپا‌شکسته بکشید و ChatGPT آن را به یک تصویر کامل تبدیل کند. ✏️➡️🎨

🔹 Templates هم برای کارهای رایج مثل ساخت پوستر، لوگو، تصاویر محصول و اینفوگرافیک در دسترس قرار گرفته تا لازم نباشد هر بار پرامپت را از صفر بنویسید.

⚡️ سرعت تولید هم بهتر شده و OpenAI می‌گوید Images 2.5 می‌تواند تصاویر را تا ۵۰٪ سریع‌تر از Images 2.0 تولید کند.

🤖 در API هم دو نسخه از مدل ارائه شده؛ یک نسخه پیشرفته‌تر و یک نسخه سبک‌تر برای استفاده‌های ساده‌تر.