هوش مصنوعی و علم داده به فارسی
6.06K subscribers
2.09K photos
515 videos
366 files
2.27K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
‏🚀 ظهور مدل پیشرو Sonic-3.6 در دنیای TTS

‏شرکت Cartesia با انتشار مدل جدید Sonic-3.6، استانداردهای تولید متن به گفتار (TTS) را جابجا کرده است. این مدل در حال حاضر رتبه اول را در هر دو بنچمارک اصلی Artificial Analysis کسب کرده و رقبای قدرتمندی را پشت سر گذاشته است.

‏مهم‌ترین نکات درباره این مدل:
‏* صدرنشینی در بنچمارک‌ها: کسب بالاترین امتیاز Elo در بخش‌های Provider Voice و Controlled Voice.
‏* برتری در ارزیابی فنی: در بخش Controlled Voice که تفاوت‌های ناشی از کیفیت صدا حذف شده و تنها موتور سنتز ارزیابی می‌شود، این مدل با کنار زدن ElevenLabs Eleven v3 به جایگاه نخست رسیده است.
‏* معماری متفاوت: برخلاف مدل‌های ترنسفورمری رایج، Sonic بر پایه State Space Models توسعه یافته است.
‏* تاخیر بسیار کم: ادعای زمان تولید کمتر از 90 میلی‌ثانیه تا شنیده شدن اولین بخش از صدا (Time-to-first-audio).

‏جزئیات بیشتر را می‌توانید در بررسی تخصصی این مدل مطالعه کنید.

📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Sonic_3_6 #State_Space_Models