هوش مصنوعی و علم داده به فارسی
6.06K subscribers
2.13K photos
522 videos
366 files
2.31K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 معرفی مدل Lift برای استخراج ساختاریافته داده‌ها

‏مدل جدید Lift با هدف ساده‌سازی استخراج داده از اسناد ارائه شده است. این ابزار به جای استفاده از زنجیره‌ای از فرآیندهای OCR و LLM، می‌تواند به صورت مستقیم فایل‌های PDF یا تصاویر را دریافت کرده و خروجی را بر اساس Schema تعیین‌شده توسط کاربر، به صورت JSON بازگرداند.

‏این مدل با پارامتر ۹ میلیارد عددی، عملکردی نزدیک به Gemini Flash 3.5 دارد و به دلیل سرعت ۳ برابری، برای پردازش سریع اسناد بهینه شده است. مهم‌ترین ویژگی‌های آن شامل موارد زیر است:

‏- نرخ دقت ۹۰.۲ درصد در استخراج ۱۱ هزار فیلد اطلاعاتی
‏- طراحی شده برای جلوگیری از توهم (Hallucination) و بازگرداندن مقدار null در صورت عدم وجود داده
‏- قابلیت میزبانی شخصی با استفاده از vLLM یا Hugging Face
‏- پردازش کامل صفحات سند در یک مرحله، که امکان استخراج دقیق داده‌های چندصفحه‌ای را فراهم می‌کند

‏این مدل از انواع اسناد، از فاکتورهای فروش تا مقالات تحقیقاتی پشتیبانی می‌کند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Lift_model #JSON_extraction