This media is not supported in your browser
VIEW IN TELEGRAM
🤖 معرفی مدل Lift برای استخراج ساختاریافته دادهها
مدل جدید Lift با هدف سادهسازی استخراج داده از اسناد ارائه شده است. این ابزار به جای استفاده از زنجیرهای از فرآیندهای OCR و LLM، میتواند به صورت مستقیم فایلهای PDF یا تصاویر را دریافت کرده و خروجی را بر اساس Schema تعیینشده توسط کاربر، به صورت JSON بازگرداند.
این مدل با پارامتر ۹ میلیارد عددی، عملکردی نزدیک به Gemini Flash 3.5 دارد و به دلیل سرعت ۳ برابری، برای پردازش سریع اسناد بهینه شده است. مهمترین ویژگیهای آن شامل موارد زیر است:
- نرخ دقت ۹۰.۲ درصد در استخراج ۱۱ هزار فیلد اطلاعاتی
- طراحی شده برای جلوگیری از توهم (Hallucination) و بازگرداندن مقدار null در صورت عدم وجود داده
- قابلیت میزبانی شخصی با استفاده از vLLM یا Hugging Face
- پردازش کامل صفحات سند در یک مرحله، که امکان استخراج دقیق دادههای چندصفحهای را فراهم میکند
این مدل از انواع اسناد، از فاکتورهای فروش تا مقالات تحقیقاتی پشتیبانی میکند.
#Lift_model #JSON_extraction
مدل جدید Lift با هدف سادهسازی استخراج داده از اسناد ارائه شده است. این ابزار به جای استفاده از زنجیرهای از فرآیندهای OCR و LLM، میتواند به صورت مستقیم فایلهای PDF یا تصاویر را دریافت کرده و خروجی را بر اساس Schema تعیینشده توسط کاربر، به صورت JSON بازگرداند.
این مدل با پارامتر ۹ میلیارد عددی، عملکردی نزدیک به Gemini Flash 3.5 دارد و به دلیل سرعت ۳ برابری، برای پردازش سریع اسناد بهینه شده است. مهمترین ویژگیهای آن شامل موارد زیر است:
- نرخ دقت ۹۰.۲ درصد در استخراج ۱۱ هزار فیلد اطلاعاتی
- طراحی شده برای جلوگیری از توهم (Hallucination) و بازگرداندن مقدار null در صورت عدم وجود داده
- قابلیت میزبانی شخصی با استفاده از vLLM یا Hugging Face
- پردازش کامل صفحات سند در یک مرحله، که امکان استخراج دقیق دادههای چندصفحهای را فراهم میکند
این مدل از انواع اسناد، از فاکتورهای فروش تا مقالات تحقیقاتی پشتیبانی میکند.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#Lift_model #JSON_extraction