دیتاست برای تشخیص زبان متن
🗃 نوع: #متن
📮 اندازه: 12.39 MB
📖 توضیحات: این دیتاست شامل ۲۳۵۰۰۰ پاراگراف از ۲۳۵ زبان است که هر برای هر زبان هزار پاراگراف وجود دارد.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/zarajamshaid/language-identification-datasst
لطفا به اشتراک بگذارید👈🏻
@persian_data
🗃 نوع: #متن
📮 اندازه: 12.39 MB
📖 توضیحات: این دیتاست شامل ۲۳۵۰۰۰ پاراگراف از ۲۳۵ زبان است که هر برای هر زبان هزار پاراگراف وجود دارد.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/zarajamshaid/language-identification-datasst
لطفا به اشتراک بگذارید👈🏻
@persian_data
Kaggle
Language Identification dataset
This data is extract from WiLi-2018 wikipedia dataset
👍1
غلط های املایی
🗃 نوع: #متن
📮 اندازه: 146.42 KB
📖 توضیحات:
این مجموعه داده شامل ۵۰۵۰ جفت کلمه فارسی است که ستون اول یک کلمه غلط املایی و ستون دوم شکل صحیح آن کلمه است. از این مجموعه داده در مباحث نرمالسازی میتوان استفاده کرد.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/rtatman/faspell
لطفا به اشتراک بگذارید👈🏻
@persian_data
🗃 نوع: #متن
📮 اندازه: 146.42 KB
📖 توضیحات:
این مجموعه داده شامل ۵۰۵۰ جفت کلمه فارسی است که ستون اول یک کلمه غلط املایی و ستون دوم شکل صحیح آن کلمه است. از این مجموعه داده در مباحث نرمالسازی میتوان استفاده کرد.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/rtatman/faspell
لطفا به اشتراک بگذارید👈🏻
@persian_data
Kaggle
FAspell
Naturally-occurring Persian (Farsi) spelling mistakes
نظرات کاربران سایت طاقچه 2019
🗃 نوع: #متن
📮 اندازه: 21.03 MB
📖 توضیحات:
تعداد ۱۱ هزار نظر از سایت طاقچه به همراه امتیاز مربوط به هر نظر که مناسب برای انجام پروژههای تحلیل احساسات است.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/saeedtqp/taaghche
لطفا به اشتراک بگذارید👈🏻
@persian_data
🗃 نوع: #متن
📮 اندازه: 21.03 MB
📖 توضیحات:
تعداد ۱۱ هزار نظر از سایت طاقچه به همراه امتیاز مربوط به هر نظر که مناسب برای انجام پروژههای تحلیل احساسات است.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/saeedtqp/taaghche
لطفا به اشتراک بگذارید👈🏻
@persian_data
Kaggle
Taaghche | طاقچه
Persian book comment ratings dataset
fastText pre-trained persian word vectors
🗃 نوع: #متن
📮 اندازه: 4.22 GB
📖 توضیحات:
مدلهای زبانی آموزش دیده شده فارسی
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/javadhelali/fasttext-pretrained-persian-word-vectors
لطفا به اشتراک بگذارید👈🏻
@persian_data
🗃 نوع: #متن
📮 اندازه: 4.22 GB
📖 توضیحات:
مدلهای زبانی آموزش دیده شده فارسی
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/javadhelali/fasttext-pretrained-persian-word-vectors
لطفا به اشتراک بگذارید👈🏻
@persian_data
Kaggle
fastText pre-trained persian word vectors
Kaggle is the world’s largest data science community with powerful tools and resources to help you achieve your data science goals.
Persian sentiment analysis dataset
🗃 نوع: #متن
📮 اندازه: 11.14 MB
📖 توضیحات:
این مجموعه داده مربوط به نظرات اینسناگرام همراه با برچسب است.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/instatext/persian-sentiment-analysis-dataset
لطفا به اشتراک بگذارید👈🏻
@persian_data
🗃 نوع: #متن
📮 اندازه: 11.14 MB
📖 توضیحات:
این مجموعه داده مربوط به نظرات اینسناگرام همراه با برچسب است.
📤 برای دریافت داده و کسب اطلاعات بیشتر به لینک زیر مراجعه کنید. 👇👇
https://www.kaggle.com/instatext/persian-sentiment-analysis-dataset
لطفا به اشتراک بگذارید👈🏻
@persian_data
Kaggle
Persian sentiment analysis dataset
Discover what actually works in AI. Join millions of builders, researchers, and labs evaluating agents, models, and frontier technology through crowdsourced benchmarks, competitions, and hackathons.
👍1