IDPL-PFOD۲ — متن چاپی فارسی
نسخهی گسترشیافتهی پایگاه دادهی متن چاپی فارسی برای OCR.

IDPL-PFOD2 یک پایگاهداده بزرگ برای بازشناسی نوری متن چاپی فارسی (OCR) است که برای آموزش و ارزیابی مدلهای بازشناسی متن فارسی طراحی شده است. این دیتاست نسخه توسعهیافتهای از IDPL-PFOD محسوب میشود و با هدف افزایش تعداد و تنوع دادهها ساخته شده است. در ساخت این دیتاست، متنها بهشکل مصنوعی تولید و به تصویر تبدیل شدهاند. از چندین فونت مختلف استفاده شده است، برای تصاویر پسزمینههای متنوع در نظر گرفته شده و برای هر تصویر برچسب متنی صحیح هم تهیه شده است. هدف اصلی این مجموعه، فراهم کردن داده کافی و متنوع برای بهبود عملکرد مدلهای OCR فارسی است.
IDPL-PFOD2: A New Large-Scale Dataset for Printed Farsi Optical Character Recognition
F. Asadi-Zeydabadi, et al.
arXiv preprint arXiv:2312.01177 · 2023
به این دادهها علاقه دارید؟
برای همکاری پژوهشی یا دسترسی به جزئیات بیشتر با تیم بهنثر تماس بگیرید.
تماس با ما