{
    "metadata": {
        "dataset_id": "shahroodut-thesis",
        "record_id": "TK243",
        "title": "تشخیص برون خط کلمات دست نوشته فارسی به کمک بلوک بندی تطبیقی ",
        "publisher": "دانشگاه صنعتی شاهرود",
        "owner": "کتابخانه مرکزی دانشگاه صنعتی شاهرود",
        "license": "CC-BY-4.0",
        "license_url": "https://creativecommons.org/licenses/by/4.0/",
        "license_text": "استفاده، بازنشر، تحلیل، پردازش و بهره برداری پژوهشی، آموزشی و صنعتی با ذکر منبع دانشگاه صنعتی شاهرود مجاز است.",
        "publication_date": "1391",
        "last_update": "2026-08-25",
        "language": "fa",
        "format": "application/json",
        "contact": "thesis@shahroodut.ac.ir",
        "access": {
            "fulltext_available": "true",
            "public_access": "true"
        }
    },
    "data": {
        "thesis_id": "TK243",
        "title": "تشخیص برون خط کلمات دست نوشته فارسی به کمک بلوک بندی تطبیقی ",
        "degree": null,
        "faculty": "مهندسی برق",
        "year": 1391,
        "authors": [
            {
                "name": "محمد علیپور سراجی",
                "role": "پدیدآور اصلی"
            },
            {
                "name": "علیرضا احمدی فرد",
                "role": "استاد راهنما"
            },
            {
                "name": "امیدرضا معروضی",
                "role": "استاد مشاور"
            }
        ],
        "keywords": [
            "بازشناسی کلمات دست نوشته فارسی",
            "گرادیان محلی",
            "بلوک بندی تطبیقی",
            "جداسازی نقاط از کلمه",
            "تخمین خط کرسی"
        ],
        "abstract": "تشخیص خودکار متن یکی از زیر مجموعه های پردازش تصویر است که به طور گسترده در کتابخانه دیجیتال، خواندن آدرس پستی نامه ها، خواندن چک های بانکی، خواندن فرم ها و پرسشنامه ها استفاده می شود. بازشناسی متون دست نوشته فارسی در دو سطح کلی برون خط و بر خط انجام می پذیرد که سیستم‌های برون خط خود به دو دسته تقسیم می شود: سیستم‌های مبتنی بر جداسازی و سیستم‌های کلی نگر.\r\nدر سیستم‌های مبتنی بر جداسازی سعی می شود کلمات به زیر کلمات و حروف سازنده آن تقسیم شوند و از آنها برای شناسایی استفاده شود اما در سیستم‌های کلی‌نگر، ویژگی‌ها مستقیما از تصویر کلی کلمه استخراج می شود و با مقایسه با داده های فرهنگ لغت، مشابه ترین کلمه به ورودی به عنوان خروجی در نظر گرفته می‌شود.\r\nدر این تحقیق روشی برای بازشناسی کلمات دست‌نوشته فارسی با استفاده از شکل کلی کلمه ارائه شده است. مراحل کار برای شناسایی کلمه شامل: پیش پردازش(باینری کردن، رفع شکستگی، حذف نویز) ،استخراج ویژگی(گرادیان، پروفایل) و طبقه‌بند (SVM،KNN  ) است.\r\nدر مرحله پیش پردازش برای تخمین مکان خط کرسی، تغییراتی در روش هیستوگرام افقی انجام می‌شود. تشخیص خط کرسی به منظور جداسازی نقاط از بدنه اصلی و همچنین برای نرمال سازی اجزاء بدنه اصلی ضروری است. در نتیجه فرایند پیشنهادی، از تصویر هر کلمه دو تصویر، یکی تصویر بدنه اصلی و دیگری تصویر نقاط و علائم حاصل می‌شود. برای استخراج ویژگی‌های کلمه در تصویر بدنه اصلی، پس از نرمال سازی جداگانه اجزای آن، از بلوک‌بندی تطبیقی و برای استخراج ویژگی از تصویر نقاط و علائم از بلوک بندی یکنواخت استفاده می‌کنیم. هر بلوک در تصاویر فوق توسط اندازه گرادیان در 32 جهت توصیف می‌شود.\r\nنتایج حاصل با استفاده از طبقه بندهای k نزدیکترین همسایگی و ماشین بردار پشتیبان نشان دهنده بهبود در دقت بازشناسی روش ارائه شده است اما به علت پیش پردازش‌های صورت گرفته، روش ارائه شده به زمان بیشتری نسبت به روش‌های پیشین نیازمند است. با خوشه بندی نمونه‌ها به منظور کاهش فرهنگ لغت نتیجه بهبود میابد. به منظور خوشه‌بندی نمونه‌ها از ویژگی‌های پروفایل و هیستوگرام افقی و الگوریتم isodata استفاده شده است.",
        "repository": "کتابخانه مرکزی دانشگاه صنعتی شاهرود",
        "note": "حقوق مادی و معنوی متعلق به دانشگاه صنعتی شاهرود می باشد.",
        "download_url": "https://shahroodut.ac.ir/fa/thesis/files/somefiles/sf_TK243.pdf"
    },
    "dictionary": {
        "thesis_id": {
            "title": "شناسه پایان نامه",
            "type": "string",
            "description": "شناسه یکتای پایان نامه در سامانه کتابخانه"
        },
        "title": {
            "title": "عنوان پایان نامه",
            "type": "string",
            "description": "عنوان کامل پایان نامه"
        },
        "degree": {
            "title": "مقطع تحصیلی",
            "type": "string",
            "description": "مقطع تحصیلی پایان نامه"
        },
        "faculty": {
            "title": "دانشکده",
            "type": "string",
            "description": "دانشکده یا واحد آموزشی"
        },
        "year": {
            "title": "سال دفاع",
            "type": "integer",
            "description": "سال دفاع یا انتشار پایان نامه"
        },
        "authors": {
            "title": "پدیدآورندگان",
            "type": "array",
            "description": "فهرست نویسندگان، استاد راهنما، استاد مشاور و سایر نقش های علمی"
        },
        "keywords": {
            "title": "کلیدواژه ها",
            "type": "array",
            "description": "کلیدواژه های علمی پایان نامه"
        },
        "abstract": {
            "title": "چکیده",
            "type": "string",
            "description": "متن چکیده پایان نامه"
        },
        "repository": {
            "title": "محل نگهداری",
            "type": "string",
            "description": "محل نگهداری نسخه اصلی پایان نامه"
        },
        "note": {
            "title": "یادداشت",
            "type": "string",
            "description": "توضیحات تکمیلی یا یادداشت های ثبت شده"
        },
        "download_url": {
            "title": "آدرس فایل پایان نامه",
            "type": "string",
            "description": "نشانی فایل چکیده یا متن کامل پایان نامه"
        }
    }
}