{
    "metadata": {
        "dataset_id": "shahroodut-thesis",
        "record_id": "Q66",
        "title": "فشرده سازی متن با استفاده از تکنیک های هوش مصنوعی ",
        "publisher": "دانشگاه صنعتی شاهرود",
        "owner": "کتابخانه مرکزی دانشگاه صنعتی شاهرود",
        "license": "CC-BY-4.0",
        "license_url": "https://creativecommons.org/licenses/by/4.0/",
        "license_text": "استفاده، بازنشر، تحلیل، پردازش و بهره برداری پژوهشی، آموزشی و صنعتی با ذکر منبع دانشگاه صنعتی شاهرود مجاز است.",
        "publication_date": "1394",
        "last_update": "2026-08-25",
        "language": "fa",
        "format": "application/json",
        "contact": "thesis@shahroodut.ac.ir",
        "access": {
            "fulltext_available": "true",
            "public_access": "true"
        }
    },
    "data": {
        "thesis_id": "Q66",
        "title": "فشرده سازی متن با استفاده از تکنیک های هوش مصنوعی ",
        "degree": null,
        "faculty": "مهندسی کامپیوتر ",
        "year": 1394,
        "authors": [
            {
                "name": "محبوبه سلیمانیان",
                "role": "پدیدآور اصلی"
            },
            {
                "name": "Ali Pouyan",
                "role": "استاد راهنما"
            },
            {
                "name": "هدی مشایخی",
                "role": "استاد مشاور"
            }
        ],
        "keywords": [
            "فشرده سازی",
            "کدینگ اطلاعات",
            "متون فارسی",
            "مدل زبانی"
        ],
        "abstract": "رشد روز افزون اطلاعات دیجیتالی در سال های اخیر، موجب افزایش توجهات به فشرده سازی متون شده است. اطلاعاتی از نوع متن که همه روزه شاهد ارسال و دریافت آن هستیم. نیاز به کاهش میزان داده ها و صرفه جویی در فضای ذخیره سازی، فشرده سازی را به امری مهم تبدیل نموده است. با افزایش روز افزون متون غیرانگلیسی و غیرلاتین، نیاز به رشد الگوریتم های فشرده سازی در زبان های دیگر نیز احساس می شود. این پایان نامه تلاشی در راستای ارائه تکنیکی جهت فشرده سازی متون فارسی است. \r\nدر این پژوهش هدف استفاده از قواعد و تکنیک های مدلسازی زبان می باشد. قواعدی که در الگوریتم های فشرده سازی معروف و پرکاربردی مانند زیپ مورد توجه قرار نگرفته است. در این تکنیک ما با استفاده از مدل آماری N-gram، احتمال قرار گرفتن دنباله ای از کلمات و کاراکترهای زبان را، بعد از دیگری با در نظر گرفتن پارامترهای تعداد تکرار و طول عبارت بررسی می کنیم. جهت ارزیابی و انتخاب مدلی با میزان کارایی بیشتر از معیار سرگشتگی که مستقل از سیستم و متناسب با احتمال های نسبت داده شده به عبارات (دنباله ای از کلمات و کاراکترها) می باشد، استفاده شده است. نتایج بدست آمده میزان فشرده سازی 82% متن ورودی را با استفاده از الگوریتم پیشنهادی و در نظر گرفتن اطلاعات زبانی، در فایل فشرده بدست آمده از الگوریتم فشرده سازی زیپ نشان می دهد. در فصل های آتی مراحل مختلف تحلیل بر اساس مدل زبانی، مراحل ارزیابی و نتایج بدست آمده تشریح خواهد شد.",
        "repository": "کتابخانه مرکزی دانشگاه صنعتی شاهرود",
        "note": "حقوق مادی و معنوی متعلق به دانشگاه صنعتی شاهرود می باشد.",
        "download_url": "https://shahroodut.ac.ir/fa/thesis/files/somefiles/sf_Q66.pdf"
    },
    "dictionary": {
        "thesis_id": {
            "title": "شناسه پایان نامه",
            "type": "string",
            "description": "شناسه یکتای پایان نامه در سامانه کتابخانه"
        },
        "title": {
            "title": "عنوان پایان نامه",
            "type": "string",
            "description": "عنوان کامل پایان نامه"
        },
        "degree": {
            "title": "مقطع تحصیلی",
            "type": "string",
            "description": "مقطع تحصیلی پایان نامه"
        },
        "faculty": {
            "title": "دانشکده",
            "type": "string",
            "description": "دانشکده یا واحد آموزشی"
        },
        "year": {
            "title": "سال دفاع",
            "type": "integer",
            "description": "سال دفاع یا انتشار پایان نامه"
        },
        "authors": {
            "title": "پدیدآورندگان",
            "type": "array",
            "description": "فهرست نویسندگان، استاد راهنما، استاد مشاور و سایر نقش های علمی"
        },
        "keywords": {
            "title": "کلیدواژه ها",
            "type": "array",
            "description": "کلیدواژه های علمی پایان نامه"
        },
        "abstract": {
            "title": "چکیده",
            "type": "string",
            "description": "متن چکیده پایان نامه"
        },
        "repository": {
            "title": "محل نگهداری",
            "type": "string",
            "description": "محل نگهداری نسخه اصلی پایان نامه"
        },
        "note": {
            "title": "یادداشت",
            "type": "string",
            "description": "توضیحات تکمیلی یا یادداشت های ثبت شده"
        },
        "download_url": {
            "title": "آدرس فایل پایان نامه",
            "type": "string",
            "description": "نشانی فایل چکیده یا متن کامل پایان نامه"
        }
    }
}