این سایت در حال حاضر پشتیبانی نمی شود و امکان دارد داده های نشریات بروز نباشند
پردازش علائم و داده ها، جلد ۱۶، شماره ۳، صفحات ۳۶-۲۳

عنوان فارسی بررسی روش‌های مؤثر بر عملکرد تجزیه‌گر دستور مستقل از متن آماری زبان فارسی
چکیده فارسی مقاله عدم دقّت در طراحی دستورهای مستقل از متن و استفاده از ساختارهای نامناسب مانند فرم نرمال چامسکی به خودی خود می­‌تواند عملکرد تجزیه­‌گرهای آماری مستقل از متن را تضعیف کند. در این پژوهش ساختار ترکیبات عطفی درخت‌بانک فارسی را مورد بررسی قرار دادیم. نتایج حاصل از این پژوهش نشان می­‌دهد که با اضافه‌کردن وابستگی­‌های ساختاری به دستورهای مستقل از متن و اصلاح قواعد اولیه، می­توان از ترکیبات عطفی رفع ابهام کرد و صحت عملکرد تجزیه­‌گر دستور مستقل از متن آماری را افزایش داد. فرض استقلال ضعیف، یکی از مشکلات مربوط به دستورهای مستقل از متن است که سعی شده است تا با تزریق وابستگی­‌های ساختاری از طریق نشانه­‌گذاری گره‌­های والد و فرزند مرتفع شود. تأثیر ریزدانگی و درشت­‌دانگی برچسب‌­های اجزای واژگانی کلام و همین‌طور ادغام ناپایانه‌­ها بر تجزیه‌­گر دستور مستقل از متن آماری فارسی از جمله مواردِ مورد بررسی قرار گرفته‌شده در این پژوهش­ است.  
کلیدواژه‌های فارسی مقاله

عنوان انگلیسی Studying impressive parameters on the performance of Persian probabilistic context free grammar parser
چکیده انگلیسی مقاله In linguistics, a tree bank is a parsed text corpus that annotates syntactic or semantic sentence structure. The exploitation of tree bank data has been important ever since the first large-scale tree bank, The Penn Treebank, was published. However, although originating in computational linguistics, the value of tree bank is becoming more widely appreciated in linguistics research as a whole. For example, annotated tree bank data has been crucial in syntactic research to test linguistic theories of sentence structure against large quantities of naturally occurring examples. The natural language parser consists of two basic parts, POS tagger and the syntax parser. A Part-Of-Speech Tagger (POS Tagger) is a piece of software that reads text in some languages and assigns parts of speech to each word (and other token), such as noun, verb, adjective, etc., although generally computational applications use more fine-grained POS tags like 'noun-plural'. A natural language parser is a program that works out the grammatical structure of sentences, for instance, which groups of words go together (as "phrases") and which words are the subject or object of a verb. Probabilistic parsers use knowledge of language gained from hand-parsed sentences to try to produce the most likely analysis of new sentences. These statistical parsers still make some mistakes, but commonly work rather well. Inaccurate design of context-free grammars and using bad structures such as Chomsky normal form can reduce accuracy of probabilistic context-free grammar parser. Weak independence assumption is one of the problems related to CFG. We have tried to improve this problem with parent and child annotation, which copies the label of a parent node onto the labels of its children, and it can improve the performance of a PCFG. In grammar, a conjunction (conj) is a part of speech that connects words, phrases, or clauses that are called the conjuncts of the conjunctions. In this study, we examined the conjunction phrases in the Persian tree bank. The results of this study show that adding structural dependencies to grammars and modifying the basic rules can remove conjunction ambiguity and increase accuracy of probabilistic context-free grammar parser. When a part-of-speech (PoS) tagger assigns word class labels to tokens, it has to select from a set of possible labels whose size usually ranges from fifty to several hundred labels depending on the language. In this study, we have investigated the effect of fine and coarse grain POS tags and merging non-terminals on Persian PCFG parser.
کلیدواژه‌های انگلیسی مقاله

نویسندگان مقاله محمدباقر صادق زاده | mohammadbagher sadeghzadeh
amirkabir university of technology
دانشگاه صنعتی امیرکبیر

محمدرضا رزازی | mohammadreza razzazi
amirkabir university of technology
دانشگاه صنعتی امیرکبیر

مسعود قیومی | Masood ghayoomi
free university of berlin
پژوهشگاه علوم انسانی و مطالعات فرهنگی


نشانی اینترنتی http://jsdp.rcisp.ac.ir/browse.php?a_code=A-10-794-1&slc_lang=fa&sid=1
فایل مقاله اشکال در دسترسی به فایل - ./files/site1/rds_journals/1315/article-1315-2198280.pdf
کد مقاله (doi)
زبان مقاله منتشر شده fa
موضوعات مقاله منتشر شده مقالات پردازش متن
نوع مقاله منتشر شده پژوهشی
برگشت به: صفحه اول پایگاه   |   نسخه مرتبط   |   نشریه مرتبط   |   فهرست نشریات