<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE ArticleSet PUBLIC "-//NLM//DTD PubMed 2.7//EN" "https://dtd.nlm.nih.gov/ncbi/pubmed/in/PubMed.dtd">
<ArticleSet>
<Article>
<Journal>
				<PublisherName>پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)</PublisherName>
				<JournalTitle>پژوهشنامه پردازش و مدیریت اطلاعات</JournalTitle>
				<Issn>2251-8223</Issn>
				<Volume>37</Volume>
				<Issue>4</Issue>
				<PubDate PubStatus="epublish">
					<Year>2022</Year>
					<Month>06</Month>
					<Day>22</Day>
				</PubDate>
			</Journal>
<ArticleTitle>A Persian Citation Parsing Method Using Support Vector Machine</ArticleTitle>
<VernacularTitle>تجزیه متون استنادی در زبان فارسی با استفاده از ماشین بردار پشتیبان</VernacularTitle>
			<FirstPage>1268</FirstPage>
			<LastPage>1245</LastPage>
			<ELocationID EIdType="pii">699700</ELocationID>
			
<ELocationID EIdType="doi">10.35050/JIPM010.2022.009</ELocationID>
			
			<Language>FA</Language>
<AuthorList>
<Author>
					<FirstName>نصراله</FirstName>
					<LastName>پاک‌نیت</LastName>
<Affiliation>پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)، تهران؛ ایران.</Affiliation>

</Author>
<Author>
					<FirstName>جلال‌الدین</FirstName>
					<LastName>نصیری</LastName>
<Affiliation>دانشکده علوم ریاضی، دانشگاه فردوسی مشهد، مشهد؛ ایران.</Affiliation>

</Author>
</AuthorList>
				<PublicationType>Journal Article</PublicationType>
			<History>
				<PubDate PubStatus="received">
					<Year>2022</Year>
					<Month>12</Month>
					<Day>10</Day>
				</PubDate>
			</History>
		<Abstract>Human users can easily divide a bibliographic reference to its constructing fields such as authors, title, journal, year, etc. However, due to the variations in formats and errors made by the authors in citing documents, it is difficult to automate this task. There exist many solutions for this problem, known as citation parsing problem in the literature, however, none of them is compatible with Persian language. This is mainly due to high language-sensitivity of these solutions. Considering the important role of citation parsing in tasks such as autonomous citation indexing and information retrieval, in this paper, we propose an intelligent method for citation parsing in Persian language. The proposed method uses the support vector machine (SVM) classification method as its core. The results of testing the proposed method using a dataset designed for this task show 95% in average for precision, recall and F1 measures for extracting different fields from a bibliographic reference which is quite plausible.</Abstract>
			<OtherAbstract Language="FA">یک متن استنادی را می‌توان به‌عنوان مجموعه‌ای از مؤلفه‌ها مانند نام نویسندگان، عنوان، محل نشر، سال نشر، شماره صفحات و ... در نظر گرفت. در حالی که تجزیه متون استنادی موجود در انتهای یک مدرک علمی توسط کاربر انسانی به‌راحتی انجام‌پذیر است، تنوع موجود در شیوه‌های استناددهی در کنار اشتباهات رخ‌داده توسط نویسندگان در نگارش این متون، خودکارسازی انجام این عملیات را دشوار نموده است. روش‌های زیادی برای خودکارسازی تجزیه متون استنادی ارائه شده، اما این روش‌ها وابسته به زبان بوده و امکان به‌کارگیری یک روش ارائه‌ شده برای یک زبان در زبانی دیگر منجر به نتایجی اشتباه می‌شود. تحقیقات صورت‌گرفته بیانگر آن است که تاکنون هیچ روشی برای خودکارسازی تجزیه متون استنادی در زبان فارسی ارائه نشده است. با توجه به این مهم و نقش گسترده این مسئله در ساخت خودکار شبکه‌های استنادی مدارک علمی و فرایندهای بازیابی اطلاعات، در این مقاله به این مسئله پرداخته شده و با استفاده از روش یادگیری ماشین بُردار پشتیبان به‌عنوان یک دسته‌بند چنددسته‌ای، یک روش هوشمند برای مسئله تجزیه متون استنادی در زبان فارسی ارائه شده است. با توجه به اهمیت انتخاب ویژگی‌های مناسب برای استفاده در دسته‌بند ماشین بُردار پشتیبان، در این پژوهش این مهم با توجه به ویژگی‌های استفاده‌شده در زبان انگلیسی و ویژگی‌های زبان فارسی و ارجاع‌دهی در این زبان انجام شده است. نتایج پیاده‌سازی و آزمایش روش پیشنهادی با استفاده از مجموعه داده‌ای ایجادشده در این پژوهش نشانگر مقدار 95/0 برای پارامترهای دقت، فراخوانی و اف-1 است.</OtherAbstract>
		<ObjectList>
			<Object Type="keyword">
			<Param Name="value">تجزیه متون استنادی</Param>
			</Object>
			<Object Type="keyword">
			<Param Name="value">دسته‌بندی</Param>
			</Object>
			<Object Type="keyword">
			<Param Name="value">دسته‌بندی چند دسته‌ای</Param>
			</Object>
			<Object Type="keyword">
			<Param Name="value">ماشین بردار پشتیبان</Param>
			</Object>
			<Object Type="keyword">
			<Param Name="value">ساخت خودکار شبکه‌های استنادی</Param>
			</Object>
		</ObjectList>
<ArchiveCopySource DocType="pdf">https://jipm.irandoc.ac.ir/article_699700_9fd631cb97c4bd23974d1b0208a49b8b.pdf</ArchiveCopySource>
</Article>
</ArticleSet>
