基于.NET的中文分词系统设计与实现  被引量:7

Chinese Word Segmentation System Design and Implementation Based on. NET

在线阅读下载全文

作  者:岳晓光[1] 梁晓诚[1] 麦范金[1] 赵子强[1] 

机构地区:[1]桂林理工大学电子与计算机系,541004

出  处:《微计算机信息》2010年第12期215-216,214,共3页Control & Automation

摘  要:针对中文分词的相关理论,讨论了中文分词的难点、语料库和中文分词算法,然后在.NET下设计了一个中文分词系统。在长词优先的原则下通过SQL Server 2005自建了一个语料库。在Visual Studio 2005下,采用改进的正向减字最大匹配分词算法,使用ASP.NET和C#语言实现了这个系统。结果表明该分词系统达到了较好的分词效果。This article discussed Chinese word segmentation theory and corpus,then designed a Chinese word segmentation systems based on.NET.And SQL Server 2005 helped to build a corpus in principle of long-term priority.In Visual Studio 2005,word segmentation was implemented under improved forward maximum matching word method by using ASP.NET and C#language.Experiments show that the system can have a good segmentation results.

关 键 词:中文分词 .NET 语料库 最大匹配算法 

分 类 号:TP391[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象