汉字全息资源应用系统.pptxVIP

  1. 1、本文档共19页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  5. 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  6. 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  7. 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  8. 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
汉字全息资源应用系统文字学及相关专业领域专家学者的科研平台目录系统构成研制过程0201系统特点系统字集0304目录检索方式系统处理0605平台作用07基本信息汉字全息资源应用系统,是文字学及相关专业领域专家学者的科研平台,是国家语委重大基础资源建设项目“通用汉字全息数据库建设”的标志性成果。 2019年1月11日,“汉字全息资源应用系统”发布会在北京师范大学举行。发布会上,北师大资深教授王宁、项目主持人王立军教授、文学院康震教授与刘宏副司长共同启动系统上线。 研制过程研制过程团队从20世纪90年代开始总结汉字的属性,由王宁领衔的专家团队,在继承章黄学术精髓的基础上不断创新,发展出“汉字构形学”和“汉语词汇语义学”等前沿学术理论。特别是“汉字构形学”的相关理论,使纷繁复杂的文字现象变得井然有序。除形、音、义之外,还增加码、用两个部分。码是汉字在计算机中的编码,用是汉字的使用,而且做了大量的属性细化研究,这样就有条件将笼统的汉字个体的资源库,改造为汉字的属性库,解决关联的多角度问题。其次是层次的确立,根据‘汉字效用递减率’,将汉字分为常用-通用-适用-罕用-无用5个层。第一、二层次涵盖字,以外的字只存记忆,不做深度开发,这样一方面可以在应用中扩大有用信息的使用度,另一方面将垃圾信息、无用信息退出关联,不干扰有效信息的集合和调用。再次就是中介的寻求,继承传统语言学的研究成果,以《说文解字》的9353个小篆及其重文为中介来关联。古文字的确切识读,绝大部分是从《说文》开始的,这样就保证了不同形制、不同字体、不同时代汉字的最大限度关联。 ?系统构成系统构成汉字全息资源应用系统——深层结构示意图“汉字全息资源应用系统”系统结构分为深层结构和表层结构两级模式;同时包括四大模块,即单字检索、综合检索、专书检索和历代字形检索,可满足“以字查息”和“以息查字”两种不同检索需求,还提供专业化程度极高的形、音、义三重系联功能。 ?系统特点系统特点快捷、权威、形象——准确查找一个难检字的相关信息再不用跑遍古籍阅览室,翻便“大部头”,只需轻点鼠标——登录汉字全息资源应用系统,点击现代通用字集,搜索要查找的字,不仅能够显示其现代字形、字音、字义信息,还可以查到该字从甲骨文、金文到篆书、楷书的历史字形演变过程,从《说文》、《尔雅》、《方言》、《释名》一直到《康熙字典》等历代辞书对该字的释义,及其在一些常用古籍文献中被使用的情况。系统采用的多层级字集设计模式,包括常用字集、现代通用字集、古籍印刷通用字集、全字符集等。常用字集可以满足中小学基础教育领域的一般需要;现代通用字集可以满足社会文化领域一般汉字使用者的需要;古籍印刷通用字集面向具备一定古汉语知识、阅读一般古籍文献的用户;全字符集则可以满足汉字研究的专业人士需求,为专业研究提供支撑。 ?系统字集系统字集系统涵盖字符集4种,其中常用字集3500字,通用规范字8105字,古籍印刷字字,全字符集字;还有辞书20种,古籍文献60种,历代字形图个。其中包括大量的图形信息资源和文本信息资源,分别来自古文字拓片、文字编、规范字表、编码字符集、历代辞书、经典文献、中小学语文教材等,涵盖了古今各个时期文字的形、音、义、用、码五大方面的重要信息。系统的主体字集是国家语委2013年公布的《通用规范汉字表》的8105个规范汉字及其关联字形。《通用规范汉字表》属于简化字系统,分为一级字表(即常用字表,3500字)、二级字表(3000字)、三级字表(1605字)。《通用规范汉字表》作为数据库子库的B库,直接和A库(传承字、繁体字和隶定字)关联,进而与小篆等古文字(C库)关联,从而实现了古今、简繁汉字的有效贯通。 ?系统处理系统处理系统的处理方法是:选取历代具有代表性的辞书,并选择最优的版本作为搭建框架的基础素材,以此为基础建构数据之间的深度关联。选择的辞书包括从《尔雅》、《说文》、《释名》、《方言》、《广韵》、《集韵》、《康熙字典》、《汉语大字典》、《新华字典》和《通用规范汉字字典》等。在字形方面,简化字的部首采用2009年国家语委发布的《汉字部首表》,即201个主形部首和99个附形部首,非简化字采用214部首体系,来源于《康熙字典》。简化字和繁体字的笔画数属性参考《通用规范汉字字典》等。结构类型(六书)属性参考《说文解字》。字音方面,现代汉语拼音和注音字母主要参考《通用规范汉字字典》和民国时期《国语辞典》等;近代音来源于《中原音韵》;中古音来源于《广韵》。字义方面,常用义项来源于《通用规范汉字字典》,并给出历代辞书的释义内容。在每个字的“用例”一栏,系统选取具有代表性的传世文献作为古籍用例的来源,包括十三经、二十五史、二十二子等三大典籍系统,提取汉字在这些文献中的使用例句,供研究者参考使用。 ?检索方式检索方式与查字典类似,为方

文档评论(0)

智慧城市智能制造数字化 + 关注
实名认证
文档贡献者

高级系统架构设计师持证人

该用户很懒,什么也没介绍

领域认证该用户于2023年07月09日上传了高级系统架构设计师

1亿VIP精品文档

相关文档