译学撷英 | 李佐文 梁国杰:语篇连贯的可计算性
翻译技术教育与研究 2022-10-05 00:00 发表于北京
以下文章来源于应用语言学研习 ,作者李佐文 梁国杰
论语篇连贯的可计算性
李佐文 梁国杰
摘要:
连贯性 是语篇所具有的一种可分析的语义属性, 是自然语篇理解和生成过程中的核心问题。语篇连贯的可计算性可以被理解为使计算机能够以语言的表层形式特征为依据对自然语篇中的连贯关系进行识别和处理。语篇连贯计算对人机互动、自动文摘以及作文评分系统的开发具有很高的应用价值。本文从汉语语篇连贯关系分类体系的建立、局部连贯关系的判定、整体连贯关系的识别、语篇语义结构的形式化表征、语篇连贯程度的自动评估等方面对语篇连贯计算的研究路径进行了探索和展望。 关键词:语篇连贯; 可计算性; 自然语言处理 作者简介: 李佐文, 博士, 教授,博士生导师。研究方向:话语语言学, 计算语言学, 语言教学; 梁国杰, 博士, 副教授,硕士生导师。研究方向:应用语言学, 区域国别学, 跨文化传播学。 收稿日期: 2017-03-20来源:《外语研究》2018年第2期引用格式:[1] 李佐文, 梁国杰. 论语篇连贯的可计算性[J]. 外语研究, 2018, 35(02): 27-32.DOI: 10.13978/j.cnki.wyyj.2018.02.006. 引言 目前, 字、词、词组和句子层面的自然语言处理已经取得了较大进展, 然而篇章话语层面的语言计算研究却举步维艰、发展缓慢, 成为制约自然语言处理水平的一个瓶颈。造成这种现状的原因是多方面的, 但 最主要的原因 有两个: 一是作为语言交际单位的篇章话语自身的复杂性远远超过词汇和语法单位, 相关的基础理论研究相对较为薄弱; 二是国内应用语言学界对篇章话语层面的自然语言处理重视程度不够, 大规模的汉语篇章标注语料库尚付阙如, 研究力量也较为分散。自然语言处理的进一步发展对篇章话语的计算机处理提出了要求, 而且无论从理论层面还是实践层面来看,
登录后可查看完整内容,参与讨论!
立即登录