当前位置:文档之家› 语料库论文语料库语言学论文

语料库论文语料库语言学论文

语料库论文语料库语言学论文
语料库论文语料库语言学论文

语料库论文语料库语言学论文

摘要:语言是我们生活的载体,是我们生活不可缺少的一部分,没有语言我们就不能称之为人类。我们的生活离不开语言;没有语言,我们就无法生存。由于语言对我们有着如此的重要性,因此,从某种程度上说,在人类漫长的历史过程中,人类一直以不同的方式对语言进行着研究。语料库语言学是“基于现实生活中语言运用的实例进行的语言研究”(t. mcenery& a.wilson,1996)。它是以真实的语言数据为基础,利用计算机对其进行统计、分类、标注、分析。本文采用定性的方式,整理前人的研究,分析语料库语言学在二语习得中的作用及发展。指出语料库强调词汇和语法的同一性,并认为意义是研究语言的关键所在。

关键词:语料库;二语习得;语言系统

一、引言

从语料库语言学针对语言研究的特点来看。一种人们似乎广泛接受的观点是,如果不提及两个颇具影响的语言学学派——结构主义和转换-生成语法,要谈论语料库语言学对语言研究的贡献是不可思议的、不可想象的。

正如我们大多数人所知,对语言的真正研究是20世纪初现代语言学之父,ferdinand de saussure,从事的比较系统的语言研究出现时才开始的。一些对语言感兴趣的人对

saussure将语言视为一个相互限定的存在体系系统的概念

感到十分惊讶并从中受到启发,这种语言概念与语言历来被看作的形式大相径庭。于是,这些人开始用结构的方式从事语言研究。这一充满生机的运动最初始于欧洲大陆,后来波及到美洲大陆,没过多久就遍及世界各地。毫不夸张地说,saussure关于语言的富有洞察力的观点构成了许多当代结

构语言学的基础,他的结构主义思想渗透到了每一个语言学学派。在saussure的指导下,人们研制了一系列的程序来

强调对话语的实质性特点在不参照语言抽象的底层结构或

其意义的情况下进行切分和分类的过程(bullock & stephen, 1999)。诚然,结构主义者不考虑意义来研究语言的纯科学

方法显示了其空前的优势,因为这种方法是首次根据系统和结构来描述语言特点的。然而,与传统语法一样,这种方法的交点仍然集中在语言的语法结构上,即集中在语言的表层结构上。因此,它遭到了由noam chomsky开创的转换-生成语法(transformational-generative grammar-tg)的严厉批评。对于转换-生成语法的语言学家来说,结构主义对被chomsky称之为表层结构的强调不能揭示抽象的底层结构,

即按chomsky的说法——深层结构,也不能揭示可以生成人类语言的普遍机制。同样,转换-生成语法由于它频繁将杜

撰的、非真实的资料用作证据来支持其理论也遭受到来自其

他语言学家的强烈抨击。

这里存在一个如何评价科学研究的贡献问题。根据gadamer的观点,从某种意义上说,一项科学研究能否给世界带来世界试图认识的新领域有时并不重要。重要的是,这项科学研究能否用一种科学的方法而非传统的方法带来一些革新(gadamer, 1998)。这一点适合于在研究结构主义语言学学派和转换-生成语言学学派中的所有情况。虽然这两个学派并未一劳永逸地提供了一幅关于我们语言的清晰图画,但是它们试图用不同的观点来从事语言研究的意图在语言学领域为后来者提供了温床。在没有分别认识到这两个语言学学派不足的情况下,用结构主义观点对语言的研究和用转换-生成语法的观点对语言的研究都不能登上舞台。对于当前的语言研究来说,在这一点上,结构主义和转换-生成语法都不应该被低估。

结构主义和转换-生成语法都主要因为强调对语言结构的分析、忽略对意义应有的关注而遭到强烈的抨击。这意味着,它们关注的是语言的用法而非语言的使用。语言用法和语言使用之间的区别与de saussure 关于“语言”和“言语”之间的区别、与chomsky关于“语言能力”和“语言运用”之间的区别相关联的。语言用法是语言运用的一个方面,这一方面为了显现语言使用者证明其对语言规则知识的

程度。语言使用是语言运用的另一个方面,这一方面为了显现语言使用者以有效交际为目的而证明其运用语言规则知

识的能力的程度。换言之,语言用法是将词和句作为语言系统的表现形式来引用。语言使用是语言系统为了交际目的而被认识的方式。懂一种语言意味着有了这种语言正确用法的知识,而这种知识本身并无多少实用性,它必须由能得体使用这种语言的知识来补充。一种知识的使用必须包括这一种知识的用法,但反过来情况未必如此:即某个人也许记住了大量的句型和词汇,但他却不知道如何运用这些句型和词汇来进行交际。因此,语言研究的焦点应该集中在语言使用上,而不应该集中在语言用法上。

语料库语言学自从它诞生以来,在满足这一需要方面一直显示出其独一无二的能力。通过使用语料库来研究语言为语言学家提供了一种对语言进行研究的新观点。语言学家现在可以用语料库语言学开始调查在自然出现的语篇中使用

的实际语言,而不是观察在理论上可能出现在一种语言里的现象。由于语料库语言学在语言研究中独特的功能,其研究成果已被广泛运用到各个领域中:词典学、语言教学、机器翻译、自然语言处理等。

二、语料库语言学在二语习得中的主要内容

众所周知,语料库语言学的独特之处在于它对词语学的

研究。它强调词汇和语法的同一性。正如sinclair所说:“grammar is needed because you cannot say everything at the same time.”话语意义主要是由词汇实现的,语法则起着一种辅助作用。以往的词汇被视为语法的附属品,把词汇和语法截然分开。认为语法是语言的主体,词汇是填充语法结构的材料,是通过语法来表达话语的意义的。语料库语言学强调词语学的重要。它认为:“词汇和语法在表达意义时交织一起,属同一事物,必须整合描述。”英国伯明翰大学语料库语言学家wolfgang teubert教授认为:词项可能包含两个或更多的词,有时甚至是整个句子,比如某些习语。词项不是任意的组合。我们所说的话语在很大程度上并不是无限的语言创造的结果,而更多的是由约定俗成的、现成的短语来组成的。即便是频繁再现的短语我们仅凭直觉也不能把他们认作可能的意义单位,只是对大量真实的语言数据作统计分析之后才能找出词与词的显著共现。才能发现这些共现并不是词的任意组合而是以前不为人知的意义单位,只是到目前为止仍没有被列入任何字典。由此可见,词项在语言中的重要性。同时,语料库语言学也强调意义的重要性,认为意义是研究语言的关键所在。它主张意义存在于语境之中,是语言形式在语境中的具体应用;没有语言所赖以依存的社会场景,也就没有意义可言。也就是说,语料库语言学

语料库术语中英对照

Aboutness 所言之事 Absolute frequency 绝对频数 Alignment (of parallel texts) (平行或对应)语料的对齐 Alphanumeric 字母数字类的 Annotate 标注(动词) Annotation 标注(名词) Annotation scheme 标注方案 ANSI/American National Standards Institute 美国国家标准学会 ASCII/American Standard Code for Information Exchange 美国信息交换标准码Associate (of keywords) (主题词的)联想词 AWL/Academic word list 学术词表 Balanced corpus 平衡语料库 Base list 底表、基础词表 Bigram 二元组、二元序列、二元结构 Bi-hapax 两次词 Bilingual corpus 双语语料库 CA/Contrastive Analysis 对比分析 Case-sensitive 大小写敏感、区分大小写 Chi-square (χ2) test 卡方检验 Chunk 词块 CIA/Contrastive Interlanguage Analysis 中介语对比分析 CLAWS/Constituent Likelihood Automatic Word-tagging System CLAWS词性赋码系统Clean text policy 干净文本原则 Cluster 词簇、词丛 Colligation 类联接、类连接、类联结 Collocate n./v. 搭配词;搭配 Collocability 搭配强度、搭配力 Collocation 搭配、词语搭配 Collocational strength 搭配强度 Collocational framework/frame 搭配框架 Comparable corpora 类比语料库、可比语料库 ConcGram 同现词列、框合结构 Concordance (line) 索引(行) Concordance plot (索引)词图 Concordancer 索引工具 Concordancing 索引生成、索引分析 Context 语境、上下文 Context word 语境词 Contingency table 连列表、联列表、列连表、列联表 Co-occurrence/Co-occurring 共现 Corpora 语料库(复数) Corpus Linguistics 语料库语言学 Corpus 语料库 Corpus-based 基于语料库的

语料库语言学综述

语料库语言学综述 作者:刘美良 作者单位:柳州铁道职业技术学院,广西,柳州,545001 刊名: 科技信息 英文刊名:SCIENCE & TECHNOLOGY INFORMATION 年,卷(期):2010,""(21) 被引用次数:0次 参考文献(19条) 1.Chomsky,N Syntactic Structure 1957 2.Sinclair.John Corpus.Concordance Collocation 3.Susan Hunstom Corpora in Applied Linguistics 2006 4.Aijmer,K.Altenberg,B English Corpus Linguistics:Studies in Honour of Jan Svartvik 1991 5.杨惠中语料库语言学导论 2002 6.何安平语料库在外语教育中的应用--理论与实践 2004 7.何安平谈语料岸研究 1997(5) 8.丁信善语料库语言学的发展及研究现状 1998(1) 9.李文中2003上海语科库语言学国际会议述评 2004(1) 10.粱旭红语料库语言学研究综述 2001(1) 11.粱燕近十年我国语料库实证研究综述 2004(6) 12.刘满堂近40年英语语料库及语料库语言学研究的回顾与出展望 2004(1) 13.潘永本梁语料库语言学的目的和方法 2001(3) 14.王建新语料库语言学发展史上的几个重要阶段 1998(4) 15.许家金语料库语言学的理论解析 2003(6) 16.卫乃兴专业性搭配初探--语料库语言学方法 2001(4) 17.卫乃兴语料库语言学的弗斯学说基础 2008(3) 18.甄风超.张霞语料库语言学发展趋势瞻望--2003语料库语言学国际会议综述 2004(4) 19.吴菲国内外英语语料库的建设和发展述评 2007(6) 相似文献(4条) 1.期刊论文王虹.岳俊发.Wang Hong.Yue Jun Fa书面言语鉴定技术的发展历程-中国公共安全(学术版)2005,""(3) 书面言语鉴定技术产生于20世纪80年代中期.随着电子打印技术的普及,涉案的不留笔迹的打印文件显著增加,书面言语鉴定技术倍受关注.近年来,运用统计语言学、语料库语言学和计算机词频检索与统计等新技术获得了新的研究成果并应用于鉴定实践.书面言语鉴定技术已经发展成为文件检验学的一个新的分支,必将在司法鉴定领域发挥更大的功效. 2.期刊论文孙丰果话语分析整合研究-聊城大学学报(社会科学版)2010,""(2) 近60年来.话语分析经历了从无到有,从小到大的发展历程.话语分析要取得长足发展,需要有一个明确的概念,需要人们对其以前的发展情况进行总结和评述.对话语分析研究的评述不妨从系统功能语言学、认知语言学、语料库语言学等多角度进行.今后,话语分析研究可以从话语分析的哲学转向、心理学转向及整合批评话语分析和积极话语分析等方面展开. 3.期刊论文杨连瑞.Yang Lianrui第二语言习得研究的学科定位和进展-外语与外语教学2005,""(5) 第二语言习得是一种复杂的人文现象.作为一门新兴的交叉学科,第二语言习得研究在发展中应重视其学科性质的科学定位和学科体系的科学建构.本文在对第二语言习得研究的学科定位、学科性质和研究对象进行讨论后,回顾和评述了国外第二语言习得研究从对比分析、错误分析、中介语理论、普遍语法研究、语言类型学研究到语料库语言学研究的发展历程和研究问题,分析了目前我国开展这一学科研究的现状,并结合我国外语教学实际对目前开展这一学科的研究提出建设性意见. 4.学位论文魏琳中国英译旅游宣传材料的语料库分析2006 旅游业在全球范围内的迅猛发展使不同文化背景的人们进行文化交流变成了一种需要。在我国,旅游英语特别是网上的旅游英译材料是外国游客接触和了解我国的媒介。因此,旅游材料的翻译质量举足轻重。而目前旅游文本的翻译研究在中国还是一个比较新的话题,近年来主要是结合最新语言学

语料库话语分析综述

近十年国内基于语料库的话语研究综述 A Review of Ten - year Research on Corpus-Based Discourse Analysis in China 摘要:文章从基于语料库的话语研究领域出发,通过对2002年至2011年发表在国内八种核心期刊上的论文进行统计与分析,发现这些研究在研究领域取得了很大的进步,涉及到话语各个方向,对于实践有重大指导作用,但同时也出现一些问题值得我们关注。 Abstract: From corpus-based discourse analysis, this thesis finds this field has made great progress, relates to many directions of discourse and has a significant guiding role for the practice, but also brings many problems worthy our attention. All of these are derived from the research and analysis of thesises published in 8 kinds of core journals from 2002 to 2011 in China. 关键词: 语料库话语基于语料库的话语研究 0. 引言 现代语料库语言学是20世纪中后期兴起的一门语言研究科学。语料库是指按一定的语言学原则,运用随即抽样的方法,收集自然出现的连续的语言运用文本或话语片段而建成的具有一定容量的大型电子文库。在20 世纪后半叶的西方语言学界, Chomsky的观点大行其道,秉承该学说的语言研究者唯直觉语料独尊。他们躲在书斋,满足于依靠自己的直觉语料从事语言研究。随着社会语言学、话语分析、语用学、语料库语言学的兴起,越来越多的语言学家认识到光靠直觉语料来研究语言是远远不够的,人们还必须借助语料库语料以及其他各种语料,只有这样我们才能更好地揭示语言的本质,克服直觉语料的局限与不足。这样基于语料库的话语研究越发引起大家的重视,并取得了丰硕的成果。国内基于语料库的话语研究虽然起步较晚,但是成果仍然颇丰。 1. 研究样本 由于近几年运用语料库来做话语研究已经成为语言研究的热点,笔者通过检索主题与关键词,将文献定在2002年至2011年这十年期间,研究样本来源为发表在八种外语类核心期刊的22篇文章。这是因为这8种外语类期刊有一定的权

机器翻译研究综述

机器翻译综述 1.引言 1.1机器翻译的历史 现代机器翻译的研究应该是从20世纪50年代开始,但是早在这以前很多人已经提出了相应的想法,甚至是远在古希腊时期就有人提出要用机器来进行语言翻译的想法。 在1946年,美国宾夕法尼亚大学的两位科学家设计并制造了世界上第一台电子计算机。与此同时,英国工程师同美国洛克菲勒基金会副总裁韦弗在讨论计算机的应用范围时,就提出了利用计算机实现语言的自动翻译的想法。在1949年,韦弗发表了一份名为《翻译》的备忘录,正式提出了机器翻译问题。他提出了两个主要观点: 第一,他认为翻译类似于解读密码的过程。 第二,他认为原文与译文“说的是同样的事情”,因此,当把语言A翻译为语言B时,就意味着从语言A出发,经过某一“通用语言”或“中 间语言”,可以假定是全人类共同的。 在这一段时间由于学者的热心倡导,实业界的大力支持,美国的机器翻译研究一时兴盛起来。 1964年,美国科学院成立语言自动处理咨询委员会,调查机器翻译的研究情况,给出了“在目前给机器翻译以大力支持还没有多少理由”的结论,随后机器翻译的研究就陷入了低潮期。直到70年代以后机器翻译的研究才重新进入了一个复苏期,随后机器翻译的发展又迎来了繁荣期 1.2机器翻译的主要内容 经过50多年的发展,在机器翻译领域中出现了很多的研究方法,总结如下:●直接翻译方法 ●句法转换方法 ●中间语言方法 ●基于规则的方法 ●基于语料库的方法 基于实例的方法(含模板、翻译记忆方法) 基于统计的方法 在当前的研究中,更多的是基于统计的方法进行的,因为基于统计的方法可以充分的利用计算机的计算能力,并且并不需要过多的语言学知识作为支撑,可以让更多的计算机科学家投入到实用系统的研究中,极大的促进了统计机器翻译的发展。 下面对各个方法逐一的进行介绍。

一体化课题

二、课题研究设计与论证报告
(一)课题的核心概念及其界定
1、某中等专业学校 某中等专业学校是一所中等职业学校,我校于 2008 年获得江苏省三星级中等职业中学资
格,是一所省重点职业学校。作为中职教育的一个重要部分,我校主要为社会输出初、中级 技术人员及技术工人,在整个教育体系中处于十分重要的位置。
2、《基础会计》理论与实践的一体化模块教学 《基础会计》是我校会计专业学生的一门专业基础课程,理论与实践一体化模块教学是根 据职业教育的培养目标,将会计基础理论教学与实训教学融为一体;把“教、学、做、训、考” 有机结合,调整教学方式,整合教学资源,着重培养我校学生的会计实践能力和职业适应能力, 充分调动和激发学生学习兴趣的教学模式。
(二)国内外同一研究领域现状与研究的价值
国外:英国的会计教育以“注重学生的素质和能力的培养”而闻名,老师讲解 30%的教材 内容,授课内容主要是新理论、新观点、专题框架结构等,并列出参考书,以备学生课后阅读。 美国:将终身学习的教育观念作为会计教育改革的基本指导思想,通过案例教学增加教学实习 的比重。加拿大的实地训练课程开设,以此培养学生的实践能力,让学生提供各种展示自身的 能力的机会。德国的会计专业教育非常重视实践能力。由此可见,国外的会计职业教育在内容 与方式上都有理论与实践相融合的方式。
国内:在现实情况下,有不少学校的会计实践教学仅仅流于形式,方法单一,造成了会计 理论与实践严重脱节,从而影响了实践教学的质量,基础会计的教学设置重理论轻实践,在这 种现状下,目前中职的理论和实践的一体化教学也在实行中,这种教学模式势在必行。
通过我们的努力,我们期望《基础会计》的理论和实践的一体化教学在本校能够打破传统 教学模式,在传授会计基础知识的同时,强化我校学生的会计职业技能,实行理论与实践一体化 教学,提高我校会计专业教学的质量,符合当今社会对会计人才的需要,这种教学模式值得实施 和推广。
(三)研究的目标、内容(或子课题设计)与重点

成人教育机电一体化专业专科毕业论文

机电一体化专业专科毕业论文 电动机技术发展、工作原理及维护 :新庆 时间:2010年5月5日

引言 近几十年来,随着电力电子技术、微电子技术及现代控制理论的发展,中、小功率电动机在工农业生产及人们的日常生活中都有极其广泛的的应用。特别是乡镇企业及家用电器的迅速,更需要大量的中小功率电动机。由于这种电动机的发展及广泛的应用,它的使用、保养和维护工作也越来越重要。本文主要介绍了电动机技术发展及现状、工作原理、电动机的运行维护。 关键词:技术现状工作原理运行维护

第一章电动机技术发展及现状 电机是利用电磁感应原理工作的机械。随着生产的发展而发展的,反过来,电机的发展又促进了社会生产力的不断提高。从19世纪末期起,电动机就逐渐代替蒸汽机作为拖动生产机械的原动机,一个多世纪以来,虽然电机的基本结构变化不大,但是电机的类型增加了许多,在运行性能,经济指标等方面也都有了很大的改进和提高,而且随着自动控制系统和计算机技术的发展,在一般旋转电机的理论基础上又发展出许多种类的控制电机,控制电机具有高可靠性﹑好精确度﹑快速响应的特点,已成为电机学科的一个独立分支。 它应用广泛,种类繁多。性能各异,分类方法也很多。电动机的功能是将电能转换成机械能,它可以作为拖动各种生产机械的动力,是国民经济各部门应用最多的动力机械,也是最主要的用电设备,各种电动机消耗的电能占全国总发电量的60%-70%。另一种分类方法是按照电机的结构或转速分类,可分为变压器和旋转电机.根据电源电流的不同旋转电机又分为直流电机和交流电机两大类.交流电机又分为同步电机和异步电机。 在现代化工业生产过程中,为了实现各种生产工艺过程,需要各种各样的生产机械。拖动各种生产机械运转,可以采用气动,液压传动和电力拖动。由于电力拖动具有控制简单﹑调节性能好﹑耗损小﹑经济,能实现远距离控制和自动控制等一系列优点,因此大多数生产机械都采用电力拖动。 按照电动机的种类不同,电力拖动系统分为直流电力拖动

语料库语言学术语汇编Aglossaryofcorpuslinguistics.docx

语料库语言学术语汇编 ( V2.0 ) Last updated 2012-10-08 by许家金 Aboutness所言之事 Absolute frequency绝对频数 Alignment (of parallel texts)(平行或对应)语料的对齐Alphanumeric字母数字构成的 Annotate标注(动词) Annotated text/corpus标注文本 /语料库、赋码文本/语料库Annotation标注(名词) Annotation scheme标注方案 ANSI/American National Standards Institute美国国家标准学会 ASCII/American Standard Code for Information美国信息交换标准码 Exchange Associates (of keywords)(主题词的)联想词 AWL/academic word list学术词表 Balanced corpus平衡语料库 Base list/baselist底表、基础词表 Bigram二元组、二元序列、二元结构 Bi-text/bitext双语合并文本、双语分行对齐文本 (一句源语一句目标语对齐后的文 本) Bi-hapax两次词 Bilingual corpus双语语料库 Bootcamp debate/discourse/discussion(新手)训练营大辩论 /话语 /大探讨CA/Contrastive Analysis对比分析 Case-sensitive/case sensitivity大小写敏感、区分大小写 Category-based approach基于类(范畴)的方法 Chi-square test/ 2χ卡方检验 Chunk词块 CIA/Contrastive Interlanguage Analysis中介语对比分析 CLAWS/Constituent Likelihood Automatic Word-CLAWS 词性赋码系统 tagging System Clean text policy干净文本原则 Cluster词簇、词丛 Colligation类联接、类连接、类联结 Collocate n./v.搭配词;搭配 Collocability搭配强度、搭配力 Collocation搭配、词语搭配 Collocational strength搭配强度 Collocational framework/frame搭配框架 Collocational profile搭配概貌

大专-机电一体化毕业论文

国家开放大学 毕业论文(设计)题目:机电一体化 学习中心:吴忠电大分校 学号: 1464001402456 姓名:吴占忠 专业:机电一体化 指导教师:史景江 2016 年 5 月 17 日

摘要 作为机电系的一名学生,将来工作学习都会以机电为主,所以必须掌握好各种机电的专业知识。我会本着认真的态度对待专业课的学习,提高自己的专业素养.接下来我将介绍一下我对电动机发展史的认识 关键词:机电一体化电动机机械技术微电子技术

目录 绪论 --------------------------------------------------------------4 第一章我国发展机电一体化面临的形式以及对策----------------------5 一、机电一体化技术发展历程及其趋势------------------------5 二、典型机电一体化产--------------------------------------7 三、我国发展“机电一体化”面临的形式和任务----------------7 四、我国发展“机电一体化”的对策--------------------------9 第二章电动机的发展及工作原理------------------------------------11 一、电动机技术发展及现状----------------------------------11 二、电动机工作原理----------------------------------------12 三、电动机的维护------------------------------------------13. 四、结论--------------------------------------------------16 致谢---------------------------------------------------------------17 参考文献-----------------------------------------------------------18

语料库语言学的发展

语料库语言学的发展 语料库顾名思义就是放语言材料的仓库。现在人们谈起语料库,不言而喻是指存放在计算机里的原始文本或经过加工后带有语言学信息标注的语料文本。现在世界上已经有了不少规模较大的语料库,有些是国家级的,有些由大学和词典出版商联合建设。另外,由于个人微机的迅猛发展和存贮数据的硬盘造价持续下降,研究者个人也开始建立适合于自己研究的小型语料库。 语料库语言学(英文corpus linguistics)这个术语有两层主要含义。一是利用语料库对语言的某个方面进行研究,即“语料库语言学”不是一个新学科的名称,而仅仅反映了一个新的研究手段。二是依据语料库所反映出来的语言事实对现行语言学理论进行批判,提出新的观点或理论。只有在这个意义上“语料库语言学”才是一个新学科的名称。从现有文献来看,属于后一类的研究还是极个别的。所以,严格地说,现在不能把语料库语言学跟语言学的分支, 如社会语言学、心理语言学、语用学等相提并论。 近年来,随着我国经济的发展,科研经费的增加,汉语语料库的建设得到了开展。1999 年我院把建立汉语语料库列为院重大课题。目前语言所正在构建三个大规模的语料库: 现场即席话语语料库,主要方言口语库和现代汉语文本语料库。在世界范围内,我国的语料库建设在规模上还赶不上欧洲的一些发达国家,特别是英国。然而,在语料库语言学的研究上,以及语料库的实际运用上,我国已经进入世界前沿的行列。 20 世纪语言研究的总特点可以用四个字概括──高度抽象。最近几十年来,语言研究的高度抽象倾向已经失去主导地位。这主要缘于两个方面的因素: 一是计算机技术,特别是基于计算机处理的多媒体技术的飞速发展;二是社会语言学、语用学、会话分析、人类语言学、计算语言学、人机对话研究、语音识别与合成等研究取得令人瞩目的成就。先前难以抓住并进行有效处理的五花八门的实际语料,现在可以对其进行大规模地的、自动的或人机配合的处理。比如个人发音特征,先前认为这跟语言学毫无关系,现在成了侦破语音学的重要内容。侦破语音学家首先建立个人发音特征语料库,这个语料库可以用来鉴别嫌疑犯。概言之,当今的语言研究由先前的高度抽象逐步走向最具体的语言的实际活动,其中

桂诗春等-2010-语料库语言学与中国外语教学

2010年11月November 2010 第33卷第4期Vol.33No.4 现代外语(季刊) Modern Foreign Languages (Quarterly )语料库语言学与中国外语教学 桂诗春 冯志伟杨惠中何安平卫乃兴李文中梁茂成 [编者按] 为推动我国应用语言学研究的新发展,教育部人文社科重点研究基地———广东 外语外贸大学外国语言学及应用语言学研究中心于2010年9月24-25日成功举办了“首届广外应用语言学论坛”,庆贺我国著名语言学家、应用语言学学科的开拓者桂诗春教授八十华诞。期间,举行了题为“语料库语言学与外语教学”的高层论坛,就语料库语言学的现状、发展前景及语料库的建设、共享、应用等展开了互动讨论。以下是根据专家发言,整理后的主要内容。 [中图分类号]H319 [文献标识码]A [文章编号]1003-6105(2010)04-0419-08 语料库语言学的发展前景与资源共享 广东外语外贸大学 桂诗春 1.语料库语言学的发展前景 语料库语言学在外国和国内都发展很快,有的人选择了它作为发展方向,因为它的入门比较容易,上手较快;有的人把语料库语言学作为收集数据的重要手段。但是总的来说,我们的语料库研究还处在比较初级阶段,需要提高。究其原因是很多人把它看成是一种工具或手段,可以运用现有的一些现成的程序和公开的语料库,如Brown ,LOB ,Frown. Flob , BNC ,CLEC ,只要选题得当,就能获得很多量化的数据,从而写出洋洋洒洒的文章来。在计算机和扫描仪的支持下,自行收集一些语言素材,建立一个特定的语料库,也不是什么难事。 我觉得,语料库语言学既是一种工具,但更是一门学科;它是对语言行为进行概率性归纳和概括的一门学科,它本身是跨学科性的,要做语料库语言学研究必须许多方面要有比较雄厚的基础。首先是数学和统计学。Herdan (1960)的一本早期著作,叫做《词次/词型数学》(Type /token Mathematics ),其副标题就是《数理语言学教科书》(A Textbook of Mathematical Linguistics ),当时还是前计算机 时代,但Herdan 觉得有两件语言事实值得我们注意:一是大量语言资料(language in mass ),二是语言排列(language in line ),它们是任何语言运作都不能离开的两个方面。某些语言学研究分支如果考虑到这两个方面,将会从中获益。当时还没有真正的机读语料库, Brown 的语料库在1967年才面世,美国心理 学家John Carroll 根据该语料库以及他后来参与制作500万词的AHI 语料库,所提出的词汇频数对数正态模型(lognormal model )均源于Herdan 所奠定的基础。一直到最近美国Barber 利用计算机对英语语体的各种研究,更是利用了因子分析的统计方法。其次是计算机科学。语料库的发展离不开现代科学技术,其主要表现是个人电脑、扫描仪和大容量硬盘的普及,当初Brown 语料库要动用到大型电脑,而到如今,只需一万元左右就能在家里拥有这些设备,制作出甚至比Brown 还要大的语料库。但是我们往往只注意到硬件部分,而不认识到软件的建设。从事语料库语言学研究的人而不掌握一到两种编成语言,也不可能拓展他们的研究领域,因为他不能根据个人的研究需

语料库和知识库的研究现状

语料库和知识库研究现状 2015-12-9

摘要:语料库是语料库语言学研究的基础资源,也是经验主义语言研究方法的主要资源,它与自然语言处理有着相辅相成的关系,是用统计语言模型的方法处理自然语言的基础资源。知识库广泛应用于信息检索、机器问答系统、自动文摘、文本分类等领域,为进行大规模的真实性文本的语义分析提供了有利的支持,它也成为自然语言处理不可或缺的基础资源。由于语料库和知识库的广泛应用,如今国内外对语料库和知识库的研究给与高度的重视,经过过去几十年的发展,各国在语料库和知识库的建设和应用方面都取得了不少成果。本文通过对语料库与知识库相关文献资料的搜索整理,重点介绍目前国内外在语料库和知识库方面的研究现状。 关键词:语料库;知识库;研究现状 1前言 语料库是指按照一定的语言学原则,运用随机抽样的方法,收集自然出现的连续的语言文本或者说话片段而建成的具有一定容量的大规模电子文本库[1]。而知识库是知识工程中结构化、易操作使用,全面有组织的知识集群,是针对某一(或某些)领域问题求解的需要,采用某种(或若干)知识表示方式在计算机存储器中存储、组织、管理和使用的互相联系的知识片集合。语料库和知识库在传统语言研究、词典编纂、语言教学、自然语言处理等领域有重要作用,所以自从20世纪60年代第一个现代意义上的语料库——美国布朗语料库(Brown Corpus)诞生开始,大批国内外的专家学者致力于语料库和知识库的研究,近年来国内外对于语料库知识库的研究取得了重大的突破,形成了规模不一的各种语料库和知识库,并且涌现了众多有关语料库和知识库的专着、论文等。对于语料库和知识库发展现状的总结研究,不仅可以帮助人们清楚的了解语料库和知识库当前发展的形势,对今后语料库知识库的发展具有一定的指导作用,而且对于应用语料库知识库发展自然语言处理等领域具有重要意义。

(完整版)语言学专业词汇中英文对照版

语言学术语(英-汉对照)表 A abbreviation 缩写词,略语ablative 夺格,离格 accent 重音(符) accusative 宾格 achievement test 成绩测试acoustic phonetics 声学语音学acquisition 习得 acronym 缩略语 action process 动作过程 actor 动作者 address form 称呼形式addressee 受话人 addresser 发话人 adjective 形容词 adjunct 修饰成分附加语 adverb 副词 affix 词缀 affixation词缀附加法 affricate 塞擦音 agreement 一致关系 airstream 气流 alliteration 头韵 allomorph 词/语素变体 allophone 音位变体 allophonic variation 音位变体allophony音位变体现象 alveolar ridge 齿龈 alveolar 齿龈音 ambiguity 歧义 analogical creation 类推造字anapest 抑抑扬格 anaphor 前指替代 anaphoric reference 前指照应animate 有生命的 annotation 注解 antecedent 先行词前在词anthropological linguistics 人类语言学 anticipatory coarticulation 逆化协同发音 antonomasia 换称代类名antonym 反义词 antonymy 反义(关系) appellative 称谓性 applied linguistics 应用语言学applied sociolinguistics 应用社会语言学 appropriacy 适宜性appropriateness 适宜性得体性 approximant 无摩擦延续音 aptitude test 素质测试 Arabic 阿拉伯语 arbitrariness 任意性 argument 中项中词主目 article 冠词 articulation 发音 articulator 发音器官 articulatory phonetics 发音语音学 artificial speech 人工言语 aspect 体 aspirated 吐气送气 assimilation 同化 associative 联想 associative meaning 联想意义 assonance 准压韵半谐音 attributive 属性修饰语定语 auditory phonetics 听觉语音学 authentic input 真实投入 authorial style 权威风格 authoring program 编程 autonomy 自主性 auxiliary 助词 auxiliary verb 助动词 B babbling stage 婴儿语阶段 back-formation 逆构词法 base component 基础部分 behavioural process 行为过程 behaviourism 行为主义 bilabial 双唇音 bilabial nasal 双唇鼻音 bilateral opposition 双边对立 bilingualism 双语现象 binary division 二分法 binary feature 二分特征 binary taxonomy 二分分类学 binding 制约 binding theory 制约论 blade 舌叶舌面前部 blank verse 无韵诗 blending 混成法 borrowing 借用借词 bound morpheme 粘着语素 bounding theory 管辖论 bracketing 括号法 brevity maxim 简洁准则 bridging 架接 broad transcription 宽式音标 broadening 词义扩大 Brown corpus 布朗语料库 C calculability 可计算性 calque 仿造仿造词语 cancellability 可删除 cardinal numeral 基数 cardinal vowel 基本元音 case 格 case grammar格语法 case theory格理论 category 范畴 categorical component 范畴成分 causative 使役的使投动词 center 中心词 central determiner 中心限定词 chain relation 链状关系 chain system 链状系统 choice 选择 choice system 选择系统 circumstance 环境因子 class 词类 class shift 词性变换 clause 小句从句 click 吸气音咂音 clipping 截断法 closed class 封闭类 closed syllable 闭音节 cluster 音丛 coarticulation 协同发音 coda 结尾音节符尾 code 语码信码 cognitive psychology 认知心理学 cognitive system 认知系统 coherence 相关关联 cohension 衔接 co-hyponym 同下义词 colligation 类连结 collocative meaning 搭配意义 color word 色彩词 color word system 色彩词系统 command 指令 common core 共核 common noun 普通名词 communication 交际 communicative competence 交际能 力 communicative dynamism, CD 交际 性动力 communicative language teaching, CLT

机器翻译研究现状与展望

机器翻译是建立在语言学、数学、信息学、计算机科学等学科基础上的多边缘学科。现代理论语言学的发展、计算机科学的进步以及概率统计学的引入, 对机器翻译的理论和方法都产生了深刻的影响。 Weaver机器翻译思想的提出, 开始了机器翻译的研究热潮。Chomsky在50年代后期提出的短语结构语法, 给出了“从规则生成句子”的原则。由于短语结构语法采用单一标记的短语结构来描述句子的构成, 描述粒度过粗, 因此存在约束能力弱、生成能力过强问题, 人们逐渐意识到仅依靠单一的短语结构信息, 不能充分判别短语类型和确认短语边界, 于是, 复杂特征集和词汇主义被引入自然语言语法系统, 广义短语结构语法、词汇功能语法、中心语驱动的短语结构语法等语言学理论也相应地产生。在这个发展过程中, 基于规则方法一直是机器翻译研究的主流。 在基于规则的方法中, 语言规则的产生需要大量的人力,而且大量的语言规则之间往往存在着不可避免的冲突。另外,规则方法在保证规则的完备性和适应性方面也存在着不足。而此时, 统计学方法在自然语言处理的语音识别领域取得了比较好的效果, 于是, 基于统计的机器翻译应运而生。随着双语语料的大量增加、计算机性能的提高, 基于实例的机器翻译方法被提出,并由此泛化产生了基于模板的机器翻译方法。 下面我们分别介绍几种典型的机器翻译方法: (1)基于规则的机器翻译方法

从Chomsky提出转换生成文法后,基于规则的方法一直是机器翻译研究的主流,Chomsky认为一种语言无限的句子可以由有限的规则推导出来。 早期的机器翻译系统, 从体系结构上可以分为直译式、转换式和中间语言式, 它们的不同之处在于对源语言分析的深度, 它们的相同点是都需要大规模的双语词典、大量的源语言推导规则、语言转换规则和目标语言生成规则。其中, 转换式的基于规则方法对源语言分析得比较深, 它涉及到词汇结构分析、语法分析、语义分析, 并完成词汇、语法、语义三层结构从源语言到目标语言的转换, 而且转换式的方法又充分考虑了源语言和目标语言之间的特征联系, 它比中间语言方法更容易获得高质量的翻译结果。因此, 转换式的方法更多地被应用在早期的机器翻译系统中, 整个翻译过程被分为, 源语言分析部分, 转换部分和目标语生成部分。而早期的系统, 如德国西门子的METAL系统、美国的SYSTRAN系统、日本日立公司的ATHENE系统以及中国中软公司的HY-1汉英系统, 都是基于转换的机器翻译系统。 基于规则的机器翻译的优点在于, 规则可以很准确地描述出一种语言的语法构成, 并且可以很直观地表示出来。机器可以按照一组规则来理解它面对的自然语言, 这组规则包含了不同语言层次的规则, 包括用以对源语言进行描述的源语言分析规则、用以对源语言/目标语言之间的转换规则以及用于生成目标语的生成规则。

城乡教育一体化论文

城乡教育一体化论文 一、城乡教育一体化的内涵 就城乡教育一体化的内涵而言,不同的学者对其界定略有不同,但其内涵都直接或间接地表达了以下几个意思:一是城乡教育一体化的提出是为了解决城乡教育的二元结构;二是实 二、城乡教育一体化的推进策略 城乡教育一体化是为了更好地解决我国现阶段的教育问不仅需要城题所提出的。要加快推进城乡教育一体化的进程,市学校和农村学校的共同努力,更需要社会各界的共同努力,也需要各种政策的支持。 1.改革教育管理制度 综上所述,成人高等教育学校只有真正明确办学的指导思想,坚持教学质量为学校生命线的理念,加强教师的综合素质,学校的办学水平、办学质量才能不断提高,学校也才能适应新形势下教育事业的科学发展。参考文献: [1]岳成阳.构建完善的成人高等教育教学质量监控体系的探讨,和实践[J].齐齐哈尔大学学报(哲学社会科学版)2011(3):111-113. [2]唐大光.构建完善的成人高等教育教学质量监控体系[J].成人教育,2011(7):119-120. 城乡教育一体化论文范文二:开放教育对城乡教育一体化的作用 一、开放教育城乡教育一体化的现状 多年来,开放教育的发展取得了举世瞩目的成就,我国开放教育为使教育能持续稳定协调发展,经过多方努力采取了多种积极有效地措施,已经初步建立起了开放教育城乡教育一体化发展的基本格局。

2.开放教育对农村农民和农业的技术培训以及参与教育部的“一村一名大学生计划”,使得开放教育在农村教育中成果显著。除了 农村对农民和农业进行技术培训外,自2004年开始开放教育又开展 了教育部“一村一名大学生计划”,将开放教育延伸到农村第一线; 该计划指出要努力做好农村党员干部现代远程教育培训工作、进一 步做好农村中小学教师继续教育、积极为农村劳动力转移开展职业 技能培训和教育培训、大力在农村开展实用技术培训、加强对“三农”服务的学历教育等,该计划开放教育有1100多个教学点参与了 试点,招生人超过了30万,可以说对“三农”的技术培训和“一村 一名大学生计划”在农村已经取得了相当大的成就。 3.开放教育的“新型产业工人培养和发展助力计划”必将对农村城镇化进程中的农民再就业,以及农业人口向产业工人转型发挥重 要的作用。自2014年秋季开放教育启动了“新型产业工人培养和发 展助力计划”(简称“助力计划”),将招生范围扩展到了城市乡村 的在职工人和再就业工人;其内容主要包括针对新型产业工人培养特 别是城镇化进程中的新型产业工人,针对他们开展的对口专业学历 教育,针对他们的岗位技能培训、职业能力提升等非学历继续教育、以及为行业、企业职工培训和职工终身学习提供课程、学习资源等 方面的学习支持服务,其主要目的是提升企业的劳动力技术水平, 为企业培养留得住用得上的高素质劳动者和技术人才,同时为行业、企业技术人才的终身学习和提升提供学习平台,此计划对开放教育 的城乡教育一体化必将产生重要的影响。 4.开放教育的“学分银行”制度大大方便了开放教育学生特别是乡村学生对学习时间、学习地点的选择,从而在一定程度上推动了 开放教育城乡教育一体化的发展。开放教育的“学分银行”制度是 学生可以从多个学校多个培训机构中的多个专业进行共享和互认学分,从而实现学生从多个学习源中累积学分的目的,进而使学生能 够自由选择学习地点、学习时间、学习内容的一种制度,它有以下 几个方面的优点。第一,突破了传统的学习时段限制和专业限制, 并在学历教育和职业技能培训中同步运行,从而将学生完成学业的 时间从固定学习制改变为弹性学习制。第二,通过“学分银行”制度,学生只要学完一门课就能获得相应的学分,只要参加技能培训

语言学常用术语

语言学常用术语

A List of Commonly-used Linguistic Terminology 语言学常用术语表 Part I General Terms 通用术语 Acquisition 习得 Agglutinative language 粘着语Anthropology 人类学 Applied linguistics 应用语言学Arbitrariness 任意性 Artificial intelligence (AI)人工智能Behaviorism 行为主义Behaviorist psychology 行为主义心理学 Bilingualism 双语现象 Cognition 认知 Cognitive linguistics 认知语言学Cognitive science 认知科学Comparative linguistics 比较语言学Computational linguistics 计算语言学 Corpus-linguistics 语料库语言学Creole 克里奥耳语;混合语 Culture 文化 Descriptive linguistics 描写语言学Design features 识别特征Developmental psycholinguistics 发展心理语言学 Diachronic/historical linguistics历时语言学 Dialect 方言 Dialectology 方言学 Displacement 不受时空限制的特性Dualism 二元论 Duality 二重性 Epistemology认识论 Etymology 辞源学 Experimental psycholinguistics 实验心理语言学 Formalization 形式化 Formal linguistics 形式语言学Forensic linguistics 法律语言学Functionalism 功能主义General linguistics 普通语言学Grammaticality 符合语法性Ideography 表意法 Inflectional language 屈折语 Inter-disciplinary 交叉性学科的Isolating language 孤立语 Langue 语言 Macro-sociolinguistics 宏观社会语言学 Mentalism 心智主义 Micro-sociolinguistics 微观社会语言学 Montague grammar蒙太古语法Neuro-linguistics 神经语言学Orthography 正字法 Orthoepic 正音法的 Paradigmatic 聚合关系 Parole 言语 Pedagogy 教育学;教授法Philology 语文学 Philosophy 哲学 Phonography 表音法 Pidgin 皮钦语;洋泾浜语Polysynthetic language 多式综合语Prescriptive linguistics 规定语言学Psycholinguistics心理语言学Psychology 心理学 Semeiology 符号学 Sociology 社会学 Speech 言语 Sociolinguistics社会语言学Structuralism 结构主义 Synchronic linguistics 共时语言学Syntagmatic 组合关系 Theoretic linguistics 理论语言学Universal grammar 普遍语法Universality 普遍性 Part II Phonology 音位学 Ablaut 元音变化 Acoustic phonetics 声学语音学Affricate 塞擦音 Allophone 音位变体

相关主题
文本预览
相关文档 最新文档