希洛与里安德的语料库检索分析
语言学研究本栏目责任编辑:谢媛媛希洛与里安德的语料库检索分析陈喆(海南大学,海南海口570000)摘要:语料库语言学作为一门新兴学科,可以应用于文学分析领域。
该文通过语料库对克里斯托弗·马洛的长诗《希洛与里安德》进行分析,旨在揭示情节,深入了解作者对于人物的刻画,以期用更加客观的方式展现诗歌的魅力。
关键词:语料库检索;希洛与里安德;文本分析中图分类号:H0文献标识码:A文章编号:1009-5039(2019)12-0079-021WordSmith 概况使用语料库方法来研究语言使用是一种天然的结合,因为语言使用千差万别,并非凭研究者的个人的语言本能所能判断的(桂诗春2012)。
语料库能在多语境的条件下同时处理大量语言数据。
WordSmith 作为一款领军软件,广泛地应用在语言学的研究领域当中。
软件由英国利物浦大学的Mike Scott 设计而成,是牛津大学出版社出版的一款文字处理软件。
Word⁃Smith 多用于在文本中查找模式中,被语言学,文学,法律,医学,历史,政治,社会学各个等领域的语言学生,教师,研究人员和调查人员广泛使用。
目前它可以处理大多数语言,其中包括中文,英文等。
WordSmith 于2018年更新至7.0版本。
本文主要运用语料库检索软件Wordsmith 4.0。
Wordsmith 在文学分析领域主要具备三大功能:单词列表、检索、主题词统计。
1.1检索功能(Concord )使用检索功能可以检测并统计某个或某些词汇或词组在特定文本中出现的频率。
WordSmith 提供了三种检索选项:简单检索、高级检索和基于文件的检索。
1.2单词列表(Wordlist )处理文本文字时常需要创建语料库中词汇使用频率列表,确定词汇或词块(clusters )是常用频率。
此时就需要用到单词列表(Wordlist )功能。
简而言之Wordlist 的三大功能是:(1)分析研究语料库中的词汇类型;(2)确定语料库中的常见词块;(3)比较不同文本中特定词汇的使用频率。
1.3主题词功能(KeyWords )主题词是研究文本内容和文本语言特征差异的重要途径。
主题词指频率显著高于或显著低于参照语料库中对应词的频率的哪些词汇。
杨慧中(2004)解释了“KeyWords ”与KWIC (key word in context )中的“key word ”的不同之处。
后者指的是作索引时的节点词(node word )或搜索词(search word )。
前者指的是文本中主题词(为了与KWIC 中的key word 的翻译相区分,本文对Key⁃Words 的翻译采用“主题词”),指的是跟某一标准相比其频率显著偏高的词,偏高的程度是这个主题词的“关键性”(p.159)。
2文本总体统计特征和分析《希洛与里安德》是克里斯托弗·马洛一首未完成的叙事诗。
全诗共6章,马洛只完成了前两章,其余4章由查普曼续成(本文研究马洛所写的前两章)。
本诗采用双韵体,题材来自古希腊,描写爱神的女祭司希洛与青年里安德隔海相爱的故事。
王佐良先生(1997)给予这首长诗很高的评价,认为诗中所写“是借希腊故事为名,把英国文艺复兴的精神完美地表现出来(p.98)”,诗“固然是叙事,恣意渲染的却是这一对爱人的青春活力(p.98)”,“诗句充满了明亮的色彩(p.98)”,“视觉的想象力发挥到了极致(p.98)”。
梁实秋先生(1986)也有这样的评语:“马洛此诗可以说是‘文字图画’的杰作,不但文辞绚烂,而且在肉体的美与性感的快乐方面刻意经营,充分表现了文艺复兴时期的精神(p.347)。
”由此可见本诗在文坛中的显著地位,因此对这首诗的分析具有研究意义。
本文旨在探讨语料库检索软件在分析文学文本的应用,通过使用WordSmith 对长诗进行分析,以期用更加客观的方式展现诗歌的魅力。
通过Wordsmith 对《希洛与里安德》文本进行统计分析,得到了有关这个文本的一些简略统计数字(由于本次检测对象为诗歌,因此不对句长、段落等特征进行分析,因其不具有显著性):形符数(tokens ):6333类符数(types ):1967类符形符比(type/token ratio ):31.06标准化类符比(standardized type/token ratio ):52.13平均词长(average word length ):4.37词长标准差:1.95形符数(token )指整个文本的词汇总数,类符(types )指文本一共有多少个不同的词形,类符/形符比(type/token ratio,TTR )主要表明文章所用词汇的多样性和差异性,类符/形符比越大,说明文章所用词汇的种类越多,相同词汇的使用比例低。
本次检验只选用了《希洛与里安德》一首诗的文本,因此单从形符数、类符数和类符形符比难以对诗歌整体做出判断,因此借助于标准化类符比进行推断。
标准化类符比的计算方法是按一定的长度分批计算文本的类符形符比,然后求出它们的平均值。
WordSmith 将这个长度界定为1000,也就是先计算第一个1000词的类符形符比,再计算第二个1000个类符形符比,以此类推,最后计算它们的平均值。
这样的比率计算方式用于解决在较短文本中类符形符比可能会上升的问题,更加客观地反映文本中的用词变化。
本诗的标准化类符比为52.13,与类符形符比高出21.07个百分点,由此可见这首诗的词汇变化量相对较高。
收稿日期:2018-10-12修回日期:2018-12-16作者简介:陈喆(1993—),女(满族),北京人,硕士研究生,单位:海南大学旅游学院外国语言学及应用语言学系,主要研究方向为社会语言学。
79Overseas English海外英语2019年06月平均词长(mean word length)是指文本中词的平均长度,以字母数为单位。
一般文本的平均词长为4个字母左右。
平均词长反映了文本用词的复杂程度。
平均词长较长,说明用的长词较多。
词长标准差(word length std.dev.)反映了文本中每个单词长度与文本平均词长的差异,标准差越大,说明文本中各单词词长之间的差异就越大。
图1词长分布图由图1可见,本诗中以三个字母和四个字母的单词居多,占整体使用的46%。
综上数据可以推断,本诗文本难度属于中等程度,用词丰富。
3主题和情节检索与分析用WordSmith对文本进行统计,可以得到一个主题词表。
对前四十个词进行筛选,发现使用频率最高的实义词是her (121),he(107),his(91),she(88),love(43),him(42),like(30),hero(25),leander(25)。
通过对her在上下文中的搭配进行追溯,可以看到这首诗的主要故事情节,下面选取一些例子进行说明:1.silk,with gilt stars drawn;Her wide sleeves green,and bor⁃dered2.Doth testify that you exceed her far,To whom you offer,and3.unknown joy.Treason was in her thought,And cunningly to yield4.Whose only dower was her chastity,Having striv'n in vain5.lest his love abated,Fearing her own thoughts made her to6.knew not how to frame her look,Or speak to him,所选例句1对是希洛所着服饰的描写:华服以星辰为点缀,碧绿的袖口以果园图案镶边。
通过检索所有her的上下文搭配,发现这首诗前15%的部分都是直接描写希洛的美貌。
外貌的描写从正面勾勒出了希洛的美丽。
另一方面,对希洛华服的大量着墨和天地神明对她的宠爱以及追求者愿意为她献出生命这些方面的叙述更是从侧面烘托了希洛绝色。
例句2讲述的是里安德向希洛求爱的过程。
里安德竭力劝说与开导希洛与他“及时行乐”。
这首诗中,马洛用华丽的辞藻和丰富的比喻去刻画人性中的爱欲。
例句3、4、5分别代表了随着马洛的劝说希洛的心理变化。
最开始希洛的态度是含蓄害羞的,她坚持守护自己的贞洁。
但里安德对“何谓贞洁”的批判性解读使她产生了矛盾的情绪。
诚如里安德所言,天生就有的东西并不值得让人骄傲。
真正为人称颂的应当是高尚的行为,保守所谓的“贞洁”是无用的,因为那并不是真正的高尚。
例句5可以看到此时的希洛已经接受了里安德的思想,与他享受爱情的甜蜜。
此时的希洛已经爱上了里安德,甚至害怕自己的某些行为会失去里安德的爱。
例句6呈现了少女希洛的一面。
爱人不畏危险穿过大海与她相见,她惊喜而不知所措。
诗的后半部分主要描述二人相爱的种种体验,本文不在此赘述。
虽然诗中最高频的实义词是her,但是统计可见,关于里安德代词的总体使用量(he,his,him总计242次)实际上是高于关于希洛的代词(her,she总计209次),对于这个现象本文也进行了研究。
例句如下:7.because she moves not there.His body was as straight as8.royally,And such as knew he was a man,would say文中同样对里安德的俊美进行了大量的着墨,比如例句7描写了里安德笔挺的身躯,例句8讲的是里安德的英俊吸引了最野蛮的士兵,因此有人甚至怀疑他女扮男装。
安德被马洛赋予了女性的阴柔之美,跨越了传统性别的界限,颠覆了以往人们对于男性的认知。
但是从代词统计数据和例句2可以看出,里安德实际上仍保持着传统的性别角色分配,即对他的刻画遵循了传统社会的男权至上的理念。
如诗中里安德费尽心思劝服希洛与他共享欢愉。
在里安德劝说希洛这部分希洛是聆听的状态,这部分展现了里安德的热情和希洛的羞涩,与传统男性角色和女性的性格相符,这也导致了里安德的代词多于希洛的使用量。
4结束语通过语料库对文本进行检索,我们可以得到《希洛与里安德》的文本总体特征:词语表达丰富,文本难易程度中等。
大致情节和人物心理变化的刻画也通过对关键词搭配显现了出来。
通过对代词使用量的分析,发现本诗塑造的角色是传统男女形象的反映。
但是通过在语料库的检索过程中也存在着一些问题。
文中大量使用明喻的修辞手法,因此“like”的具体所指还需一个一个回归原文进行分析。
高频词“love”的分析也遇到了困难,因为诗中除了“爱”这个含义,还用“Love”指代爱神,但高频词分析不区分大小写,这也给分析造成了困难,仍需参照原文才能得出具体含义。
多维度分析法在语料库语体分析中使用现状综述
外语外文7学法教法研究课程教育研究1、多维度分析法简介Douglas Biber (1988)[1]创建的多维度分析法(Multi-dimensional Analysis )被认为是目前为止涉及语言特征最多,分类最细的语域分析方法。
在多维度分析法被提出之前,语域对比研究主要集中于分析语域在某一参数上的差异,而这种单维度的对比方法并不能全面揭示语域间的差异,而且对语言特征的分类也是建立在研究者主观直觉上。
为了弥补之前研究的不足,1988年,Biber 提出了多维度分析法:利用因子分析法(Factor Analysis ),对英国LOB 语料库(Lancaster-Oslo/Bergen Corpus )和LLC 语料库(London-Lund Corpus )中的23种口笔语与语文本的67种语言特征的“共现”进项归类分析,将众多语言特征变量分解为几个公共因子,归纳出五个主要维度:交互性与信息性、叙述性与非叙述性、指称明晰性与情景依赖型、显性劝说型、信息抽象与具体程度。
每个维度都包含其特有的语言特征,例如动词的过去式(past tense verb ),第三人称(third-person pronouns )、公共动词(public verbs )等语言特征主要出现在叙述性语体中,在非叙述性文章中则很少出现,由此可见这一组语言特征“共现”在某一语域中,我们便可将其归纳为同一维度。
Biber (2002)指出多维度分析法作为一种基于语料库进行语域分析的研究方法,能够客观揭示口笔语语域不同,从而得以实证分析出任何两种语域之间的区别。
2、基于语料库的多维度分析法研究概述2.1 国外研究综述早期使用多维度分析法对语料库进行分析的研究主要集中在口笔语语域差异比较。
Biber (1992)[2]使用该方法首先对索马里语的口笔语语域差异进行了分析,分析得出任何语言都有一个或者更多的口语维度。
之后,Biber (1994)在此研究基础上对体现作者写作风格的语言特征进行分析,在2002年[3]总结之前的研究成果,Biber 等人对大学口笔语语域进行了多维度分析,该研究以TOFEL2000口语及WALC (Written Academic Language Corpus ,书面语学术语言语料库)作为研究对象,发现口语语域和书面语域之间存在本质性差异。
语料库2——精选推荐
语料库2由于语料库⽂体学特别注重⽂学语篇语⾔特征的分析, 到⽬前为⽌,基于语料库的⽂学语篇语⾔⽂体特征的分析主要集中在以下⼏个⽅⾯:1.利⽤语料库的词汇统计原理识别某个语篇的作者 2.主题词(Key Words)分析:对语篇的关键词进⾏统计,得出关于该语篇的主题相关性;3.两种语⾔风格对⽐:以平⾏语料库的⽅法对不同作家或同⼀作家不同时期⽂学语篇、不同作家的同类语篇或⽂体特征进⾏⽐较研究;4.⽂学⼿段如象征⼿法等的运⽤;5.利⽤词汇频率(包括使⽤频率、覆盖率和分布率)的统计对⽂学⽂本进⾏体裁特征及体裁差异分析;6.词语搭配(修辞搭配、异常搭配等)的⽂体意义分析。
语料库⽂体学:⽂学⽂体学研究的新途径对⽂学作品主题、⼈物形象的塑造、叙事的发展以及作家风格等进⾏研究。
纵观⽂学⽂体的语料库研究,根据研究⾓度的不同,⼤致可分为以下三个主要研究领域:1)以个体语⾔特征的⽂体研究为⽬的的语料库标注和分析;2)对作品主题的语⾔表现⽅式的研究;3)作家风格研究搭配研究可以⽤于语⾔创造性使⽤、⽂体变异、作家风格等研究⽬的《警察与赞美诗》的语料库检索分析⽤语料库⽅法分析美国⼩说家欧·亨利的⼩说《警察与赞美诗》,能揭⽰⼩说的情节、⼈物的塑造及作者的写作技巧。
最近⼏年来语料库语⾔学正以其独特的优势得以迅猛发展,语料库(Corpus)被⼴泛应⽤于与语⾔相关的各个领域。
语料库检索软件(Concordancer)在语⾔学领域,尤其是在⽂本分析中已被⼴泛使⽤。
语料库检索结果就是在语料库中抽取⼀个⽂本的⼀个检索词班代及其出现的语境按字母顺序罗列出来,语料库检索软件是提供这些词的罗列结果的系统。
它使⽤既简单⼜省时,因为它可以快速有效地显⽰出检索词的搭配词频。
作为⼀种建⽴在庞⼤的数据基础上的极有威⼒的假设检验设置,语料库索引可以使⽂本隐含的结构显现出来,同时⼜激发⼈的想像⼒,并能检验⽂本对读者的感染⼒,具有很强的客观检验性。
语⾔学并不是语料库检索软件应⽤的惟⼀领域,它也可以⽤于⽂学批评领域来分析⽂学⽂本。
《哈利·波特和混血王子》的语料库检索分析
口 口 匡 匡 匡6 1
5 6 5
th i. 山em
协e
53
4 3 55 56
3 4 9 4肠
2 4 3 4 19 4 13
. nd
0 2
2l
卜」 川
卜 im wh a t
山. n
lj” k
3327 2 89 5
表 1《 哈利 波特和 混血王子》 中出现频率在前68 位 的词
文学 ,近年来语料库语言学正以其独特的优势得以迅 猛发展 ,凭借其大规模 的语料资源 以及先进 的语料库 检索软件和工具对语言文本进行深加工, 再创造。语料
库检索工具 可 以分析统计 出文本 中所需 查词语 的 出现
际 频率
l
单词 名次 频率 单词 名次
第 三 ,具有一定独 特功能 的称谓语不 易被淘 汰 。
“ 人 ”一 直 是 用 来 指 称 具 有 一 定 社 会 地 位 的人 的妻 夫
本文用J K 罗琳 的<哈利 波特和混血王子》 作为 文本 , 主要运用Wor s mi h和Co c 记an e等工具来分析 d t n o c 小说 中的语言特色 , 情节发展 , 以及人物塑造等几个方
仅仅局限于对原文斟词酌句的研究 , 分析言外意, 得出
对文学作 品 中的情节转化 与人物塑造 的理解 与阐述 。 这 种传统的鉴赏方法秉承 了文学研究 的精髓 , 为我们鉴赏
压
16
胭 id
臼
32 33 4 3
72 3 , 2 0
s 6 7
肠 7 6
s 6
36 3 36 1
匡
目目
I自
面
文学作品的语料库检索分析——以雨中中教的猫为例
文学作品的语料库检索分析——以《雨中中教的猫》为例-中教数据论文文学作品的语料库检索分析——以《雨中中教的猫》为例梅朝阳,李麒,杨敏(第三军医大学基础部,重庆400038)摘要:基于语料库的文学作品检索分析是语料库研究方法在文学鉴赏中的具体应用。
本文用语料库语言学方法对海明威的短篇小说《雨中的猫》进行了检索分析,以此量化解读该作品的文本特征、故事情节和写作特色等信息。
关键词:语料库检索;文本特征;故事情节;写作特色DOI:10.16083/ki.22-1296/g4.2015.10.053中中教图分类号:H319文献标识码:A文章编号:1671—1580(2015)10—0120—02收稿日期:2015—04—15作者简介:梅朝阳(1987—),女,湖南益阳人。
第三军医大学基础部外语教研室,助教,硕士,研究方向:语料库语言学,外语教育,话语分析。
李麒(1990—),男,黑龙江哈尔滨人。
第三军医大学基础部外语教研室,助教,研究方向:外语教育,翻译理论。
杨敏(1963—),女,重庆人。
第三军医大学基础部外语教研室,教授,研究方向:外语教育,专门用途英语。
本文以海明威的《雨中的猫》作为研究对象,运用语料库检索软件,从文本特征、故事情节和写作特色等角度对其进行分析,试图为文学批评寻求一种更深入的研究方法。
一、基于词表的作品基本情况分析首先用Wordsmith 6.0软件对小说文本进行统计,提供了一些简略统计信息。
从形符数(1159个)和句子数(121个)可以看出,该文本是一个较短的文本。
杨慧中指出,单纯的形符数和类符数并不能反映文本的本质特征,但两者的比率却在一定程度上反映用词的变化性。
将类符形符比29.85与标准类符形符比31.90作比较,可以推断出该文本词汇变化不大。
词长为1~4个字母的词有826个,即整个词汇的71.3%均为少于4个字母的词。
在语言层面上,小说篇幅相对较短,语篇用词浅显,整体难度较低(文本易读度Flesch Reading Ease系数为93.657,文本难度级别Flesch-Kincaid系数为2.345,Coh-Metrix 2.0)。
《人世间》语料库检索分析
《人世间》语料库检索分析作者:徐超来源:《现代交际》2020年第17期摘要:《人世间》是当代著名作家梁晓声的长篇小说。
以语料库文体学为理论基础,利用AntConc语料库检索软件和ICTCLAS汉语分词系统,通过量化的方式对小说的主人公和故事情节进行分析。
首先通过词频表分析小说的高频词,然后选定参照语料库,提取小说关键词,最后借助软件的Concordance功能分析主人公的性格特征,发现小说具有人物角色丰富、形象刻画细腻等特点,且该书与作家的其他作品之间具有很强的延续性。
关键词:《人世间》语料库 ;检索中图分类号:I06 ;文献标识码:A ;文章编号:1009-5349(2020)17-0104-03梁晓声是当代著名作家,他曾创作出版过大量的小说、散文和影视作品。
在创作过程中,知青经历带给他無限的灵感。
他的多部作品都涉及知青话题,如《这是一片神奇的土地》《今夜有暴风雪》《雪城》等。
2017年由中国青年出版社出版的《人世间》[1]是其最具影响力的长篇小说之一,该书曾获第二届吴承恩长篇小说奖,同年8月获第十届茅盾文学奖。
小说展示了北方某省会城市背景下普通工人子弟之间的亲情和友情,以及他们之间既相互影响又各自独立的人生,也描绘出中华人民共和国成立后波澜壮阔的社会巨变。
文章基于语料库,首先利用分词系统对小说的全部文本进行分词处理,然后通过AntConc 语料库检索软件进行词频统计、主题词提取并归类,分析小说的主题和情节,利用软件的索引功能对主人公“秉昆”进行检索,并对其搭配词进行整理分析,探讨主人公的个性特点。
本研究的目的在于,借助语料库检索软件,对《人世间》的文本进行量化分析,在此基础上挖掘小说在人物塑造、情节叙事等方面的特点,为该书的研究提供一个新的视角[2]。
一、理论基础虽然出版时间不长,但已有多位学者对《人世间》进行分析研究。
在中国知网中以“《人世间》”为关键词进行检索,共有论文23篇,这些研究以对书中某一人物性格特征的分析、小说的叙事方式为主,如李贵成(2019)《“永恒的女性,引领我们向上”——梁晓声〈人世间〉中的女性形象与社会变迁》、高心悦(2019)《论梁晓声〈人世间〉的情爱叙事》等。
语料库辅助EFL自主学习的多维探索第6章
6.2.1 Word and Phrase的应用
6.2.2 AntConc的应用
主要途径
1. 直接查询权威语料库,理解文中的语言难 点和重点; 2. 利用Range等软件检测语篇的词汇广度与 深度等; 3. 通过BYU语料库网站的Word and Phrase及 其它在线文本分析网站,获取某篇文章词 汇使用的宏观与微观信息; 4. 利用AntConc或Wordsmith Tools等工具分 析文本,特别是通过主题词分析,加深对 文章主题的理解,分析写作特点。
还有同一类词性的词在语法结构中的出现 位置或充当的成分并不一样 作为人体部位名称的lap前面通常只带人称 所有格(如his或her)并与介词搭配作状语(如 on his/her lap) 但其他部位名称如mouth和eye却非如此 (Sinclair,2004;转引自何安平,2009)。
6.2 语料库辅助英语阅读 能力的培养
第四,文学手段如象征手法等的运用; 第五,利用词汇频率(包括使用频率、覆盖 率和分布率)的统计对文学文本进行体裁特 征及体裁差异分析; 第六,词语搭配(修辞搭配、异常搭配等)的 文体意义分析。
链接
BYU语料库网站的Word and Phrase: / The Online Corpus of Old English Poetry (OCOEP): http://www.oepoetry.ca/ Shakespeare's Sonnets Corpus: /ecorpus/sonnets/framconc. asp Corpus of Middle English Prose and Verse: /c/cme/
基于语料库方法检索分析《傲慢与偏见》
基于语料库方法检索分析《傲慢与偏见》作者:宋艳秋来源:《文学教育》2019年第05期内容摘要:语料库语言学是一门新兴的学科,在文学领域逐渐发展起来,为文学作品的分析提供了一种全新的视角。
本文主要运用Keyword和Concordance等功能对小说《傲慢与偏见》的文体特征、主题和人物性格塑造等特征进行检索分析。
关键词:语料库检索主题人物性格随着计算机技术和日新月异,语料库语言学作为一门新兴的学科不仅在语言学领域发展起来,也在文学领域蓬勃发展。
利用现代计算机技术,凭借其丰富的语料库资源和先进的语料库检索软件及工具对文本进行直观分析。
语料库检索工具可以分析统计出搜索词在文本中出现的频率,词与词的搭配情况,以及关键词出现的疏密程度。
语料库中最常用的工具是Keyword 即关键词和Concordance即语境共现,是指从选定的文本中选择一个搜索词,利用AntConc3.5.0软件把这些词及其出现的上下文按照字母顺序依次排列出来。
以检索词为中心,左右两侧显示的单词数构成该检索词的跨距,跨距中的词就是检索词出现的上下文,即共现语境。
这种隐含结构为进行主题和人物性格分析提供了可靠的依据。
迄今为止,我国有很多学者在语料库检索软件辅助分析文本方面都有所研究。
比如孙丽丽的基于语料库对海明威《老人与海》的文本特征分析,郭放的《快乐王子》的语料库检索分析,汪琴的词、搭配与词块——《太阳照常升起》的语料库文体学研究等,都利用检索软件对词汇,语法,修辞等文体特征做了统计分析。
笔者从中受益颇多。
本文主要用语料库检索软件辅助分析英国小说家简·奥斯汀的杰出代表作《傲慢与偏见》,以Keyword和Concordance为检索工具对文本特征,主题和人物性格进行直观分析。
一个文本的形符数即该文本的长度,文本全部的词汇数量,就是总形符数。
统计结果显示:《傲慢与偏见》一共有251,119个形符数,说明该作品篇幅较长。
平均词长是指在相关语料库中所取单词所包含字母的平均数。
语料库与语用学研究发展新趋势
语料库与语用学研究发展新趋势作者:杨子来源:《北京科技大学学报(社会科学版)》2018年第01期〔摘要〕虽然语料库语言学近年发展迅猛,但语料库与语用学的结合相对迟缓,西班牙学者Jesús Romero-Trillo主编的《语料库语言学与语用学年鉴》系列自2013年问世以来,旨在推动语料库语用学的发展,文章对2015年版进行述评,该卷年鉴不仅为语料库与语用学的结合研究指明了方向,更涵盖了语料库语用学现有的几乎全部研究范式、思路和方法,全面呈现了语料库语用学的现有研究架构。
〔关键词〕语料库语言学;语用学;述评〔中图分类号〕H0〔文献标识码〕A〔文章编号〕1008-2689(2018)01-0026-04引言自20世纪80年代诞生以来,语料库语言学发展迅猛,如今语料库已经成为继内省法、诱导法后的又一重要语言研究方法,广泛应用于语言学的各领域研究。
然而,语料库方法从语言形式出发,对形式以外的内容检索能力较弱,而语用学关注具体语境下的语言使用,主要研究对象如说话人意图、会话隐含等均无明显形式标记,故语料库与语用学的结合进展缓慢。
在此背景下,西班牙学者Jesús Romero-Trillo主编了《语料库语言学与语用学年鉴》系列,集合了近年来语料库语言学与语用学交叉研究的众多力作,内容涉及二者结合研究开拓的新领域和方法、语料库语用学下的实证/理论研究新范式、语料库语用学背景下语篇与翻译研究方法等。
自2013年问世,各卷整体结构类似,均由导言、研究性论文(10余篇)和书评(2-3篇)构成。
本文将对2015年年鉴[1]进行述评。
一、内容简介本辑分三部分:第一部分关注语料库语用学下语篇研究的新方法,第二部分考察语料库语用学在翻译研究中的应用,第三部分介绍近年出版的语料库语用学相关书籍。
第一部分开篇“语料库语用学下的言语行为——自然语篇与引导语篇中指令句的定量对比研究”对比了英语口语会话语料库、商务信函语料库与基于语篇补全测试(DCT)的指令句库,随意选取三类指令句各235例进行人工标注,定量对比指令行为的实现方式、面子威胁修正语的使用、指令行为间接度与面子威胁修正策略间的关联,揭示指令行为在“自然语篇-引导语篇”和“口语-书面语”维度上的差异。
基于语料库的作品对比分析
基于语料库的作品对比分析作者:杨秋月来源:《校园英语·上旬》2014年第10期【摘要】本文采用基于语料库的研究方法,使用Antconc和Monoconc对《简爱》和《呼啸山庄》两部经典文学作品进行了对比研究,旨在发现两部作品在词汇使用频率,类符形符比等方面的差异并通过进一步分析,找出造成差异的原因,以帮助读者更好的理解这两部经典的文学作品。
【关键词】简爱呼啸山庄语料库对比分析一、引言随着《简爱》和《呼啸山庄》的出版,这两部著作的作者——勃朗特夏洛特勃朗特和艾米莉勃朗特获得了广泛的关注。
这两部作品都以女性为关照对象,一百多年里,简爱对个人独立的不懈追求和她与罗切斯特先生之间浪漫而又波折的爱情故事,凯瑟琳和希刺克利夫之间狂热而又颇引人争议的爱情故事一直为人们所津津乐道。
二、文献语料库是一系列自然语言形成的文本,Sinclair(1991)认为语料库的作用是为了检测或研究某一语言状态或变体。
研究者经常使用基于语料库或语料库驱动的方法以实现其研究目的。
三、研究方法本文采用基于语料库的研究方法,旨在通过Antconc和Monoconc对《简爱》和《呼啸山庄》两部经典的文学作品进行对比研究,包括两部作品在词频等方面的不同,以帮助读者更好的了解这两部作品。
四、分析《简爱》和《呼啸山庄》这两部文学作品是由勃朗特姐妹所著,并且由于其戏剧场景、对女性价值观的独特描述获得了关注。
由于女权运动的发展,它们更是得到了众多学者的关注,但很少有人以基于语料库的方法对这两部作品进行对比。
以下是这两部作品中词频的检索片段:由于篇幅的限制,这里只列举了5个出现次数最多的词。
但通过检索我们发现,和《呼啸山庄》相比,《简爱》中”I”的出现次数要高出很多,而且“me” “my”等第一人称代词的频次也高于第三人称的频次。
值得注意的是两部作品中“was”的出现频次均高于“is”,这说明两者都用过去时叙述整个情节。
此外,在两部作品中“that” “which”的比例都比较高,这表明两部作品中的句子都比较长。
国际语料库翻译学研究现状的可视化图谱分析
国际语料库翻译学研究现状的可视化图谱分析宋晓舟【摘要】This paper analyzes the co‐cited references of 439 articles on corpus translation from the da‐tabase:Web of Science by using CiteSpaceⅢ ,w hich is a scientometric tool .T he annual distribution of articles ,the most productive authors ,countries and research institutions is studied;the most cited literature ,the hottest topic as well as the front research domains of world corpus translation is also studied .This study aims to facilitate the study of world corpus translation and detect the research fronts in this field by clarifying the development and knowledge structureof world corpus translation .%通过可视化软件CiteSpace Ⅲ对Web of Science数据库中收录的以“语料库翻译”(corpus translation)为主题的文献进行分析,绘制出语料库翻译学的知识图谱;重在考察语料库翻译的研究力量分布、知识来源分布、热点研究课题及前沿课题研究;以期对国际语料库翻译研究的发展脉络和知识结构进行重新梳理,并展望未来的发展趋势。
【期刊名称】《合肥工业大学学报(社会科学版)》【年(卷),期】2015(000)004【总页数】7页(P109-115)【关键词】CiteSpace Ⅲ;语料库翻译;共被引分析;可视化【作者】宋晓舟【作者单位】福建师范大学外国语学院,福州 350007; 福建工程学院人文学院,福州 350118【正文语种】中文【中图分类】H059(1.College of Foreign Languages, Fujian Normal University, Fuzhou 350007, China; 2.School of Humanities, Fujian University of Technology, Fuzhou 35 0118, China)Key words:CiteSpace Ⅲ; corpus translation; co-cited analysis; visualization 翻译的研究早已超越了一门学科的限制,成为了一门交叉学科[1]。
