在英文论文中反复使用“I”或“we”,它体现的是研究者如何表达立场、安排论证责任、调用已有研究,并在学科共同体中建立可信身份。本文围绕作者声音、元话语名词型式、元话语名词、命题来源和实证研究论文展开,比较应用语言学与法学论文在词汇语法选择上的共性与差异。研究使用2020—2024年国际期刊发表的100篇实证论文,自建697,122词的学术英语语料库,对4,507个相关实例进行分析。对于外国语言文字、学术英语写作、语言学论文辅导和博士论文辅导来说,这项研究提供了较完整的语料选择、人工标注、统计比较及结果解释范例。

作者声音是学术英语素养的重要组成部分。它反映研究者能否在所属学科中表达学术立场、建构研究身份,并与目标读者形成有效互动。
有些人把作者声音理解成第一人称代词的使用频率,这种理解过于简单。作者即使没有直接写出“I argue”或者“we find”,也可以通过名词、从句、引语方式、评价词和命题来源让读者感受到他的判断。作者声音既是一种词汇特征,也是一种语法现象,最终呈现的是多种话语资源共同作用所形成的累积印象。
现有研究较多关注动词、副词、形容词、自我指称语和引文方式,对名词性元话语的讨论相对不足。另一个问题是,过去不少研究把词汇项目分开统计,较少考察句法型式如何把元话语名词、命题内容与命题来源连接起来。本文所分析的研究,正是从这一缺口出发。
研究重点考察两类典型的前指性元话语名词型式。所谓“前指”,是指名词的具体含义要由后面的从句补充。读者先看到一个概括性名词,再通过后续命题理解这个名词究竟指什么。
| 主要型式 | 细分结构 | 常见写作功能 |
| N + 名词后置从句 | N + that从句 | 通过fact、evidence、finding等名词概括并引出具体命题 |
| N + 名词后置从句 | N + to不定式从句 | 表达研究目的、机会、能力、尝试或未来行动 |
| N + 名词后置从句 | N + of介词从句 | 讨论某种可能性、过程、方法或行为 |
| N + be + 补足语从句 | N + be + that从句 | 对一个完整命题作出判断、解释或评价 |
| N + be + 补足语从句 | N + be + to不定式从句 | 突出目标、任务、需求和未来导向行为 |
例如,“the fact that...”“the opportunity to...”“the possibility of doing...”“the concern is that...”和“the aim is to...”都不是单纯的名词短语。名词负责概括和评价,后面的从句负责提供具体命题,两者结合后才形成完整的修辞功能。
研究没有只统计某一个单词,而是建立了由“词汇语法型式—元话语名词—命题来源”组成的三维框架。
| 分析维度 | 研究内容 | 需要回答的问题 |
| 词汇语法型式 | 名词和后续从句采用何种句法组合 | 作者通过什么结构组织立场和命题 |
| 元话语名词 | 事件、认知、话语、状态、品质和关系等名词 | 作者如何概括事实、表达判断并引导读者理解 |
| 命题来源 | 作者声言、学者引用和抽象实体等来源 | 一个判断由谁负责,作者是显性出现还是隐性存在 |
这一框架把作者声音界定为话语层面的人际概念。它强调,声音不是由某一个代词、引语或者态度词单独决定的,而是词汇与语法资源反复共现后形成的整体效果。
研究选取应用语言学和法学两个软学科进行比较。两个学科都具有较强的解释性和论证性,但知识建构方式并不完全相同,因此适合观察相近学科内部的语言差异。
语料来自两个领域的十本国际期刊,每本期刊抽取10篇论文,共计100篇。应用语言学和法学各50篇,发表时间为2020—2024年。为了控制体裁差异,样本只包括使用数据分析、语料分析、实验、问卷、访谈或者案例研究方法的实证研究论文,书评和综述文章没有进入最终语料。
文章还需要具有相对清晰的IMRD结构,即引言、研究方法、研究结果和讨论。图表、注释、参考文献、基金信息及页码等非正文内容在语料清洗阶段被删除。
| 语料部分 | 应用语言学词数 | 法学词数 | 合计词数 |
| 引言 | 50,319 | 73,137 | 123,456 |
| 研究方法 | 82,473 | 86,241 | 168,714 |
| 研究结果 | 103,142 | 139,104 | 242,246 |
| 讨论 | 77,379 | 85,327 | 162,706 |
| 总计 | 313,313 | 383,809 | 697,122 |
研究同时采用语料库量化分析和文本质性解释。第一步是清洗语料,并使用TreeTagger 3完成词性和词元标注。随后通过AntConc 3.5.9及正则表达式检索可能包含元话语名词的句法结构。
机器检索只能找到候选实例,不能直接判断名词是否真正承担元话语功能。像democracy、society和government等具有固定指称的具体名词需要排除,而同一个名词在不同语境中也可能属于不同类别。因此,研究对检索结果进行了人工核对。
完成识别后,再使用UAM CorpusTool 6.2对词汇语法型式、元话语名词类别和命题来源进行人工标注。整体流程可以概括为:
| 步骤 | 具体工作 | 主要目的 |
| 语料清洗 | 删除图表、注释、文献、页码和非正文信息 | 避免无关文本干扰统计 |
| 词性标注 | 标记名词、动词、介词及从句结构 | 为句法检索提供基础 |
| 候选检索 | 利用正则表达式检索五类结构 | 定位可能的元话语名词型式 |
| 人工识别 | 结合上下文排除非元话语名词 | 提高分类准确性 |
| 功能标注 | 标记名词类别、句法型式与命题来源 | 建立三维分析数据 |
| 统计与解释 | 比较原始频次、标准化频率及学科差异 | 解释学科文化和知识建构方式 |
研究在100篇实证论文中识别出4,507个元话语名词型式实例,平均每篇45.07个,每千词约6.6个。其中,“N + 名词后置从句”占绝对多数。
| 句法型式 | 出现次数 | 每篇平均 | 每千词频率 | 占比 |
| N + that从句 | 1,768 | 17.68 | 2.6 | 39.23% |
| N + to不定式从句 | 1,543 | 15.43 | 2.2 | 34.24% |
| N + of介词从句 | 866 | 8.66 | 1.2 | 19.27% |
| N + be + that从句 | 194 | 1.94 | 0.3 | 4.30% |
| N + be + to不定式从句 | 128 | 1.28 | 0.2 | 2.84% |
| 合计 | 4,507 | 45.07 | 6.6 | 100% |
这一结果说明,学术作者更习惯先使用一个概括性名词,再通过后置从句提供具体信息。名词一方面压缩信息,另一方面提前告诉读者应当把后面的内容理解为事实、发现、问题、目的、可能性还是评价。
法学语料中的元话语名词型式共有2,727例,每千词7.2例;应用语言学为1,780例,每千词5.8例。总体差异达到统计显著水平。法学语篇表现出更高的名词化程度和信息密度。
| 型式 | 应用语言学:次数/每千词 | 法学:次数/每千词 |
| N + 名词后置从句 | 1,638 / 5.3 | 2,547 / 6.7 |
| N + that从句 | 659 / 2.1 | 1,137 / 3.0 |
| N + to不定式从句 | 666 / 2.2 | 877 / 2.3 |
| N + of介词从句 | 313 / 1.0 | 533 / 1.4 |
| N + be + 补足语从句 | 142 / 0.5 | 180 / 0.5 |
| N + be + that从句 | 69 / 0.2 | 125 / 0.4 |
| N + be + to不定式从句 | 73 / 0.3 | 55 / 0.1 |
尽管两个学科都以名词后置从句为主要结构,具体选择仍然不同。应用语言学作者更偏向“N + (be) + to”型式,通过研究目的、行动能力和未来行为突出学科的应用导向。法学作者较多使用“N + (be) + that”型式,把注意力放在一个完整命题的判断、事实认定和论证责任上。
研究把元话语名词划分为实体、属性和关系三大类。实体类用于命名事件、认知、话语或文本;属性类负责表达状态、方式和品质;关系类用于说明因果、连接或对比关系。
| 类别 | 次数 | 每千词频率 | 占比 |
| 实体类 | 2,200 | 3.2 | 48.81% |
| 属性类 | 2,045 | 3.0 | 45.38% |
| 关系类 | 262 | 0.4 | 5.81% |
实体类中,事件名词出现959次,占全部实例的21.28%;认知名词出现859次,占19.10%。属性类中,状态名词为760次,方式名词695次,品质名词590次。关系类使用最少,其中因果名词185次,连接名词50次,对比名词27次。
这说明两个学科的作者都倾向于把研究活动、认知判断和事物特征作为论证起点,而较少直接使用名词建立实体之间的关系。名词不仅承担信息压缩功能,也在暗中影响读者如何评价后续命题。
就类别偏好而言,应用语言学作者更多通过认知名词突出研究目的、认识过程和解释行为,形成较强的“认知阐释”立场;法学作者则更依赖事件名词,把事实、证据、判决和法律活动放在论证中心,表现出“事实认定”导向。
在状态名词方面,应用语言学更常讨论能力、机会和必要性等动态情态,体现语言研究的实际应用价值。法学作者较多使用表示确定性、可能性及认知判断的状态名词,强调论证的严谨性。
在品质名词方面,应用语言学作者更倾向使用积极评价,说明方法或研究的价值;法学作者更常使用消极评价类名词,指出现有制度、规则或解释可能存在的问题。差异并不是简单的语言习惯,而是两种学科知识生产方式的反映。
命题来源回答的是“这句话由谁负责”。研究将其分为声言和援引。声言表示命题主要来自作者自己的判断,援引则表示作者把命题归于其他研究者、文献、机构或抽象实体。
| 命题来源 | 次数 | 每千词频率 | 占比 |
| 声言合计 | 3,833 | 5.6 | 85.05% |
| 显性声言 | 755 | 1.1 | 16.75% |
| 隐性声言 | 3,078 | 4.5 | 68.30% |
| 援引合计 | 674 | 1.0 | 14.95% |
| 学者引用 | 619 | 0.9 | 13.73% |
| 抽象实体 | 55 | 0.1 | 1.22% |
声言占85.05%,说明成功的学术论文不能只堆积前人观点,作者自己的解释仍然要处于中心位置。不过,作者往往不直接宣布“这是我的判断”,而是通过“the present study”“these findings”“the evidence”或者无生命主语隐藏自身存在,形成具有客观外观的立场。
两学科都以隐性声言为主,但法学作者显性声言的标准化频率明显更高。法学语料中,显性声言共594例,其中第一人称代词相关实例为593例;应用语言学显性声言为161例,其中第一人称代词135例。
法学作者常通过“we”或“our”与事件名词、认知名词共同出现,明确承担定义、判断和论证责任。应用语言学作者则更依赖学者引用以及认知、话语类名词,通过与其他研究建立联系来突出学术共同体意识。
在援引方式上,两类论文均更喜欢非融入式引用,即把研究信息或命题放在句子中心,而将作者信息放在括号中。这样的处理可以弱化被引作者的个人存在,突出研究发现本身,也体现软学科学术写作受到实证主义研究范式影响后出现的客观化倾向。
新手写作者常见的问题不是没有观点,而是不知道怎样让观点在英文句法中显得可信。直接大量使用“I think”会显得主观,完全隐藏作者又容易使论文失去清晰立场。元话语名词型式提供了两者之间的平衡办法。
| 写作目标 | 可考虑的语言资源 | 注意事项 |
| 呈现证据 | fact、evidence、finding、result | 必须明确数据或研究依据,不能把推测包装成事实 |
| 说明研究目的 | aim、purpose、intention、attempt | 目的应当与研究问题和方法对应 |
| 表达可能性 | possibility、likelihood、potential | 根据证据强度控制判断程度 |
| 评价研究 | importance、value、limitation、problem | 评价后应给出原因,避免空泛褒贬 |
| 连接前人研究 | study、research、approach、argument | 区分自己的判断与被引观点 |
| 承担作者责任 | we、our study、the present analysis | 按学科惯例决定显性程度 |
真正有效的作者声音来自“主张—来源—证据—限制”之间的配合,而不是把高频学术词机械替换进句子。外国语言文学论文辅导和学术英语写作辅导在修改此类内容时,应结合具体语境检查名词功能、命题来源和句法结构。
在理论层面,研究把词汇语法型式、元话语名词和命题来源纳入同一个作者声音分析框架,说明作者声音是多个语言资源协同作用后的累积结果。它也补充了以往过度关注动词、形容词和副词的问题,进一步揭示名词性结构的人际意义。
在实践层面,研究获得的元话语名词使用规律和搭配特征,可以帮助新手作者提高句法复杂度,理解名词性立场表达,并更有策略地使用声言和援引资源。相关成果还可以用于EAP、ESP课程设计、教材开发、学术英语评价和语言模型训练。
第一,元话语名词具有语义模糊和高度依赖语境的特点,自动识别难度较高。人工标注能够提高准确性,却限制了语料规模。本研究只分析十本期刊的100篇论文,可能遗漏低频结构和更多搭配方式。
第二,研究主要考察五种从句结构,没有覆盖“N + wh从句”“N + be + wh从句”和“There be + N”等低频型式。
第三,研究以跨学科宏观比较为主,没有进一步细分引言、方法、结果和讨论等子语类中的声音差异。语料集中于2020—2024年,也不能充分呈现长期历时变化。
第四,比较范围只有应用语言学和法学两个学科,结论不能直接推广到全部软学科或硬学科。后续研究可以扩大语料库,引入Python、R、自然语言处理和大语言模型辅助标注,同时增加跨语类、跨学科和历时比较。
博士論文字數不能根据专业名称统一判断。外国语言文学博士论文除了正文,还可能包含中英文摘要、语料说明、统计表、附录和词表。本文原始PDF共272页,但其中包含前置页面、参考文献与附录,PDF页数不能直接等同于正文有效字数。写作前应以学校和学院最新培养文件为准。
用户咨询代写价格时,也不能只按字数报价。像本文这样的语料库语言学研究,需要完成期刊筛选、语料下载、文本清洗、词性标注、正则检索、人工分类、统计检验、英文例句解释和多轮格式调整。是否已有语料、是否需要重新标注、是否提供数据文件,以及统计结果能否复核,都会影响实际工作量。
因此,不论咨询论文代写、博士辅导、英语论文辅导还是外国语言文学论文辅导,都应先确认研究阶段、交付范围、现有材料和学校要求。任何服务都不应虚构语料、统计结果或引用信息,否则即使文字看起来完整,也经不起导师追问和答辩核验。
据我们平台自身保存的品牌资料介绍,优客网ukthesis创立于1999年。作为长期从事论文写作支持、论文代写相关咨询与博士辅导服务的平台,我们持续运营至今所积累的经验,主要体现在对不同学科研究流程的理解上。面对外国语言文学、应用语言学和学术英语写作课题,我们不会只看篇幅或套用固定模板,而是先检查研究问题、语料来源、分析框架、标注标准和结果解释是否连贯。我们认为,平台的历史与优势最终仍要通过具体工作证明:数据是否能够复核,方法能否解释清楚,修改后的内容能否经得起导师和读者的实际检验。
不是。第一人称只是显性作者声音的一种形式。名词选择、评价方式、引用结构和命题来源都能表现作者的存在与立场。
元话语名词是需要结合上下文补充具体含义,并能组织话语、表达立场或引导读者理解的名词,例如fact、finding、possibility、aim和limitation。
同一个名词在不同结构和语境中可能承担不同功能。脱离后置从句、补足语从句和命题来源,只统计单词频率容易误判。
法学论证需要处理事实、证据、规则和判断,名词化结构有利于压缩复杂命题、提高信息密度并明确论证对象。
隐性声言能够保留作者判断,同时降低个人化表达,使主张呈现出相对客观和非个人化的语言外观。
可以检查论文是否只有引用而缺少自己的解释,是否过度使用第一人称,以及名词、从句和命题来源之间是否形成清晰的论证责任。
不能。软件适合检索和统计,但元话语名词高度依赖语境,仍需人工检查其具体指称、修辞功能和命题来源。
因为语料建立、人工标注、统计分析和结果复核所需时间,通常比普通文字整理更能决定实际工作量。
作者声音并不是论文表面的语言风格,而是研究者通过词汇语法型式、元话语名词和命题来源持续作出选择后形成的整体印象。应用语言学与法学虽然都表现出客观化倾向,却在句法偏好、名词类别、显性责任和引用策略方面保留了各自的学科特点。对于外国语言文字研究和学术英语写作来说,这项研究最有价值的地方,是把一个较抽象的“声音”概念转化为可以检索、标注、统计和解释的具体语言资源。