[1]感谢加拿大社会科学和人文科学研究理事会(SSHRC)对本研究的支持和资助。
[2]全面的讨论参见Käthe Hamburger, The Logic of Literature, 2nd ed., trans. Marilyn J. Rose, Bloomington:Indiana UP, 1973, p. 233;Gérard Genette, Fiction and Diction, trans. Catherine Porter, Ithaca: Cornell UP, 1993, pp. 1-29.
[3]这里需要明确区分虚构与真实之间的重要区别。本文探讨的是文本向读者表明其虚构性或真实性时所固有的特质识别问题。这与检测文本是否真实(即“测谎”意义上的真实性判断)有着本质不同。
[4]中文译文引自艾丽丝·门罗:《逃离》,李文俊译,北京:北京十月文艺出版社,2016年,第133页。出于与后文分析一致的需要,括号内补充了原中文译本中省略的动词“is”(对应词“是”)和代词“they”(对应词“她们”“他们”)。——译注
[5]尽管虚构作品的可预测性研究已取得初步且卓有成效的成果,但本文将聚焦于虚构写作的标志性特征,探讨这些特征如何揭示虚构性的本质,尤其是长篇小说的历史。参见Ted Underwood, “Understanding Genre in a Collection of a Million Volumes, Interim Report,” https://dx.doi.org/10.6084/m9.figshare.1281251.v1。
[6]Richard M. Gale, “The Fictive Use of Language,” Philosophy, vol. 66, 1971, pp. 324-340; David Lewis, “Truth in Fiction,” American Philosophical Quarterly, vol. 15, 1978, pp. 37-46; John R. Searle, “The Logical Status of Fictional Discourse,” Expression and Meaning: Studies in the Theory of Speech Acts, Cambridge: Cambridge UP, 1979, pp. 58-76; Hilary Putnam, “Is there a Fact of Matter about Fiction?” Poetics Today, vol. 4, no. 1, 1983, pp. 77-82; Benjamin Hrushovski, “Fictionality and Fields of Reference,” Poetics Today, vol. 5. no. 2, 1984, pp. 227-251; Gregory Currie, The Nature of Fiction, Cambridge: Cambridge UP, 1990.
[7]John R. Searle, “The Logical Status of Fictional Discourse,” p. 68. (中文译文引自约翰·塞尔:《虚构话语的逻辑地位》,冯庆译,《南京社会科学》2012年第6期,第145页。——译注)一切皆取决于塞尔对“一串话语”这一概念的区分——而这一区分本身亦构成一串话语。
[8]Maurice Blanchot and Jacques Derrida, The Instant of My Death, Demeure: Fiction and Testimony, Stanford: Stanford UP, 2000, p. 28.
[9]Stanley Fish, Is There a Text in This Class? The Authority of Interpretive Communities, Cambridge: Harvard UP, 1982.
[10]此观点绝非过时之论,它如今正以“后经典”叙事学的形态在学界重演——该学派主张,虚构叙事与非虚构叙事之间不存在本质性区隔特征。受心智理论新近研究成果的驱动,其关注焦点已从文本的独特性转向处理文本的认知机制,并假定这种机制普遍存在于各类叙事之中。而本文将说明,虚构与非虚构叙事不仅存在显著差异,而且这种差异主要是源于对感官感知(即具身体验)的高度关注,这使得将认知框架作为叙事研究的基础范式问题重重。关于后经典叙事学的立场,参见J. Alber and M. Fludernik, eds., PostclassicalNarratology, Columbus: Ohio State UP, 2010。这类新的研究主要是为了回应多里特·科恩(Dorrit Cohn)以及更早的凯绥·汉伯格(Käthe Hamburger)的“经典”叙事研究。Dorrit Cohn, The Distinction of Fiction, Baltimore: JHU Press, 1999; Käthe Hamburger, The Logic of Literature, Bloomington: Indiana UP, 1973.
[11]或有必要对此观点稍加阐发。语言哲学家们执着于这样一种理念:对于任何特定话语而言,并不存在能绝对判定其真实性的决定性特征。以前文段落中的句子为例——“站在那里的一个妇女认出了她,两人便聊了起来”——我们无法从字面本身明确判断其真伪,无从确证其所指涉的是现实世界真实发生的事件,抑或纯属虚构场景。然而,当我们将语言置于整体语境中观照时,其意向指涉性便开始显现。这恰如斯坦利·卡维尔(Stanley Cavell)常指出的,这类情形暴露出哲学家们建构的例证往往因过度简化而丧失了解释现实世界的效力。
[12]“虚构性”的多样化程度仍是一个悬而未决的问题,泰德·安德伍德(Ted Underwood)的研究准确地处理了文体的稳定性这一观念,而马克·阿尔吉-休伊特(Mark Algee-Hewitt)等的研究处理了19世纪之前虚构叙事的异质性问题。参见Ted Underwood, “The Life Cycles of Genres,” CA: Journal ofCultural Analytics; Mark Algee ‐ Hewitt, Laura Eidem, Ryan Heuser, Anita Law, and Tanya Llewellyn, NovelTaxonomies: Prehistories of Genre in the Eighteenth Century, CA (即将出版)。(从作者信息等方面判断,此文后来发表于斯坦福大学文本实验室的系列项目里面,题目略有差异,参见https://litlab.stanford.edu/projects/taxonomy-titles-18c/。——译注)在非计算的研究中,托马斯·帕维尔(Thomas Pavel)认为19至20世纪长篇小说的统一是一个有意为之的审美概念,意在与现代早期的子文体优先序次问题形成对照。“现代早期的叙事文化强调子文体之间的差异,而长篇小说后来的形态则是融合这些子文体的多种尝试的结果。”参见Thomas Pavel, The Lives of the Novel: A History, Princeton: Princeton UP, 2015, p.10。
[13]这一观点关注到多里特·科恩早期在计算研究之前所相信的“只有当虚构将聚焦潜能实现时,才能被明确识别为虚构”。Dorrit Cohn, The Distinction of Fiction, p. 25.
[14]在此,我发现我的这些结论与“可能世界理论”(possible worlds theory)高度一致,这一理论在1990年代很有影响力。参见Thomas Pavel, Fictional Worlds, Cambridge: Harvard UP, 1989; Marie Laure-Ryan, Possible Worlds, Artificial Intelligence, and Narrative Theory, Bloomington: Indiana UP, 1992; Ruth Ronen, Possible Worlds in Literary Theory, Cambridge: Cambridge UP, 1994。这也支持了约翰·班德(John Bender)更晚近的新历史研究,他的研究强调18世纪长篇小说的兴起与科学实验的关系。参见John Bender, Ends of Enlightenment, Stanford: Stanford UP, 2012。
[15]正如凯瑟琳·加拉格尔写道:“如果一种文体可以被认为是具有态度的,那么小说对其虚构性似乎持有矛盾的态度——既把它发明为本体论基础,又对它施加了严格的限制。”参见Catherine Gallagher, “The Rise of Fictionality,” The Novel, vol. 1, ed. Franco Moretti, Princeton: Princeton UP, 2006, pp. 336-363; Elaine Freedgood, “Denotatively, Technically, Literally,” Representations 125, Winter, 2014, pp. 1-14; Frances Ferguson, “Now It’ s Personal: D.A. Miller and Too-Close-Reading,” Critical Inquiry 41, Spring, 2015, p. 527; Ian Watt, The Rise of the Novel: Studies in Defoe, Richardson, and Fielding, Berkeley: California UP, 2001。需要补充说明的是,弗里德古德对小说技术性词汇重要性的强调绝非规范性的;她只是希望我们关注这一被忽视的维度,因为它拓展了阅读研究的史料范围。正如我将在本文结尾所展示的,对小说内部事实性的关注是计算方法非常适合解决的问题。同样值得注意的是,这些学术观点所关注的时间范围都比我在此探讨的时间框架要早,但它们的时间框架仍然构成了更广泛的长篇小说(用迈克尔·麦基恩(Michael McKeon)的话说,就是“我们的那种小说”[our kind of fiction])的规范性论述的基础。一个悬而未决的问题是,这些虚构性的模糊性或强化的指涉性感知之所以呈现出如此面貌,是否与17世纪小说中发生的事情有关,也就是说,这些论点是否基于17、18世纪之交发生的另一种转变,而这种转变到19世纪已不再起作用。
[16]更充分的讨论和预测模型的运用,参见Ted Underwood, “The Life Cycles of Genre”。
[17]虚构与非虚构的划分来自泰德·安德伍德的文献数据集。所有的重复题名都已剔除,所有在文体或题名域中有“essays”“tales”“scenes”“stories”词干的文档都已剔除,所保留的作品均为有89%或更高的概率其内容80%以上篇幅属虚构。
[18]与此前.txtLAB网站的19世纪文献集类似,本文涉及的文档都代表了近十年间虚构与非虚构作品的典范样本——这意味着它们都通过了某种筛选机制:无论是入选《纽约时报书评》、入围文学奖项提名,还是出现在亚马逊网站或《纽约时报》等多种畅销书榜单。对于该数据集更为详细的说明,以及围绕长篇小说的当代社会价值形态的揭示,参见Andrew Piper and Eva Portelance, “How Cultural Capital Works:Prizewinning Novels, Bestsellers, and the Time of Reading”。
[19]如对研究LIWC使用的词典感兴趣,可参阅其语言手册,http://www.liwc.net/LIWC2007LanguageManual.pdf。
[20]参见Yla R. Tausczik and James W. Pennebaker, “LIWC and Computerized Text Analysis Methods,” Journal of Language and Social Psychology, vol. 29, no. 1, 2010, pp. 24-54。
[21]有关词典驱动研究的周详而实用的综述,参见H. A. Schwartz, J. C. Eichstaedt, L. Dziurzynski, M. L. Kern, E. Blanco, S. Ramones, M. E. P. Seligman, and L. H. Ungar, “Choosing the Right Words: Characterizing and Reducing Error of the Word Count Approach,” in Proceedings of SEM-2013: Second Joint Conference onLexical and Computational Semantics, Atlanta, Georgia, USA, 2013, pp. 296-305。有关文本分析的词典与机器学习方法的对比,参见Andrew Piper and Eva Portelance, “How Cultural Capital Works”。
[22]有关建模和计算阐释学,参见Andrew Piper, “Novel Devotions: Conversional Reading, Computational Modeling and the Modern Novel,” New Literary History, vol. 46, no. 1, 2015, pp. 63-98。
[23]本研究使用R语言中的kernlab程序包,所有分析均采用高斯核函数(“rbfdot”)。关于机器学习,有一篇有用的导论文章:Brett Lantz, Machine Learning with R, Birmingham, UK: Packt, 2013。
[24]完全可以推翻这一假设,优先考虑总体上更普遍的特征,这在评估单个词语时很有价值。单个词汇的使用频率可能很低,因此偏好使用数量较多的词汇可以确保找到更多“重要”或“相关”的词汇,即随机词汇较少。关键的一点是,结果是由模型中使用的初始假设决定的。
[25]除了删除对话,有关交流的200个动词及其前后紧挨着出现的人称代词(I said, said she等)也被从文中删除了。
[26]通过R语言中的NLP程序包分析发现,小说文本中平均提及的人名数量为10.58个,而历史类著作中这一数值则达到23.94个。
[27]Lisa Zunshine, Why We Read Fiction: Theory of Mind and the Novel, Columbus: Ohio State UP, 2006.
[28]Ted Underwood, “The Life Cycles of Genres,” Journal of Cultural Analytics, Vol. 2, no. 2, 2016.
[29]这种随着时间推移而演变的“虚构作品/长篇小说”的区别,将在当代长篇小说的文体区分中再次显现,因为它与社会价值息息相关。当前畅销书与获奖小说之间最显著的差异特征之一,便体现在对怀旧与回溯(retrospection)这一特征的处理上。参见Piper and Portelance, “How Cultural Capital Works”。
[30]这一观察与马修·埃林(Matthew Erlin)有关小说叙事的哲学维度的论述一致。参见 Matthew Erlin,“From the Philosophical to the Epistemic Novel?” CA: Journal of Cultural Analytics (即将出版)。(原文如此,译者并未找到这篇文章。——译注)
[31]如果仅以这四项特征作为分类依据,分类结果的准确率将显著高于随机选取四项特征的平均水平。不过需要说明的是,该准确率仍远低于使用全部80项特征时的表现,且存在其他特征组合能够实现略优的效果。在这些表现更佳的特征组合中,出现频率最高的是现在时动词和感官知觉类别——这也印证了前文关于小说文本独特性的其他讨论。具体数据如下:使用全部四项特征的准确率为76%,表达认知推诿的特征准确率为63.4%,而随机选取四项特征的准确率(基于100次试验)为60.8%±3.8%。
[32]这些小说首先使用R语言中的openNLP工具包进行文本处理,仅保留名词,然后再用Python脚本hypernyms_ReturnTopClass.py处理后的文本进行转录。
[33]Ryan Heuser and Long Le-Khac, “A Quantitative Literary History of 2,958 Nineteenth-Century British Novels: The Semantic Cohort Method,” Stanford Literary Lab Pamphlet 4, http://litlab.stanford.edu/LiteraryLabPamphlet4.pdf.
[34]这里的p值极低,原因之一是观测数据的数量较多。在比较各组中每篇小说和其他所有小说时,我们得到了超过13,000个观测值。在这种情况下,即使是微小的差异也会显得很重要。因而,实际差异从0.003%变为0.5%。
[35]将小说的抽象性视为其早期独特性关键的观点,为我们反思现实主义假说提供了一条有别于韦恩·布斯(Wayne C. Booth)的思路。在布斯看来,长篇小说(或者他所说的“优秀的”长篇小说)的价值在于对戏剧性张力的关注,而非现实主义呈现。他说道:“对现实主义的兴趣并不是一种可证实或证伪的‘理论’,甚至也不是多种理论的组合;它只是一个时代人们最深切关怀的表达。”这种观点将我们引向更接近马修·乔克斯(Matthew Jockers)著作精神的情节弧线理论——情感强度如韵律般起伏波动的叙事结构。参见Wayne C. Booth, The Rhetoric of Fiction, Chicago UP, 1983, p. 63。
[36]Matthew Erlin, “From the Philosophical to the Epistemic Novel?” CA: Journal of Cultural Analytics(即将出版)。(原文如此,译者未找到这篇文章。——译注)
[37]进一步分析表明,这一增长主要是由于对“地点”(site)这类词的依赖。而其他大多数词则保持不变。更多的研究可以揭示这种明显的偏差对虚构的影响。
[38]Curtis Dahl, “Moby Dick's Cousin Behemoth,” American Literature, vol. 31, no. 1, 1959, pp. 21-29.