童话说说技术创业美文职业
投稿投诉
职业母婴
职场个人
历史治疗
笔记技能
美文纠纷
幽默家庭
范文作文
乐趣解密
创业案例
社会工作
新闻家居
心理安全
技术八卦
仲裁思考
生活时事
运势奇闻
说说企业
魅力社交
安好健康
传统笑话
童话初中
男女饮食
周易阅读
爱好两性

孙建军:大数据时代人文社会科学如何发展

7月7日 霸王亭投稿
  当前,科学数据在科学研究中的作用日益显著,数据密集型知识发现方法受到科学界的普遍关注:科学家不仅通过对大量数据实时、动态地监测与分析来解决科学问题,更基于数据来思考、设计和实施科学研究。数据不仅是科学研究的结果,且成为科学研究的基础;人们不仅关心数据建模、描述、组织、保存、访问、分析、复用和建立科学数据基础设施,更关心如何利用泛在网络及其内在的交互性、开放性,利用海量数据的可知识对象化、可计算化,构造基于数据的、开放协同的研究与创新模式。在人文社会科学领域,以“人文计算”、复杂网络分析、大规模数据分析为特征的研究方法逐渐被采纳,人文社会科学的“科学性”显著增强,而批判性与人文关怀有所弱化,学界对此褒贬不一。
  人文社会科学研究的数据挑战
  其一,科研资料总量的快速增加给人文社会科学学者带来了巨大挑战。2006年,GregoryCrane提出,当前人文社会科学研究者在自身研究领域都面临大量文献资料的处理,这些文献资料的数量已经大大超越了传统阅读能力所能处理的范畴,因而人文社会科学学者也将不得不借助计算机来处理完成相关文献资料,即“百万图书的挑战(MillionBooksChallenge)”问题。随着跨学科研究趋势的日益增强,传统人文科学和社会科学领域引入了大量的计算机处理模式和分析方法,各类依托计算机存储媒介数字学术资源的开发,基于复杂运算和分析的计算机模拟与实证,基于事实与证据的商业预测与案件证据推理等研究议题广泛兴起,从根本上改变了人文知识的获取、标注、比较、取样、阐释与表现方式。尤其在语言学、文学、历史学、文艺学、民族学等多个人文领域取得了引人注目的效果,并组建了专门的科研机构,形成了国际数字人文机构联盟和数字人文中心网络两大数字人文研究联盟。
  其二,资料的数字化改变了传统人文社会科学的资料类型,数字资源的采集、加工和处理对研究成果的获得作用日益显著。目前,海量的图书、报纸、期刊、照片、绘本、乐曲、视频等人文资料被数字化,并在互联网上被提供给研究者存取利用。而以“大数据”为代表的数据资源相对于数字文本、数字文献等数字信息资源,来源更加广泛,数据粒度更小,记录单元更加碎片化,结构更加多元化,机器生成数据也显著多于人工生成数据,信息质量参差不齐,对资料的汇集、保存和综合利用更加依赖计算机的辅助,人文社会科学也越来越需要依赖计算机对研究过程的支撑,传统人文社会科学学者对计算机技术和分析技巧的缺失甚至可能影响人文社会科学研究的最终实现,进而将计算机分析处理能力延伸为人文社会科学研究者科研素养的重要组成部分。
  大数据与人文社会科学研究新思维
  从当前数字人文和人文大数据研究情况看,人文及社会计算方法与人文社会科学研究的融合出现了三类新的研究思维:
  其一,人文社会科学开放与全过程研究思维。以往人文社会科学研究成果的表现形式为最终成果,再利用主要以文献引用、转述和评论等为主。而数字人文研究可记录人文社会科学研究的完整过程,资源化的原始数据、中间成果得以立体化应用,再利用水平显著提升。目前,国外以在线实验室、项目网站、开放数据集、项目论坛、项目社会网络为特征的立体开放研究思维普遍确立,可参与性大大增强。
  其二,人文社会科学碎片化重组研究思维。大数据环境下,人文社会科学研究更加注重片段数据、海量数据、非结构化数据的采集、清洗与分析,通过碎片化重组,深度揭示难以处理或无法预知的科学问题。比如通过海量自然语言表达效果观测公众的政治参与意识、通过科学家的在线时间与资源下载时间分布研究科学家的作息时间与工作强度等。
  其三,人文社会科学计算分析研究思维。以往人文社会科学研究定性研究居多,定量研究也主张采用是非论断,采纳或拒绝某一特定假设,是采用确定性、因果关系的研究思维。在大数据环境下,人文社会科学研究可采用计算分析思维,对相关命题进行趋势分析。
  此外,在上述研究思维体系下,跨学科协作、跨平台协作、海量资料加工以及人文社会科学的计算化趋势日益明显,并涌现出若干研究取向与热点问题。
  人文社会科学大数据研究的基本特征
  综合已有的研究,人文社会科学的大数据研究具有如下基本特征:
  一是所涉及资料均大大超过一般的阅读、分析和理解所能处理的范畴,是以往“不可研究”或“难以研究”的,大数据分析方法的出现提供了人文社会科学研究新的研究空间,提供了新的研究可能。
  二是一般引入计算分析方法,其结论并非观察、思索、领悟等传统方法获得,而是通过大量数据的汇集而“自动涌现”,其理论的获得不同于传统人文社会科学研究。
  三是均构建了可持续完善和丰富的数据集和分析工具,其可用性、共享性、重用性、协作性大大增强,提供了人文社会科学学者大规模协作的可能。
  四是均具有跨学科特征。数字人文研究需要汇集专业领域技能、数据管理技能、数据分析技能和项目协作技能,因而这类项目往往由跨度较大的不同学科的专业学者共同完成。
  五是决定研究质量的主要是数据集的质量、数量和利用方式,而研究假设相对容易。在某种程度上,数据科学家将成为人文社会科学大数据研究中的主角。
  人文社会科学大数据研究的隐忧
  虽然以微软、谷歌、IBM为代表的主流数据服务商都极力推崇数字化人文社会科学研究的美好前景,但其也存在不足:
  首先,非场景化的研究逻辑缺乏适用性与人文关怀。由于完全剥离了数据所处的具体环境,数据可能生涩,并且缺乏可理解性和适用性。比如商业分析中的数据挖掘,其可用性仅10左右,并非“一挖就灵”。2012年,加拿大作家史蒂芬马尔什在其文章《文学不是数据:反对数字人文》中也表示,将文学当作数据会失去文学本身丰富的意蕴。
  其次,人文社会科学的大数据研究有可能“敏锐地”发现问题,却无法给问题合理的解释,也无法给出有针对性的对策,限制了其应用范围。比如舆情分析、政策计算、情感计算的应用。
  再次,数据分析的集群研究会消灭重要的个体特征,而个体反而是众多人文社会科学研究关注的焦点。
  最后,人文社会科学大数据研究过分关注技术分析,可能忽视创新思维和思辨分析,不利于大师级人文社会科学学者的培养。
  总之,随着人文社会科学数据的快速增长以及大数据分析技术的日益完善,人文社会科学的大数据研究必然会成为人文社会科学的主流领域,但不会替代现有的人文社会科学研究,而是相互补充,相得益彰。
  (作者:国家社科基金重大项目“面向学科领域的网络信息资源深度聚合与服务研究”首席专家、南京大学教授)

刘奇:“重中之重”越来越重党中央、国务院把“三农”工作放在全党、全国和全部工作“重中之重”的位置。“重中之重”,一个在汉语词汇里已达极点的程度表述,旨在警世,意在醒世!“三农”问题的根本就是对农业文明的……吴国光:试论改革与二次改革时间是自在和连续的,而历史则呈现为人类活动对时间的切割1。从所谓新民主主义革命,到文化大革命中的无产阶级专政下继续革命,再到后来的改革,中国的当代史就是这样一个充满断裂的过程。……冼岩:中国的政治改革可以这样起步热衷于政治改革的部分中国知识分子,有鉴于在中国的政治传统和现实格局中罕有现代西方政治制度所必须的力量均衡,因此主张扩大地方权限、强化地方自治,以地方分权制衡中央集权。这就是所谓……徐勇:圈子下乡调查时,见许多农家民房前都有各种各样的围墙和围栏,将自己的家围在一个圈子里。夏天晚上在打谷场上乘凉,人们围在一起,谈天说地,自然形成一个圈子。村里开大会选举村领导,一些人随……李曦珍高红霞:西方民族主义的意识形态透视自近代以来,发端于西欧的民族主义在世界各国变成了一种影响力最强、影响面最广的社会思潮和意识形态之一,以至于此后的“任何社会运动或革命,如果不与民族主义结盟,就几乎不可能取得成功……徐贵:也看新自由主义当代西方新马克思主义的代表人物之一,也是当今世界最重要的批判性知识分子,美国人哈维,在他2010年写就的《新自由主义简史》一书导论的中写到:“将来的历史学家或许会把197819……李禄俊:保钓风云与台湾“党外”运动的滥觞今年中日钓鱼岛之争引发国内多城市、大规模的游行示威活动,期间发生的打砸抢烧事件引发国内外关心中国自由、民主的有识之士对极端爱国主义、民族主义、“义和团”式的盲目排外、文革重演的……传统马克思主义者为什么是错的?MoishePostone,德国法兰克福大学政治科学社会学博士,现任芝加哥大学历史系教授,长期从事社会理论,尤其是批判理论的研究与教学,其专著《时间、劳动与社会统治》于1993……殷辂:从民族主义走向中华主义民族主义是近代以来世界主导文化在民族问题上的表现。它的主要特点是将民族当成先验的绝对存在,以民族的“理性”代替人的理性,将民族利益视为判断是非的标准。强调整体精神,但却不能推己……徐勇:“两票制”和“两会制”是授权方式的一种重大转变(根据录音整理,未经审阅)这次非常高兴到随州来,感受到随州的民主之风给我们很多启示。随州的“两票制”到“两会制”对我们学习民主、研究民主提供了很好的理论资源,“两票制”和……徐勇:重建政治信任的有益探索读《乡村选举中的“两票制”》中国共产党由一个最初只有数十人的党,能够成为一个领导十几亿人进行现代化建设的大党,一个最基本的因素就是能够得到广大人民的充分信任和拥扩。而在我们党成为对外丌放和发展社会主义市场……陈子明:儒家思想与中国民主长期以来,许多人认为儒家思想妨碍了中国在20世纪实现民主转型。进入21世纪后,仍然有一部分“特殊国情”论者认为,在以儒家思想为主流的中国传统思想与现代民主制度之间存在着不可调和……
金启华:论杜甫的拗体七律杜甫的诗篇,现存一千四百五十余首,七律为一百五十余篇,占全诗的十分之一强。吾曾论杜甫的七律矣,涉及到他的拗体七律,然而未详也,兹篇则专论之。杜甫的拗体七律计十余篇,约占他……孙雪霄:论杜甫的歌引论当人们以诗歌统称各体诗作时,通常语义偏指诗这一概念,而很少有人关注诗歌一词中歌的蕴含所指,即使深究起来,也不过将之视为对诗这一文体所具备的优美韵律形式的一种赞美。事实……谢思炜:杜诗的自我审视与表现自传性是杜诗的一个基本特点。按照一些学者的意见,中国自序文体中塑造的自我有“为世排除之我”、“与众异质之我”、“众中杰出之我”、“劣于众人之我”、“想往如此之我”等各种类型,在……何国瑞:论杜甫仁民爱物的思想社会活动的主体能给历史以影响者很少。杜甫能成为世界文化名人,对人类产生着永恒性的“杜甫效应”,是由于其时代、家世、经历、个性形成了交汇的最佳结构,但起决定性作用的是其执着儒家理……蒋寅:文如其人?一、作为传统观念的文如其人在一贯高扬自我表现旗帜的西洋文学传统中,虽然自古就有“作诗与为人殊辙”的夫子自道,但作者与作品的一致性在新批评派出现以前似乎不成为问题。由于新批……蒋寅:王夫之对情景关系的意象化诠释王夫之是中国古代最富于辩证思维的哲学家,他的宇宙论秉承传统的二元观念而更强调其间的共生依存关系。他在《周易外传》中曾说:“天下有截然分析而必相对待之物乎?求之于天地,无有此也;……邓小军:杜甫《北征》补笺《北征》是杜诗煌煌巨制。对于了解杜甫和杜诗,具有举足轻重的作用。1962年,胡小石先生在《江海学刊》发表《北征小笺》,对《北征》的研究取得突破性成就。本文拟在《北征小笺》基础上……刘宁:杜甫五古的艺术格局与杜诗“诗史”品质杜诗何以为“诗史”,宋代以下,说者纷纭,而其中有一种意见很可注意。宋人胡宗愈云:“先生以诗鸣于唐,凡出处、动息劳佚、悲欢忧乐、忠愤感激、好贤恶恶,一见于诗,读之可以知其世。学士……吴逢箴:试论杜甫的民族观游国恩先生等主编的《中国文学史》在论述杜甫的思想时曾写道:“杜甫深受儒家思想的影响,但他从切身生活体验出发,对儒家的消极方面也有所批判。儒家‘严华夷之辨’,杜甫却在一定程度上摆……黄去非:杜甫入湘早期行踪及诗作编年杜甫自大历三年(768年)冬天由湖北境内进入湖南后,终其余年,再也没有走出湖南。杜甫流寓湖湘期间,到过很多地方,也写了很多诗。但杜甫都到过哪些地方?他的湖湘诗究竟应该如何编次?……蒋寅:孟郊创作的诗歌史意义从严格的意义上说,任何一位诗人都是一个独特的存在,任何一种风格和表现都有不可取代的价值。然而实际上,每位诗人、每种风格和艺术表现由于出现的时间不同,对于诗史的意义也是不一样的。……钟来茵:再论杜甫与道教1981年我写了《论杜甫与道教》,刊于黄河文艺出版社《文学论丛》第六辑。十多年来,我的研究又深入了一步,也积累了不少新的资料,故作此文。郭沫若先生在《李白与杜甫》中告诉读……
友情链接:中准网聚热点快百科快传网快生活快软网快好知文好找作文动态热点娱乐育儿情感教程科技体育养生教案探索美文旅游财经日志励志范文论文时尚保健游戏护肤业界