春秋时代作为中国古代历史发展的重要转型时期,经济、政治、文化等各领域都发生了急剧的变革.研究这一时期社会变迁,对于阐释中华文化的历史渊源、发展脉络、基本走向,建构中国特色社会主义传统文化观皆有非常重要的意义和价值.文章以《左传》为语料来源,以文本挖掘为手段分析春秋社会演变规律,借助社会变迁相关理论对春秋时代进行结构、表现及动力等不同维度的描述,进而从文本分析的角度构建对应的量化指标.通过融合词频分析、聚类分析、时间序列分析、社区结构挖掘等多种文本挖掘技术,实现各项量化指标的计算.实验结果表明,研究设计的文本计算方法较好地描述了春秋社会结构演变、演变动力及演变表现,与人文学者研究结果基本一致.对于人文计算的开展具有一定理论价值与实践意义,但在模型构建、特征挖掘的方法以及结果评价方面仍有待进一步提升.
[目的/意义]在人文计算迅速发展的背景下,利用文本挖掘技术对《左传》进行聚类计算,为春秋时期社会发展状况的主题挖掘等定量分析提供参考,同时对典籍文本多维度重组和分析也具有一定的借鉴意义.[方法/过程]采用文本聚类方法对《左传》进行多维度的定量分析,打破《左传》线性的编年体记载顺序,先运用词匹配算法从《左传》特征词语料中得到各个诸侯国语料,再将LDA主题模型先后用于处理《左传》特征词语料和选取的诸侯国语料,最后结合时间信息进行主题强度计算.[结果/结论]实验结果表明,根据主题-词分布可以挖掘出春秋时期社会和诸侯国各方面的发展内容,通过主题强度变化曲线可以总结出春秋时期社会和各诸侯国的各方面发展态势.通过LDA主题聚类方法最终展现出了春秋时期整个社会以及不同诸侯国在战争、政治及外交等的发展变迁.
〔Abstract〕 This paper tries to build a semantic description model for scientiifc experimental data. It takes rice gene experiment data as an example and extracted the related information from research literature, user interview and related thesarus. The core metadata was acquired by the abstraction of knowledge about core area and the relationship between different knowledge. Then the semantic description model of scientiifc experimental data was constructed by mining and multiplexing of metadata. Finally, semantic mapping and pattern transformation was achieved based on the d2rq Mapping language and the open source software called d2r server was used. This paper realized the integration and development of agricultural scientiifc data resource by the descriptive semantic model.
文章在对科学实验数据建立描述模型的基础上,通过对相关的科学实验描述本体的复用和扩展,构建以科学实验描述本体为基础的科学数据组织模式.采用RDF格式存储科学实验相关元数据,深入挖掘和揭示了科学数据中各类资源对象的语义内涵与关联关系,将与科学实验数据相关的科研机构、文献数据库以及科研成果等外部信息进行有效语义关联,建立了动态的、开放的科学实验数据知识组织模式.