citespace分析分成几个部分

2024-05-17

1. citespace分析分成几个部分

四部分
1、首先选择一个盘符,建立工程文件夹项目,建议不要存放在C盘!不要存放在C盘!不要存放在C盘!
2、下载分析数据,再知网高级搜索中选择相应设置。可以看到检索结果有20条。如果数据比较多的话,建议还是逐个筛选一下,尽量选择期刊质量高或者知名作者的论文。然后全选,导出Refworks。下载完成之后将其重命名为download_xxxx(这个自己定)放到之前建好的Citespace_data文件夹中。
3、导入数据
选择完成之后开始点击CNKI Format Conversion。在CNKI_output文件夹中,然后将这些转换完成的所有txt转移到CNKI_data。
4、新建工程
在新建工程这里,建议先使用Wos,如果出现错误,就重新建一个工程选择使用CSSCI再试一下。保存完成之后,在这里可以根据具体年份选择一下,如果不清楚年限的直接点go就行了。

citespace分析分成几个部分

2. 【01误区解读】知识图谱与文献计量你一定做错了~CiteSpace时区图

本文仅以该图为案例,其他软件如VOSviewer做的图也存在各种问题
  
 上图你一定很熟悉,利用CiteSpace软件制作的时区图(TimeZone)
  
 该图通过关键词出现年份进行排列,用以展示主题的演化过程
  
 具体原理可参考我之前的推文:《 CiteSpace的时区图谱含义详细解读 》
  
  但是,该图存在一个致命问题 
  
 这个问题在以前并不是问题
  
 而是随着期刊公开方式的变化而产生的
  
 以前,中国知网公开的期刊都是已经印刷完成的,已经有纸质版本了,所以文章的发表时间是确定的了
  
 但是,近年来随着期刊公开方式的转变,尚未印刷已经录用的文章会通过 网络首发 的方式进行公开,如下:
                                          
  当纸质版印刷后,再把网络首发删除,公开正式版本 
  
 现在 几乎每个期刊 都会通过 网路首发 公开自己刚刚录用的文章,这是非常好的事情,能够让读者及时了解到最新研究成果,打破了文章从录用到出版的时滞问题
  
 但是,网路首发的文章对于我们做文献计量与知识图谱就会存在致命问题
  
 为什么呢?
  
 因为网络首发的文章
  
  缺失时间 
  
  缺失时间 
  
  缺失时间 
  
  缺失时间有什么重要后果呢? 
  
 比如,我们做时区图,有一个关键词是【新型冠状病毒】,显然该词出现于2020年,但是由于缺失时间,CiteSpace会默认补充一个1990年或者其他年份,这就出现问题啦。
  
 同样针对研究前沿探测也会出现此问题
  
 另外,VOSviewer软件也具备时间-关键词叠加图,由于 网路首发 导致的缺失时间,该软件也会出现相应的问题
  
  上述缺陷会导致结果错误 
  
  而你可能并不知道 
  
  最终结果就是看着错误的图给出错误的解析 
  
 不知道你以前注意过此问题吗?
  
 可能并没有,也可能注意到了但不知道如何解决
  
  下面给出解决方案 
  
 中文数据利用 Data数据园软件 综合提取功能,看是哪篇文献缺失时间,然后回到原TXT文本里补充时间
  
 英文数据利用 WOS全字段挖掘软件 综合提取功能,看是哪篇文献缺失时间,然后回到原TXT文本里补充时间
  
  关注[学术点滴]公众号获取更多资讯。
   
  
  这个数据预处理功能一定要重视