R数据分析处理——按符号分割数据及统计两列数据组合的频数
发布时间
阅读量:
阅读量
初始数据格式解析
如图所示,数据格式中每个Keywords字段均包含若干关键词,各关键词之间通过分号(;)进行分隔。整体数据共分为ABCDEF六个组别,且存在关键词重复的情况。

最终想要的数据格式
对六个组别中所有不重复的关键词进行统计,计算其出现的频率。

R语言数据处理应用
rm(list = ls())
setwd("protein/")
library(xlsx)
# 根据自己的数据来处理
data <- read.xlsx("datapre/keywords.xlsx", sheetIndex = 1)
data <- data[, c(1,8)]
data$group <- c(rep("A", 14), rep("B", 11), r
全部评论 (0)
还没有任何评论哟~
