R语言数据去重

R语言常用的去重命令有unique duplicated

unique主要是返回一个把重复元素或行给删除的向量、数据框或数组

> x <- c(3:5, 11:8, 8 + 0:5)
> x
[1] 3 4 5 11 10 9 8 8 9 10 11 12 13
> unique(x)
[1] 3 4 5 11 10 9 8 12 13
> unique(x, fromLast = TRUE)
[1] 3 4 5 8 9 10 11 12 13 #排序后的

> a
[,1] [,2] [,3]
[1,] 1 2 3
[2,] 1 2 4
[3,] 1 3 5
[4,] 1 2 3

> unique(a)
[,1] [,2] [,3]
[1,] 1 2 3
[2,] 1 2 4
[3,] 1 3 5 #去除重复的最后一行

duplicated主要是判定向量或数据框中的元素是否重复，它返回一个元素（行）是不是重复的逻辑向量

> duplicated(a)
[1] FALSE FALSE FALSE TRUE # 返回一个是否重复的逻辑判断

> a[!duplicated(a),]
[,1] [,2] [,3]
[1,] 1 2 3
[2,] 1 2 4
[3,] 1 3 5 #去除重复的最后一行

如果把第二列有重复的去除，则需要加一个索引

> index <- duplicated(a[,2])
> index
[1] FALSE TRUE FALSE TRUE
> a[!index,]
[,1] [,2] [,3]
[1,] 1 2 3
[2,] 1 3 5

相关阅读:
关于在ubuntu12.04图形界面下不能从root用户直接登录的问题
error: stray '357' in program
关于gcc -o 的使用问题
如何解决程序退出重启后不能绑定端口的问题？
使用Ubuntu12.04登陆账户时，输入密码是正确的，但是图形界面闪一下后就又回到登陆页面了
如何在linux系统中设置严密的密码策略（译文）
sqlite3数据库归纳
Bing地图切片原理
CSS技巧
jQuery.extend方法和开发中变量的复用

原文地址：https://www.cnblogs.com/nkwy2012/p/8082330.html