把一个向量分成若干块

我必须在r中把一个向量分成n个相等大小的块，我找不到任何基函数来做这个。谷歌也没帮上什么忙。这是我目前想到的;

x <- 1:10
n <- 3
chunk <- function(x,n) split(x, factor(sort(rank(x)%%n)))
chunk(x,n)
$`0`
[1] 1 2 3

$`1`
[1] 4 5 6 7

$`2`
[1]  8  9 10

当前回答

我需要一个接受数据参数的函数。Table(引号中)和另一个参数，该参数是原始data.table的子集中行数的上限。这个函数产生任意数量的数据。表的上限允许:

library(data.table)    
split_dt <- function(x,y) 
    {
    for(i in seq(from=1,to=nrow(get(x)),by=y)) 
        {df_ <<- get(x)[i:(i + y)];
            assign(paste0("df_",i),df_,inherits=TRUE)}
    rm(df_,inherits=TRUE)
    }

这个函数给出了一系列数据。命名为df_[number]的表，其起始行来自原始数据。表中的名称。最后一个数据。表可以很短，并且填满了NAs，所以你必须将其子集返回到任何剩下的数据。这种类型的函数很有用，因为某些GIS软件对您可以导入的地址引脚数量有限制。切片数据。不建议将表分成更小的块，但这可能是不可避免的。

2017-03-26 21:24:53

其他回答

这是另一种变体。

注意:在这个示例中，您在第二个参数中指定CHUNK SIZE

所有的块都是均匀的，除了最后一块; 最后一个最坏的情况是更小，永远不会比块大小大。

chunk <- function(x,n)
{
    f <- sort(rep(1:(trunc(length(x)/n)+1),n))[1:length(x)]
    return(split(x,f))
}

#Test
n<-c(1,2,3,4,5,6,7,8,9,10,11)

c<-chunk(n,5)

q<-lapply(c, function(r) cat(r,sep=",",collapse="|") )
#output
1,2,3,4,5,|6,7,8,9,10,|11,|

2013-09-14 16:41:11

我需要一个接受数据参数的函数。Table(引号中)和另一个参数，该参数是原始data.table的子集中行数的上限。这个函数产生任意数量的数据。表的上限允许:

library(data.table)    
split_dt <- function(x,y) 
    {
    for(i in seq(from=1,to=nrow(get(x)),by=y)) 
        {df_ <<- get(x)[i:(i + y)];
            assign(paste0("df_",i),df_,inherits=TRUE)}
    rm(df_,inherits=TRUE)
    }

2017-03-26 21:24:53

你可以像mdsummer建议的那样，结合split/cut和quantile来创建偶数组:

split(x,cut(x,quantile(x,(0:n)/n), include.lowest=TRUE, labels=FALSE))

这为您的示例提供了相同的结果，但不适用于倾斜变量。

2010-07-23 14:22:55

分割(x,矩阵(1:n, n,长度(x))(1:长度(x)))

也许这更清楚，但同样的想法: 分割(x,代表(1:n,天花板(长度(x) / n)、长度。Out = length(x))

如果你想对它排序，就对它进行排序

2010-07-23 16:30:26

不确定这是否回答了OP的问题，但我认为%%在这里可能有用

df # some data.frame
N_CHUNKS <- 10
I_VEC <- 1:nrow(df)
df_split <- split(df, sort(I_VEC %% N_CHUNKS))

2022-10-25 23:08:24

把一个向量分成若干块

推荐文章

最新文章

标签