草庐IT

关于r:只总结一个组的某些级别[dplyr]

codeneng 2023-03-28 原文

Only summarise some levels of a group [dplyr]

我正在尝试(使用 dplyr)计算如何仅总结一个分组变量的一个级别,以保持所有其余部分相同。例如:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
library(dplyr)

dat <- starwars %>%
  select(height, hair_color) %>%
  filter(!is.na(hair_color))

dat %>%
  group_by(hair_color) %>%
  summarise(mean_height = mean(height))
#> `summarise()` ungrouping output (override with `.groups` argument)
#> # A tibble: 12 x 2
#>    hair_color    mean_height
#>    <chr>               <dbl>
#>  1 auburn               150
#>  2 auburn, grey         180
#>  3 auburn, white        182
#>  4 black                 NA
#>  5 blond                177.
#>  6 blonde               168
#>  7 brown                 NA
#>  8 brown, grey          178
#>  9 grey                 170
#> 10 none                  NA
#> 11 unknown               NA
#> 12 white                156

将总结 hair_color 的每个级别。但是我的问题是,如果我只想总结金发,而留下 hair_color 的所有其余级别怎么办?

我看到一个带有 split 的路径,如下所示:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
dat_split <- dat %>%
  mutate(is_blond = ifelse(hair_color %in% c("blond"),"blond","not_blond")) %>%
  split(.$is_blond)


d1 <- dat_split[["blond"]] %>%
  group_by(hair_color) %>%
  summarise(height = mean(height))
#> `summarise()` ungrouping output (override with `.groups` argument)

d2 <- dat_split[["not_blond"]] %>%
  select(-is_blond)


dat_final <- bind_rows(d1, d2)
dat_final
#> # A tibble: 80 x 2
#>    hair_color    height
#>    <chr>          <dbl>
#>  1 blond           177.
#>  2 none            202
#>  3 brown           150
#>  4 brown, grey     178
#>  5 brown           165
#>  6 black           183
#>  7 auburn, white   182
#>  8 auburn, grey    180
#>  9 brown           228
#> 10 brown           180
#> # ... with 70 more rows

然而,这似乎有点冗长(而且笨拙)。我想知道这是否是 rowwise 的工作,但我还没有完全解决这个问题。

  • 只是一个提示:您的 dat %>% mutate(is_blond = ifelse(hair_color %in% c("blond"),"blond","not_blond")) %>% split(.$is_blond) 可以简化为 dat %>% split(.$hair_color =="blond")


我们可以通过 replace 将 \\'height\\' 其中 \\'hair_color\\' 是 "金发" 到对应 \\' 的 \\'height\\' 的 mean头发颜色\\'

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
library(dplyr)
dat %>%
    mutate(height = replace(height,
          hair_color == 'blond', mean(height[hair_color == 'blond'])))
# A tibble: 82 x 2
#   height hair_color  
#    <dbl> <chr>        
# 1   177. blond        
# 2   202  none        
# 3   150  brown        
# 4   178  brown, grey  
# 5   165  brown        
# 6   183  black        
# 7   182  auburn, white
# 8   177. blond        
# 9   180  auburn, grey
#10   228  brown        
# a€| with 72 more rows

data.table 中会更紧凑(假设它是一个数字列)

1
2
library(data.table)
setDT(dat)[hair_color == 'blond', height := mean(height)]


你可以试试

1
2
3
4
dat %>%
  mutate(valid = hair_color =="blond") %>%
  group_by(valid) %>%
  mutate(mean_h = ifelse(valid, mean(height), height), .keep="unused")

1
2
3
4
5
6
7
8
9
10
11
12
13
14
# A tibble: 82 x 2
   hair_color    mean_h
   <chr>          <dbl>
 1 blond           177.
 2 none            202
 3 brown           150
 4 brown, grey     178
 5 brown           165
 6 black           183
 7 auburn, white   182
 8 blond           177.
 9 auburn, grey    180
10 brown           228
# ... with 72 more rows

有关关于r:只总结一个组的某些级别[dplyr]的更多相关文章

  1. ruby - 使用 RubyZip 生成 ZIP 文件时设置压缩级别 - 2

    我有一个Ruby程序,它使用rubyzip压缩XML文件的目录树。gem。我的问题是文件开始变得很重,我想提高压缩级别,因为压缩时间不是问题。我在rubyzipdocumentation中找不到一种为创建的ZIP文件指定压缩级别的方法。有人知道如何更改此设置吗?是否有另一个允许指定压缩级别的Ruby库? 最佳答案 这是我通过查看ruby​​zip内部创建的代码。level=Zlib::BEST_COMPRESSIONZip::ZipOutputStream.open(zip_file)do|zip|Dir.glob("**/*")d

  2. ruby - 使用 Vim Rails,您可以创建一个新的迁移文件并一次性打开它吗? - 2

    使用带有Rails插件的vim,您可以创建一个迁移文件,然后一次性打开该文件吗?textmate也可以这样吗? 最佳答案 你可以使用rails.vim然后做类似的事情::Rgeneratemigratonadd_foo_to_bar插件将打开迁移生成的文件,这正是您想要的。我不能代表textmate。 关于ruby-使用VimRails,您可以创建一个新的迁移文件并一次性打开它吗?,我们在StackOverflow上找到一个类似的问题: https://sta

  3. ruby-on-rails - Rails - 一个 View 中的多个模型 - 2

    我需要从一个View访问多个模型。以前,我的links_controller仅用于提供以不同方式排序的链接资源。现在我想包括一个部分(我假设)显示按分数排序的顶级用户(@users=User.all.sort_by(&:score))我知道我可以将此代码插入每个链接操作并从View访问它,但这似乎不是“ruby方式”,我将需要在不久的将来访问更多模型。这可能会变得很脏,是否有针对这种情况的任何技术?注意事项:我认为我的应用程序正朝着单一格式和动态页面内容的方向发展,本质上是一个典型的网络应用程序。我知道before_filter但考虑到我希望应用程序进入的方向,这似乎很麻烦。最终从任何

  4. ruby-on-rails - 渲染另一个 Controller 的 View - 2

    我想要做的是有2个不同的Controller,client和test_client。客户端Controller已经构建,我想创建一个test_clientController,我可以使用它来玩弄客户端的UI并根据需要进行调整。我主要是想绕过我在客户端中内置的验证及其对加载数据的管理Controller的依赖。所以我希望test_clientController加载示例数据集,然后呈现客户端Controller的索引View,以便我可以调整客户端UI。就是这样。我在test_clients索引方法中试过这个:classTestClientdefindexrender:template=>

  5. ruby-on-rails - 如果 Object::try 被发送到一个 nil 对象,为什么它会起作用? - 2

    如果您尝试在Ruby中的nil对象上调用方法,则会出现NoMethodError异常并显示消息:"undefinedmethod‘...’fornil:NilClass"然而,有一个tryRails中的方法,如果它被发送到一个nil对象,它只返回nil:require'rubygems'require'active_support/all'nil.try(:nonexisting_method)#noNoMethodErrorexceptionanymore那么try如何在内部工作以防止该异常? 最佳答案 像Ruby中的所有其他对象

  6. ruby - 为什么 SecureRandom.uuid 创建一个唯一的字符串? - 2

    关闭。这个问题需要detailsorclarity.它目前不接受答案。想改进这个问题吗?通过editingthispost添加细节并澄清问题.关闭8年前。Improvethisquestion为什么SecureRandom.uuid创建一个唯一的字符串?SecureRandom.uuid#=>"35cb4e30-54e1-49f9-b5ce-4134799eb2c0"SecureRandom.uuid方法创建的字符串从不重复?

  7. ruby-on-rails - 在 Rails 和 ActiveRecord 中查询时忽略某些字段 - 2

    我知道我可以指定某些字段来使用pluck查询数据库。ids=Item.where('due_at但是我想知道,是否有一种方法可以指定我想避免从数据库查询的某些字段。某种反拔?posts=Post.where(published:true).do_not_lookup(:enormous_field) 最佳答案 Model#attribute_names应该返回列/属性数组。您可以排除其中一些并传递给pluck或select方法。像这样:posts=Post.where(published:true).select(Post.attr

  8. ruby-on-rails - Rails - 从另一个模型中创建一个模型的实例 - 2

    我有一个正在构建的应用程序,我需要一个模型来创建另一个模型的实例。我希望每辆车都有4个轮胎。汽车模型classCar轮胎模型classTire但是,在make_tires内部有一个错误,如果我为Tire尝试它,则没有用于创建或新建的activerecord方法。当我检查轮胎时,它没有这些方法。我该如何补救?错误是这样的:未定义的方法'create'forActiveRecord::AttributeMethods::Serialization::Tire::Module我测试了两个环境:测试和开发,它们都因相同的错误而失败。 最佳答案

  9. ruby - 用 Ruby 编写一个简单的网络服务器 - 2

    我想在Ruby中创建一个用于开发目的的极其简单的Web服务器(不,不想使用现成的解决方案)。代码如下:#!/usr/bin/rubyrequire'socket'server=TCPServer.new('127.0.0.1',8080)whileconnection=server.acceptheaders=[]length=0whileline=connection.getsheaders想法是从命令行运行这个脚本,提供另一个脚本,它将在其标准输入上获取请求,并在其标准输出上返回完整的响应。到目前为止一切顺利,但事实证明这真的很脆弱,因为它在第二个请求上中断并出现错误:/usr/b

  10. ruby - 一个 YAML 对象可以引用另一个吗? - 2

    我想让一个yaml对象引用另一个,如下所示:intro:"Hello,dearuser."registration:$introThanksforregistering!new_message:$introYouhaveanewmessage!上面的语法只是它如何工作的一个例子(这也是它在thiscpanmodule中的工作方式。)我正在使用标准的ruby​​yaml解析器。这可能吗? 最佳答案 一些yaml对象确实引用了其他对象:irb>require'yaml'#=>trueirb>str="hello"#=>"hello"ir

随机推荐