統計コンサルの議事メモ

統計や機械学習の話題を中心に、思うがままに

2017-04-01から1ヶ月間の記事一覧

dplyr::filterの注意点

R

最近すっかりHadley信者になってしまいデータ加工にもdplyrをよく使っているのだけれど、filterで少し躓いてしまったのでメモ。まずは{dplyr}と{dtplyr}を読み込む: library(dplyr) library(dtplyr) やりたかった処理とは以下のようなもので、irisを例とす…

summaryの罠

R

年月を6桁の数値(YYYYMM)で表すために以下のように書いて何気なくsummaryを実行したところ、思わぬ挙動となった。 > Year <- rep(2012:2016, each=12) > Month <- rep(1:12, 5) > YM <- Year * 100 + Month > summary(YM) Min. 1st Qu. Median Mean 3rd Q…