ラベル R の投稿を表示しています。 すべての投稿を表示
ラベル R の投稿を表示しています。 すべての投稿を表示

2012年5月29日火曜日

文字コード

UTF-8形式のテキストファイルをRで読み込んだら、日本語が文字化けして、右往左往。

結局、
options(encoding="UTF-8")
としてから、読み込めばよいらしい。


2012年5月28日月曜日

重複順列

Rの重複順列のやり方のメモ。

> #####
> ### 必要なパッケージ
> library(gtools)
>
> #####
> ### 重複順列を実行する(たとえばNΠk)
> permutations(n=2, r=3, repeats.allowed=T)  #N=n, k=r
     [,1] [,2] [,3]
[1,]    1    1    1
[2,]    1    1    2
[3,]    1    2    1
[4,]    1    2    2
[5,]    2    1    1
[6,]    2    1    2
[7,]    2    2    1
[8,]    2    2    2
>

2011年12月9日金曜日

負の二項分布でGAM

目的変数が負の二項分布に従うと仮定した一般化加法モデル(GAM)をするにはどうすればよいのかと思っていたら、Rのヘルプにそれっぽいことが書いてあった。
http://127.0.0.1:24616/library/mgcv/html/negbin.html

gam関数(library(mgcv))の中のfamilyをnegbin(theta, link = "log")にすればよいみたい。
thetaは自分で指定するのだけど、2つの値を入れるとその間で最適なthetaを探してくれるらしい。
例えば、こんな感じにする。
family=negbin(c(1,10))

さて、この方法でうまく解析できるかな?

2011年11月9日水曜日

Rに全パッケージを追加する

Rに全パッケージを追加する方法らしきものを見つけたのでメモ。

追加パッケージをなんでもかんでも追加する


方法はこんな感じ(上記サイトからの引用)

## 1. CRANから一覧を入手
packs<-available.packages(contriburl=contrib.url("http://cran.md.tsukuba.ac.jp/"))

# 2. 一覧をもとにダウンロードとインストール
install.packages(packs[,1],contriburl=contrib.url("http://cran.md.tsukuba.ac.jp/"))


追記(2013/11/5)
こういうやり方もOKみたい。
availablePackages <- available.packages()[,1]
install.packages(availablePackages)

2011年4月6日水曜日

Notepad++でR

Notepad++でRを使うためのメモ(正しいかは不明)


Notepad++: インストール
http://sourceforge.jp/projects/notepad-plus/

NppToR: これもインストール
http://sourceforge.net/projects/npptor/

※追記(2012.3.15)
NppToR-2.6.0はなぜかインストールできなかった。
とりあえずNppToR-2.5.4なら大丈夫そう。
http://sourceforge.jp/projects/sfnet_npptor/downloads/npptor%20installer/NppToR-2.5.4.exe/


R.api: Notepad++の[plugins]->[APIs]に入れる  ※自動補完のため
http://www.stat.tamu.edu/~aredd/files/R.api

R.xml: Notepad++の[plugins]->[APIs]に入れる ※自動補完のため
http://sourceforge.net/projects/npptor/files/R%20auto-completion/


  • 設定→環境設定→自動保存・入力補完の設定を忘れない
  • スタイル設定で、フォント名:MS UI Gothic、フォントサイズ:12、フォント名・フォントサイズを他のスタイルに適用をチェック(このあたりの設定は好み)
  • コードをRに送るのはF8
  • なんかいろいろ設定があるみたいだけど、とりあえずNotepad++とNppToRをインストールすれば使えるみたい(使えるというのはRと連携できるという意味)


参考ページ
http://akka2.jugem.jp/?eid=40
http://akka2.jugem.jp/?eid=150
http://d.hatena.ne.jp/phosphor_m/20100121/1264035654

2010年12月26日日曜日

GAMの作図

GAM(一般化加法モデル)の結果をplot()したときの予測値がどう算出されているのか分からず、ずっともやもやしていたけど、何となく解決した。

とりあえず、plot()をして出てくる図のy軸は、
「線形予測子を正規化した値」
であることが判明。

Rで書くと、
scale(result$linear.predictor, scale=F)
あるいは、
result$linear.predictor - mean(result$linear.predictor)
とも書ける。
※resultはgam()の結果


では変数が二つ以上ある場合は、どうなっているのか?
これはどうやら注目しない変数を固定して求めているっぽい。
たとえば、y~x0+x1でx0の図を書くときは、x1の値は0とかに固定した上で予測すると結果が一致する。
(最後に正規化するので、x1はどの値に固定しても関係ない)

実際にやるには、以下のようなイメージ
dat.x0 <- data.frame(x0, x1_0) #x1を0に固定したデータセット
pre.x0 <- predict(result, dat.x0, type="link")
plot(x0, scale(pre.x0, scale=F))

散布図と重ねるにはどうすればよいのだろう?