Skip to main content

機械学習week2 / multivariate linear regression : 複数変数を持つ一次関数を扱う

week 1 では、以下の事柄に関して、一つの定数と一つの変数を持つ1次関数に関して検討をおこなった。つまり f(x) = 定数a + θ(:xの変数) * x の場合の検討である。
  1. const function
  2. const function の値が最小になるようにする = この場合が、最適な予想曲線となる
  3. cost function が最小になる θ を定める方法(gradient descent)
week2 ではこれを発展させ、一次関数だが、複数の変数を持つ場合についての検討をおこなう。

メモ blogger で数式を埋め込む方法

基本これを参照
http://latex.codecogs.com/eqneditor/integration/blogger/install.php

ガジェットを追加→<script type="text/javascript" src="http://latex.codecogs.com/latexit.php?p&li&div"></script>をコンテンツに追加

あとは本文に「$$」 で囲ったエリアに特定の様式で書けば OK

$X ={X_i^2}$
上記の式は、X ={X_i^2} を $$で囲ったもの

http://www.codecogs.com/latex/eqneditor.php
↑example からよく使うものはあるので、クリックして表示されるものを参考に入力

動画1

https://www.coursera.org/learn/machine-learning/lecture/6Nj1q/multiple-features
複数変数variable をもつ場合の、表記について

https://www.coursera.org/learn/machine-learning/supplement/WKgbA/multiple-features

${x_j^{(i)}}$ は、i番目のトレーニングサンプルの、j個目の特徴を表す。
${x^{(i)}}$ は、i番目のトレーニングサンプル全体を表す。
m はトレーニングサンプルの数
n は特徴量の数


複数特徴量を持つ一次式のは、次のように表すことができる
$h_{\theta}(x) = \theta_0 + \theta_1 x_1 + \theta_2 x_2 + \theta_3 x_3 + \cdots+ \theta_n x_n$

これはθのマトリックスとxのマトリックスの掛け算なので、次のように表せる

$h_{\theta}(x) = \begin{pmatrix}\theta_0 & \theta_1 & \theta_2 & \cdots & \theta_n\end{pmatrix}\begin{pmatrix}x_0\\ x_1\\x_2\\\cdots\\x_n\end{pmatrix}$

さらに、それぞれ以下のようなマトリックスと定義した場合、
$ \theta = \begin{pmatrix}\theta_0 \\ \theta_1 \\ \theta_2 \\ \cdots \\ \theta_n\end{pmatrix}$
$ x = \begin{pmatrix}x_0\\ x_1\\x_2\\\cdots\\x_n\end{pmatrix}$

$ \theta^T = \begin{pmatrix}\theta_0 & \theta_1 & \theta_2 & \cdots & \theta_n\end{pmatrix}$ なので、( $ \theta^T$ は $ \theta$のtransition = 転置)

$h_{\theta}(x) = \begin{pmatrix}\theta_0 & \theta_1 & \theta_2 & \cdots & \theta_n\end{pmatrix}\begin{pmatrix}x_0\\ x_1\\x_2\\\cdots\\x_n\end{pmatrix} = \theta^T x$ と表すことができる

このような場合のコストファンクション

動画2
https://www.coursera.org/learn/machine-learning/supplement/aEN5G/gradient-descent-for-multiple-variables

左側の画像は、以前扱った、変数が1つの場合のコストファンクション。
$\frac{\partial}{\partial \theta_0} J(\theta)$ は、$J(\theta)$ を $\theta_0$で偏微分したもの。


右上は、変数が1個以上の場合の一般化した式。

右下は、n=2 の場合の具体例。
特徴量n が2個ということは、当然 θ も2個ある。(θ0を入れたら3つ)
$x_1^{(i)}$は、特徴量の1番目のやつの、1番目のサンプルのこと。

Comments

Popular posts from this blog

1日目 シャンポリオン・シュリーマン・チャレンジとは

ト ロイ遺跡を発見したシュリーマン。彼は語学の天才だったということになっております。武器商人としてクリミア戦争で莫大な資産を築いた彼は、現在のトルコ、エーゲ海の東側で発掘を始めます。 そんなシュリーマンが古典語を学ぶために何をしたか。なんと、フランス語に翻訳された本と、古典語の本を並べて、両方暗記する。辞書は引かない。文法もやらない。という方法で学習したそうです。 本当でしょうか? 気になります。 そこで私も、イタリア語の村上春樹を手に入れましたので、これと英語版の村上春樹を並べて、スペイン語を勉強したいと思います。名付けて、シャンポリオン・シュリーマン・チャレンジ。 シャンポリオンはもちろん、あのヒエログリフを解読したフランス人です。彼は、ロゼッタストーンに併記された三つの文字、ヒエログリフ、それから古代エジプトでもヒエログリフよりも一般に使われていた文字、最後にギリシャ文字、この三つの文字を頼りに、ヒエログリフを解読しました。 今回、村上春樹の日本語と英語とスペイン語版を並べて、暗記する、というのを行なっていきますので、これはまさにシャンポリオンのヒエログリフ解読ではないかと!雰囲気的に!ということで、シャンポリオンシュリーマンチャレンジと名付けたいと思います。 さしあたって1日目のシャンポリオンシュリーマンチャレンジ、感想としては辞書を引きたい。文法書を読みたい。です。意味のわからない言葉の羅列を覚えるの、かなり厳しいですね。わかるようになる気配がない。 明日も頑張ろ〜🦀

8日目 やっぱり音読が暗記に効く

Utter 楽をしようとして、なんとなく字面だけで覚えようとしても、覚えれないことがわかりました。 そんなに面倒なことではないので、口に出して覚える。これをやはり実行した方が効果が高い。 3センテンス目で粘ってます。 明日もがんばろ〜🦀

83日目 習慣づくりについておすすめの本

ブログを書く頻度が下がってしまいましたが、なんだかんだでシャンポリオンチャレンジは83日続いてます。 今こうして様々な習慣が続いているのは、梅原大吾さんの「1日ひとつだけ、強くなる。」という本の影響が大きいと思うので、この本おすすめです。 内容を一言でまとめると、次のようになります。「昨日より今日、何か一つでも強くなっているのであれば、今日の自分が最強である。そしてそれが死ぬまで続けば、死んだときが最強である。」 まあ言ってることはありまえのことなのですが、やはり梅原さんのことをよく知っているので、説得力を感じます。少なくとも、ゴールドマン・サックスのコンサルタントよりも、テレビのタレントよりも、親近感があるので、その言葉に力を感じます。 この考え方のポイントは、やはり「昨日と今日という最小の単位だけに着目する」ということにあるように思います。 10年、1年、1ヶ月といった中長期的目標を立てることはもちろん大切なのですが、現実的には、当面一週間続ける、というハードルを超えることが一番難しく、私を含め多くの人が、中長期的な目標が有効になるレベルまで継続することができずに挫折してきたことでしょう。 まず立ち向かうべきは、単に「今日の自分だけ」なのだということを、梅原さんは明確にしています。他人ではなく、過去の自分でも、未来の自分でもなく、今日の自分にだけ勝てば、結果、最強だと。   今日ジュンク堂でみつけた「小さな習慣」という本は、これについてもっと明確に、科学的に、かつ体系的に説明した本で、非常に良い本だなと思いました。 端的に内容を言えば、「習慣化することが一番重要。そのためには、タスクの内容が非常に簡単で、気負うようなものではないものである必要がある。何故なら、達成が困難で精神的なハードルが高い習慣目標を立てた場合、習慣化できないからだ。」ということになります。 この本が説明していることで面白いと思ったのは「そもそも、目標が高いと、習慣化の妨げになるので、好ましくない」という点を強調しているところです。つまり、あまりに困難な習慣目標を立てるのは、そもそも戦略的に誤りだと。習慣化したいのであれば、当然クリアーできる簡単なものにするべきだと。 これは私も体感的に納得ができま...