G検定模擬試験set1 - 未解答
(ア)に最もよくあてはまる選択肢を 1 つ選べ.
機械学習による分析を行う際,カテゴリーデータをそのまま扱うのは非常に難しい.このため,これを数値に変換して扱いやすくすることが一般的である.
ドリンクのサイズ S, M, L などの順序を持つ文字列のカテゴリーデータの場合,それぞれの値に対応する数値を辞書型データで用意し,これを数値に変化する方法 (ア) を利用して変換を行うことがある.
また順序を持たない名義特徴量のカテゴリーデータについては,各変数に対応したダミー変数を新たに作り出す (イ) が有用である.
(ア)に最もよくあてはまる選択肢を 1 つ選べ.
機械学習の種類を大きく分類すると教師あり学習,教師なし学習,強化学習がある.ニューラルネットワークにもそれらに対応するものがある.例えば,教師あり学習には(ア),教師なし学習には(イ),強化学習には(ウ)などがある.
(ア)に最もよくあてはまる選択肢を 1 つ選べ.
機械学習の手法は学習の枠組みに応じて主に三つに分類することができる.
(ア)は入力とそれに対する出力のペアの集合を学習用データとする手法で,(イ)などが(ア)に含まれる.(ウ)は入力の集合だけから学習を行う手法であり,(エ)などが(ウ)に含まれる.最後に(オ)は,最終結果または連続した行動の結果に対して報酬を与え,報酬ができるだけ大きくなるような行動を探索する手法である.
(イ)に最もよくあてはまる選択肢を 1 つ選べ.
RNN は(ア)系列データの処理に長けているニューラルネットワークである.RNN は,(イ)勾配消失問題が起きやすいという特徴を持っていたが,RNN の一種である LSTM では(ウ)を含む LSTM Block を組み込むことで,長期間の系列情報に対しても勾配消失せずに学習を行うことができる.
人工知能の急激な進化により,様々なことが言われている.一つは,人工知能によって人類が危機にさらされるのではないかという議論である.2014 年のテレビインタビューにおいて「人工知能の進化は人類の終焉を意味する」と発言したのは以下の誰か.
(ア)に最もよくあてはまる選択肢を 1 つ選べ.
ニューラルネットワークには様々なモデルがあり,タスクによって適切な選択をする必要がある.例えば,画像を扱う際には(ア),自然言語処理などの系列データには(イ)がよく使われる.他にも次元削減には(ウ),画像生成には(エ)などが用いられる.
(解説あり)(イ)に最もよくあてはまる選択肢を 1 つ選べ.
ディープラーニングでの学習を効率的に行うにあたって,共有データセットの整備が徐々に進められている.しかしながら,現在広く普及しているものには,いくつかの問題点が指摘されている.
第一は, (ア) の問題である.現在は公正な利用がなされているとされているが,企業が共有データセットを利用して学習したモデルを自社のプロダクトに転用して売り上げを上げようとした場合に問題はないのかという議論が巻き起こっている.他の問題として,これは日本にとっての問題であるが,多くのデータセットが (イ) であることが挙げられる.これにより,日本固有の食べ物を認識しようとすると,それが全く別の国の食べ物としてのみ認識されるという不具合が生じるに至っている.
(ア)に当てはまらない選択肢を 1 つ選べ.
ディープラーニングのモデルは,確定的モデルと確率的モデルに分類することができる.これらのモデルの例として,確定的モデルに(ア)や確率的モデルに(イ)がある.
(ア)に最もよくあてはまる選択肢を 1 つ選べ.
機械学習において,重み更新に関わる単位として,(ア)と(イ)がある.(ア)は,重みが更新された回数であり,(イ)は訓練データを何回繰り返し学習したかを表す単位である.また一回の(ア)に用いるサンプル数は(ウ)と呼ばれる.
loading!!