1 週間で機械学習を始めることは信頼できるでしょうか?詳しい学習スケジュールはこちら

1 週間で機械学習を始めることは信頼できるでしょうか?詳しい学習スケジュールはこちら

[[185648]]

原著者 | ペル・ハラルド・ボルゲン

編集:魏子民、頼暁娟、張立軍

「初心者にとって、機械学習を始めるのは困難な作業のように思えるかもしれません。しかし、1 週間かけて機械学習の基礎を学んだ後、以前考えていたよりも簡単に理解できることがわかりました。」

この記事は Medium から引用したものです。著者は機械学習を始めるにあたって個人的に 1 週​​間を体験した後、機械学習を始めることに興味のある読者に使いやすい詳細なスケジュールを提供することを願って、その「下から上まで」の学習体験を皆さんと共有しました。

背景

機械学習の週を始める前に、私はこのテーマについてしばらく前から知っていて、Coursera の Andrew NG のコースの半分と他の理論的なコースをいくつか受講していました。まだ自分の知識を完全にコードに変換することはできませんが、機械学習の一般的な概念は理解しています。これもまた、私が変化を遂げるきっかけとなったのです。

たとえ基礎の多くを省略し、ボトムアップアプローチではなくトップダウンアプローチを使用することになったとしても、週末までに機械学習の問題を解決できるようになりたいと考えていました。

Hacker News に相談した結果、Python の Scikit Learn モデルから始めるのが最適だと結論付けました。このモデルは豊富なアルゴリズムの選択肢を提供し、機械学習の実践をわずか数十行のコードにまで削減します。

月曜日: 例から学ぶ

今週の初めに、Scikit Learn のビデオ チュートリアルを探して、機械学習を使用して株式に投資する方法に関する Sentdex のチュートリアル ビデオを選択しました。このビデオにより、学習の次のステップに進むために必要な知識が得られました。

Sentdex チュートリアル ビデオの優れた点の 1 つは、インストラクターがデータ収集に関するすべての手順を示してくれることです。読み進めていくと、データの取得とクリーニングには実際の機械学習操作よりもはるかに長い時間がかかることがわかります。したがって、ファイルや Web ページからデータを取得するスクリプトを作成する能力は、機械学習の専門家になるために不可欠なスキルです。

その後もこの動画を何回か見ましたが、問題に行き詰まったときにとても役に立ちました。皆さんも何回か見ることをお勧めします。ただし、このチュートリアルはデータの取得に重点を置いているため、Web サイトからデータを取得する方法をすでに知っている場合は、このチュートリアルは最適ではない可能性があります。 Udacity の機械学習入門コースの方があなたには適しているかもしれません。

火曜日: 現実世界の問題への応用

火曜日には、学んだことを実際の問題の解決に活用できるかどうか試してみたかったのです。私が一緒にコードに取り組んでいた別の開発者がイングランド銀行のデータ視覚化コンテストに参加していたので、私は彼と協力して銀行が公開したデータセットを調べました。最も興味深いデータは、銀行が数千世帯を対象にお金に関するテーマで毎年実施している「家庭調査」に関するものです。

私たちが解決しようと決めた問題は次のとおりです。

人の教育レベル、年齢、収入がわかれば、コンピューターは性別を予測できるでしょうか?

私はデータセットをいじって、何時間もかけてそれをクリーンアップし、その後 Scikit Learn を使用してこの問題に最適なアルゴリズムを見つけました。

最終的に成功率は約 63% となり、あまり理想的とは言えません。しかし、機械は少なくとも、50% の成功率でコインを投げるよりもわずかに高い確率で推測することができます。

結果を見るとやる気が湧いてくるので、Scikit Learn の使い方を大まかに理解したら、ぜひ自分で試してみることをお勧めします。

これは、機械学習を使用して現実の問題を解決できることに気付く重要な瞬間です。

水曜日: ゼロから始める

さまざまな Scikit Learn モデルを試した後、線形回帰アルゴリズムをゼロから作成してみることにしました。私がこれをやりたいと思った理由は、コンピューティング エンジンがどのように動作するのか本当に理解していないと感じたからです。

幸いなことに、Coursera にはいくつかのアルゴリズムを実装する方法に関するコースがあり、このときに大いに役立ちました。より具体的には、線形回帰の基礎となる概念について説明します。

これは間違いなく最も強力な機械学習技術であり、「内部で」何が起こっているかを理解することを強制します。いつかこれを実行することを強くお勧めします。

作業が進むにつれて、より複雑な実装を書き直す予定ですが、それは Scikit Learn アルゴリズムを試してから行いたいと思います。

木曜日:実行に移す

木曜日に、Kaggle 入門チュートリアルの一部を実装し始めました。 Kaggle は、企業や組織が投稿した問題に対する解決策を提出できる機械学習コンペティションのプラットフォームです。

機械学習の理論的かつ実践的な理解が十分に得られた後でのみ、Kaggle を試すことをお勧めします。そうでなければ、報酬よりもフラストレーションが増すことになります。

Bag of Words チュートリアルでは、コンペティション プラットフォームにソリューションを提出するための各ステップをガイドするほか、自然言語処理プロセスのシンプルでありながら興味深い紹介も行います。チュートリアルを終えた後、自然言語処理プロセスにさらに興味を持つようになりました。

金曜日:新学期

金曜日は、Kaggle チュートリアルの作業を継続し、Udacity の入門機械学習チュートリアルも開始しました。まだ学習中ですが、とても楽しいです。

これは Coursera のコースよりもはるかにシンプルで、基礎となるアルゴリズムは含まれていません。しかし、より実践的で、Scikit Learn の使い方を教えてくれます。 Coursera の Octave でアルゴリズムをゼロから作成するよりも、アルゴリズムを現実世界に適用する方がはるかに簡単です。

進む

この 1 週間の経験はとても楽しかっただけでなく、機械学習が社会でどれほど役立つかを実感することができました。学べば学ぶほど、活用できる分野が増えていきます。

機械学習に興味があるなら、数日間または数晩かけて基本的な理解を深めることを強くお勧めします。

教材の重労働に取り組む準備ができていない場合は、実際の問題を解決することでできるだけ早く学習できるトップダウンのアプローチを選択できます。

ソース:

https://medium.com/learning-new-stuff/machine-learning-in-a-week-a0da25d59850#.qw3zmizf9

[この記事は51CTOコラムBig Data Digest、WeChatパブリックアカウント「Big Data Digest(id: BigDataDigest)」のオリジナル翻訳です]

この著者の他の記事を読むにはここをクリックしてください

<<:  人工知能技術の助けを借りて、人々は携帯電話を通じて皮膚がんを診断できるようになるかもしれない

>>:  Googleの人工知能学習により低ピクセル画像も鮮明に

推薦する

マイクロソフト、AIシステムツール「Counterfit」のソースコードを公開

最近、マイクロソフトは、開発者が AI および機械学習システムのセキュリティをテストできるように設計...

ディープラーニングのパイオニア、ヤン・ルカン氏、叱責を受けてツイッターを辞める「皆さんはもうすべて知っています。これからは何も言いません」

2週間に及ぶ「舌戦」の末、チューリング賞受賞者でフェイスブックの主任AI科学者であるヤン・ルカン氏...

多様性がAI戦略の成功の鍵となる理由

機械学習と人工知能に関しては、スキャンダルが後を絶ちません。過去数ヶ月、マイクロソフトのジャーナリス...

...

...

AIによる地震予測はテストで有望性を示す

人工知能の助けを借りて地震を予測する新たな試みにより、この技術が将来、人々の生活や経済への壊滅的な影...

...

AIメモリに与える8つの優れたオープンソースの無料ベクターデータベース

今年、AI大規模モデルの応用は爆発的な成長を遂げました。その中でも、LangChainやHaysta...

予測トークンの速度が2倍になりました! Transformerの新しいデコードアルゴリズムは人気がある、Alpacaチームより

アルパカチームの新たな研究は大ヒットとなっている。彼らは、モデルが 100 個のトークンを 1.5 ...

グラフニューラルネットワークが深くなるほど、パフォーマンスは向上しますか?

数十または数百の層を持つニューラル ネットワークの応用は、ディープラーニングの重要な機能の 1 つで...

3種類の動的ルーティングプロトコルアルゴリズムは、

ダイナミック ルーティング プロトコルには多くの種類があります。ここでは主に、RIP、OSPF、EI...

「アルゴリズム経済」はどのような新しいモデルやトレンドを生み出すのでしょうか?

2000年から10年間の発展を経て、中国のPC時代のインターネットは「交通経済」を生み出しました。...

...

...

自動運転車の運転分類と必要な処理能力

今後 20 ~ 30 年で、自動運転車 (AV) は私たちの運転習慣や輸送業界を変え、社会全体に影響...