RのWeb制作

Webサービス制作のための技術情報を。データ分析(Python、機械学習コンペ他)や自作野球ゲームMeisyoのこと中心。

データサイエンス SQL データサイエンスおすすめ教材紹介【Skill Stacks】

【教材紹介】10年戦えるデータ分析入門

投稿日:2022年1月16日 更新日:

何度でも言いたいことですが、データ分析をするための技術はSQLが一番良いです。
PythonやRよりも制限が少なく、ビッグデータを扱えるのはSQLです。
分析に触れる第一歩としてこの本はいかがでしょうか?

名称


10年戦えるデータ分析入門

著者

青木峰郎

概要

データ分析にはPythonやRという論調が多いですが、データサイエンス実務ではSQLの出番の方が多いのではないでしょうか。
テラバイト級データはSQLでは対応可能ですが、Pythonだけで分析をすることは困難です。

SQLでは技術的には様々な分析ができます。
本書では多種多様な分析の方法論を、実際に架空データを使いながら分析することでスキルの定着を図ります。

必要知識

パソコンの操作

得られるスキル

SQL, PostgreSQL, select, where, order_by, group_by, join, window関数, DWH, バッチ処理

その他の教材紹介ページはこちら → Skill Stacks

-データサイエンス, SQL, データサイエンスおすすめ教材紹介【Skill Stacks】

執筆者:


comment

メールアドレスが公開されることはありません。 が付いている欄は必須項目です

関連記事

【教材紹介】ディープラーニングを支える技術

近年目覚ましい発展を遂げた機械学習、ディープラーニング。その概要と技術の使い方を体系的に学ぶにはどの本がいいでしょうか? 私はこの本をお勧めします。 なぜなら、ディープラーニングについて、最先端の研究 …

[社内コンペ] 間取り予測

これは何? 某社で行われている社内コンペのメモです。私の備忘録でもあります。 結果:3位 精度:60.7% 今回は学習データが12,000件ほどあり、ある程度多いデータ量での学習ができました。 学習デ …

ゲームデータで学ぶSQL(初級編)

近年のデータサイエンスブームをきっかけに「SQLを学びたい」と思った方へ。 そう思ったところで、壁になってくるのは実データの入手です。 私は職業としてデータサイエンス関連の業務に従事していますが、キレ …

【教材紹介】異端の統計学ベイズ

今回はベイズ統計学の歴史書です。今でこそ、頻度論の統計学とベイズ統計学などをひとまとめにして統計学と言われていますが、そこに至るまでに何があったのか?そちらを詳細に記述する500ページ越えの大作です。 …

[Kaggle] Titanic 約80% by ランダムフォレスト

実力不足感が否めませんが、Kaggleのチュートリアル的なTitanicにおいてランダムフォレストで正答率約80%を出せたのでコードを載せておきます。 Colaboratory 実施期間:2019/0 …