ISBN 9784274225345

Pythonデータエンジニアリング入門 : 高速化とデバイスデータアクセスの基本と応用

Pythonデータエンジニアリング入門 : 高速化とデバイスデータアクセスの基本と応用
出版社
オーム社
刊行
2020-04

概要

Pythonスクリプトの高速化とデバイス通信を実装レベルで習得する

想定読者

Pythonの基本文法は習得済みで、センサ・アクチュエータ制御や数値処理の高速化を実務に取り入れたい組込み・IoT・データエンジニア

こんな人には向いていない

  • Pythonをこれから学び始める初学者(本書は文法解説を持たず、高速化とデバイス制御から入る構成のため)
  • 機械学習モデリングやデータ分析パイプライン(ETL/ELT)を主目的とする読者(本書のデータエンジニアリングはハードウェアI/O寄りであり、クラウドDE文脈とは異なる)
  • すでにCython・NumPy・マルチプロセスを日常的に使いこなしているエンジニア(高速化の基礎章は既習者には冗長になる)

読了後にできるようになること

  • CPUアーキテクチャの基礎とPythonの実行モデルを踏まえた速度ボトルネックの特定方法
  • NumPy配列演算・C/C++モジュール呼び出し・マルチプロセス・Pythonコンパイル(Cython等)・GPU活用による段階的な高速化手法
  • USB・Bluetooth・有線LAN/Wi-Fiを介した外部デバイスとのデータ送受信の実装パターン
  • センサ信号の取得からアクチュエータ制御までのIoTデータアクセス全体像
  • データサイエンスを現場に適用するうえで必要なエンジニアリング層(高速化+デバイスI/O)の俯瞰的理解

本書のキー概念(章解説)

  • 第 1 章 データエンジニアリングとは — 本書が定義する「データエンジニアリング」の射程を最初に確認することで、クラウドDE文脈との差を早期に把握できる
  • 第 2 章 コンピュータエンジニアリングの基礎 — CPU動作原理の理解が後続の高速化章の根拠になるため、飛ばさず読む価値がある
  • 第 3 章 Intelの革新的なCPU — 最新世代の命令セット・キャッシュ構造の概説。実務での最適化選択肢を広げる背景知識
  • 第 4 章 デバイスデータアクセスの基礎
  • 第 5 章 単純な方法による速度改善 — まず試せる手法から始まる実践的な章構成
  • 第 6 章 NumPyの活用 — ベクトル演算への切り替えが高速化の最初の大きな改善点
  • 第 7 章 C/C++モジュールの呼び出し
  • 第 8 章 マルチプロセス
  • 第 9 章 Pythonのコンパイル — Cython等の活用法を解説。コンパイル型の高速化を手軽に試したい読者向け
  • 第 10 章 GPUの活用
  • 第 11 章 IoT実現に必要な機能
  • 第 12 章 USBを用いたデータ転送
  • 第 13 章 Bluetoothを用いたデータ転送
  • 第 14 章 有線LAN・Wi-Fiを用いたデータ転送
  • 第 15 章 センサ信号処理と制御例 — 取得から制御まで一気通貫の具体例が示されており、組込み寄りの読者が最も参照するユースケース

ハイライト

  • データエンジニアリングは、データサイエンスを現実に意味のある形に使えるようにし、実装・運用できるようにすることを指します。(本書が「データエンジニアリング」という語をどう定義しているかが端的に示された箇所。クラウドDEとは文脈が異なることを読者が即座に判断できる)

編集メモ

Qiita言及記事0件(ISBN直接参照・書名フレーズ検索ともにヒットなし)。楽天ブックスに在庫あり・Kobo電子書籍版同時提供だが、外部シグナルが限定的なため補完的な選択肢と判定

読む前に押さえておきたいこと

  • Pythonの基本文法(変数・関数・クラス・ライブラリのimport)を一通り書いた経験
  • NumPyの配列操作の初歩(本書の高速化章はNumPy知識を前提として積み上げていく)
  • OSの基礎概念(プロセス・スレッド・メモリ)の雰囲気を知っていると高速化章の理解が深まる

学習のコツ

  • 高速化に関心がある読者は第2章(コンピュータ基礎)→第5〜10章(高速化手法)を先に通読し、デバイス通信章(11〜15章)は必要に応じて参照する読み方が効率的
  • NumPy経験者は第6章を確認用に流し読みし、第7章(C/C++呼び出し)から重点的に読むと新しい学びが多い
  • IoT・組込み系エンジニアは第4章と第11〜15章を優先し、高速化章は処理速度の課題が生じた時点で戻る形が実務に合いやすい
  • 巻末のサポートリポジトリ(github.com/ohmsha/MHBooks)にサンプルコードが整備されており、手元環境で動作確認しながら読み進めると理解が定着しやすい
出版社による内容紹介

データサイエンスを実応用するための基本を押さえる! データエンジニアリングは、データサイエンスを現実に意味のある形に使えるようにし、実装・運用できるようにすることを指します。 データサイエンスを機器や分析に実応用するためには、Pythonスクリプトの高速化の知識や、センサ信号の取得、アクチュエータ制御に必須となる通信、インタフェース駆動といった外部デバイスとのデータアクセスの基本と応用についてのスキルの修得が必要となります。本書は、これらのデータをエンジニアリングするための入門的な知識を解説するものです。

この本がどの学習段階で役立つかは、 関連する ロードマップ から確認できます。

質問に答えるだけで、
あなたに合う専門書が見つかる

IT・デザイン・士業・医療・経理・教育・研究 ほか、あらゆる分野の専門書と 「読む順序」(学習ロードマップ)を収録。何を選べばいいか分からなくても、 いくつかの質問に答えるだけでたどり着けます。