田中慎司のレビュー一覧
-
Posted by ブクログ
Web開発者のための大規模サービス技術入門
データ構造、メモリ、OS、DB、サーバ/インフラ
著:伊藤 直也
著:田中 慎司
Webシステムを、大規模化、いわゆるスケールアウト、スケールアップしていくと、小規模では顕在化しなかった様々な問題が起きてくる。それをどう解決するかを解いた指南書が本書である
スケールアウトとは、システムの台数を増やすことによって全体システムの性能を維持する方法
スケールアップとは、1台1台のシステムを高性能化していくことによって性能を改善する方法
大規模化することによって生じる不具合
・検索や表示の速度が遅くなる
・DBを分散させると、データの同期がとれなくなってくる
・系全体が大規模化すると、ネットワーク通信に遅延が生じる
・サーバが100台以上になると、どのサーバーが何の役割をしているのかわからなくなってくる
・開発や運用が大変、一人ではどうにもならない
■開発 言語、DB、ミドルウエア、フレームワークを統一する
■大規模データ処理 メモリとディスクの速度差、転送速度、バス、OSチューニング
■負荷分散 CPU負荷、I/O負荷
■大規模データ OSキャッシュ、分散RDB,アルゴリズムとデータ構造
■DBスケールアウト インデックス、レプリケーション、探索アルゴリズム
■インフラ クラウド、負荷の把握、チューニング、ネットワーク
■運用 冗長性の確保、システムの安定化、Hadoop
目次
本書について
本書の構成
講義
第1回 大規模Webサービスの開発オリエンテーション
第2回 大規模データ処理入門
第3回 OSのキャッシュと分散
第4回 DBのスケールアウト戦略
第5回 大規模データ処理“実践”入門
第6回 “課題”圧縮プログラミング
第7回 アルゴリズムの実用化
第8回 “課題”はてなキーワードリンクの実装
第9回 全文検索技術に挑戦
第10回 “課題”全文検索エンジンの作成
第11回 大規模データ処理を支えるサーバ/インフラ入門
第12回 スケーラビリティの確保に必要な考え方
第13回 冗長性の確保、システムの安定化
第14回 効率向上作戦
第15回 Webサービスとネットワーク
特別編 いまどきのWebサービス構築に求められる実践技術
索引
ISBN:9784774143071
出版社:技術評論社
判型:A5
ページ数:352ページ
定価:2580円(本体)
2010年08月05日 初版第1刷発行 -
Posted by ブクログ
2008年の本。オンプレ全盛の時代なので、いまだとまた変わりそう。当時はこういった構成で対応していたのが、いまのクラウドアーキテクチャに当てはめるとこう変わるかな、と考えて読むと楽しい。
・サーバ/インフラ構築入門
冗長化/負荷分散の基本
・ワンランク上のサーバ/インフラの構築
冗長化、負荷分散、高性能の追求
・止まらないインフラを目指すさらなる工夫
DNSサーバ、ストレージサーバ、ネットワーク
・性能向上、チューニング
Linux単体ホスト、Apache、MySQL
・省力運用
安定したサービスへ向けて
・あのサービスの舞台裏
自律的なインフラへ、ダイナミックなシステムへ -
Posted by ブクログ
とても勉強になります。,「どうすればいいの?」という疑問に対して具体例で答えてくれる本です。,,【学んだこと】,○リバースプロキシ,○DNSの負荷分散, クライアントのリゾルバに複数記載する方法はダメ。, タイムアウトを待ってしまうため、システム停止じゃないが反応が遅くなってしまい, 問題がややこしくなる。,○VLAN, ポートVLANは設定が簡単だけど、複数のスイッチにまたがることができない。, タグVLANは柔軟に設定ができるが、全ての機器がタグVLANに対応していないといけない。,○構成はシンプルにすること,○負荷とは?, CPU負荷とI/O負荷に分けることができる。, 負荷を知ることはOSを知ること,○サービスの稼働監視, Nagios,○リソースモニタリング,○サーバ管理の効率化,○デーモンの稼動監視,○リモートメンテナンス
-
Posted by ブクログ
ネタバレフォトリーディングNo.68
目的:インフラのポイントをおさえる
トリガーワード:冗長化、障害、故障、サーバ、ロード場ランサ、DNSラウンドロビン、負荷分散、リバースプロキシ、キャッシュサーバ、レプリケーション、スレーブ、フェイルオーバー、サーバーファーム、VLAN、チューニング、ログ、リバースプロキシ
質問:①チューニングのコツは?
②DNSラウンドロビンとは?
③キャッシュサーバとその効果は?
~20120716ポストレビューここまで~
~20120717アクティベーションここから~
質問に対するまとめ:
①推測&計測。CPUとI/Oのどちらがボトルネックかを探る。
②1つのFQDNに複数のIPを振って分散
③あるクライアントがダウンロードしたサーバのドキュメントを、別のクライアントにもキャッシュを有効にする
雑感:知らないことが多いがわかりやすい。 -
Posted by ブクログ
技術評論社から出版されているこのWEB+DB PRESS plusシリーズは、実際に稼動しているサービスの内部実装について細かく解説しているので、敷居は高いものの非常に重要かつ実践的な内容が書かれているので非常に面白かったりします。
本章のポイントはざっくりいって3つ。一つは、SE業務というと普通の人はプログラミングが例となる論理的な部分をイメージすると思うけど、実際にサーバを稼動するときに大事なのは、それ以上にサーバを「物理的に」どう配置するかが重要だという事。ネットワークの構成、冗長化、機能分散といった部分は、技術の進歩によって確かに論理的に分散させる事も可能になってきているけど、やはりまずは物理的な構成に依存していることは避けられないというのは、以外と見過ごされている部分です。
二つ目が、サーバの不可分散について。近年も右肩上がりに続いているCPUの性能向上によって、もはや1個のプロセッサで1台のOSでは寧ろパフォーマンスが余りがちという自体も発生する状態においては、装置の不可状況を適切に見極め、チューニングしていく技術がますます重要になっている。そして、これについては「推測するな、計測せよ」。この言葉にすべて集約されているでしょう。
最後は、はてながこれらの構成や不可状況を見極めた上で、実際にソフトウェアを走らせサーバを稼動させるのだけど、そのソフトウェアは「全て」OSS、無料で公開されているのを使っているという事。これについては以前も他の本で述べてるけど、やはりIT業界はアプリケーションやソフトではなく、それらを用いて提供するサービスやインフラが「商品」となっているのが主流となっていくのでしょうか。