栞/#system
- 2010年4月
Twitterのスケールの仕組み。「途方もないスケールのデータをつないでいるにも関わらず、0.1秒以下でWebページの表示を完了させなければならない。そのために各データストレージは 1〜5ms程度で応答しなければならない。」
- 2010年3月
Amandaの使い方。
バックアップツール。S3とかにもできる。
Varnishの状況をCactiでモニタリング。
Varnishの設定とか。
LVS+keepalivedの組み合わせ。
NRPEの使い方。Nagiosからリモート監視を行うために。
DRBDを監視できるNagiosプラグイン。
DNSの仕組み。
管理/監視ツールを手製のもので間に合わせる。「監視とは継続的なテストである」は名言。
- 2010年2月
「TCP: Treason uncloaked!」について。
DELL R610でCentOS 5.3を仕様しているケースでネットワークがダウンする現象あり。bnx2ドライバーが原因の模様。 http://twitter.com/megapod/status/9408788879 も参照のこと。
「When a service with limited resources, such as Memcached, is taxed to its limits, requests begin contending with each other for Memcached's computing time. For example, if Memcached can only handle 10 requests at a time but it gets 11 requests at time, the 11th request needs to wait in line to be
kernel panicとkernel oopsが起きた場合に自動的に再起動させる。また、netconsoleを使ってkernel messsageをリモートホストで採取。
TwitterのBitTorrentを利用したデプロイツール、Murderの紹介記事翻訳。
BitTorrentの技術を利用してたくさんのサーバーにデプロイ。
PHPで簡単な監視スクリプトを。cronを仕掛けてエラー時はGmail経由で携帯電話に転送とか。
Tritonnのバックアップについて。MyISAMのバックアップと同様、LVMのスナップショットとか。
syslog-ngでマクロを使う。
ログ監視をswatchからsyslog-ngに切り替えてる。