栞/#db
NoSQLモデリング
削除フラグ、というか物理削除しないで残しつつ運用する仕組み
「コンシューマ向けサービスでは、データの検索・操作・集計の範囲が広範囲になることはない。または設計上で回避出来る」「DBサーバーは基本的にスケールアウト(サーバー増設する)が出来ない」
Twitter的なタイムラインの実装を考えてる
Twitterのスケール、QCon発表資料。
Twitterのスケールの仕組み。「途方もないスケールのデータをつないでいるにも関わらず、0.1秒以下でWebページの表示を完了させなければならない。そのために各データストレージは 1〜5ms程度で応答しなければならない。」
KVSの優位性、そしてRDBと違って諦めなければいけないこと。「レンジクエリが使えない場合、インデックス構造自体をKVS上の1レコードとして持つ必要がある」とか、トランザクションの有無とか。
スキーマが決まってないデータをどうDBにつっこむか。
MySQL Clusterの歴史、仕組み。
KVS比較。日本からはKaiが。MemcacheDBの評価高い。
バックエンドにBerkeley DBを使うmemcachedプロトコル互換のKVS。
PostgreSQLのクエリの処理状況を定期的に採取→解析。
CassandraのRubyからの使い方。Twitterで使うのかな。「We're beginning to use Cassandra at Twitter」
FacebookによるBigTableみたいなストレージ。
分散型のkey-valueストアについて。
likeでエスケープが必要な文字まとめ。
DWHとしてのMyISAM。バッチ処理が中心だから無問題。
データ/DB共有。http://www.computerworld.jp/topics/google/150389.html
LinkedInで使われてるkey-valueストレージ。
MySQLでセッション管理まとめ。「--single-transaction オプションを利用してdump 中にテーブルにロックをかけない」
key-valueストアとデータディクショナリ。DOAとか懐かしいな。
MySQL開発者が始めたMySQLのfork。