データを CSV か JSON で持ち出す
統計ページには、CSVと表示されたリンクがあり、その隣にJSONと表示されたリンクがある。これらはカウンターの数字をファイルとして渡す。アカウントは不要、申請フォームも不要、ダウンロードリンク付きのメールを待つ必要もない。
この投稿は主に、そのリンクがそもそもなぜそこにあるのかについて書く。
何が得られるか
CSVは、日付、ヒット数、ユニーク訪問者数、ボット数の4列からなる、1日1行のデータを渡す。設定を一切いじらなくても、どの表計算ソフトでも開ける。これがこの形式を選んだ理由のすべてだ。
JSONは同じ日次データに加えて、内訳も渡す。国別、都市別、ブラウザ別、画面サイズ別、そして最もアクセスの多いページに加え、ファイルがいつ生成されたか、どの期間を対象としているかという情報も含まれる。
どちらも期間を指定できる。3か月分なら&days=90を追加すればよく、400までの任意の日数を指定できる——これは統計そのものが保持される期間と同じだ。指定しない場合は直近30日分が得られる。
ただのアドレスに過ぎない
このエクスポートはただのURLであり、URLを取得できるものなら何でも取得できるということだ。週に一度、数字を表計算ソフトに読み込みたい場合でも、400日より前まで遡る独自のアーカイブを保持する小さなスクリプトを組みたい場合でも、ここには何の障害もなく、キーも一切必要ない。
これは意図的な設計だ。人間がブラウザでクリックしたときにしか機能しないダウンロードボタンは、一度しか使われないように作られたダウンロードボタンである。
含まれていないもの
正直に言っておく価値がある。これは、統計ページがすでに表示しているのと同じデータだ。隠されたより豊富な層が新たに解放されるわけではない。このエクスポート機能が存在するのは、データを持ち運び可能にするためであって、より完全なものにするためではない。
とりわけ、訪問者単位のデータは一切含まれていない。訪問者単位のデータをそもそも保持していないからだ。再訪を区別するための日次ハッシュは2日後に削除され、ファイルには含まれない。エクスポートできるのは、実際に存在するもの——グループ化された件数——だけだ。
なぜわざわざ用意するのか
立ち去れることが前提だからだ。
利用者の履歴を人質に取るサービスは、品質によって引き留めているのではなく、一からやり直すコストによって引き留めているにすぎない。それは誰かがそこに留まる理由としては貧弱であり、意図的にそう作ることはさらに貧弱なことだ。
訪問者の履歴はカウンターの持ち主のものだ。それを持って別の場所へ移ることは、まったく理にかなった行動であり、そのための仕組みが、サイトの中で最も手入れの行き届いていない部分になっていてはならない。