クラスターの作成
クラスターを作成する方法は3つあります。これらは組み合わせることもできます。たとえば、検索から作成したクラスターとファイルからアップロードしたクラスターを組み合わせ、その結果を3つ目のクラスターとして保存できます。
検索結果から作成
検索を実行し、結果の上にある クラスター ボタンを押します。ドメイン名が重複を除いて新しいクラスターとして保存されます。検索で同じサイトの複数のページが見つかった場合も、クラスターにはそのサイトが1回だけ含まれます。
これが通常の出発点です。今すぐクラスターが必要でなくても作成しておく理由があります。インデックスは日々更新され、先月時点のインデックスに対して検索をやり直すことはできません。クエリを実行した時点で何が返されたかを記録できるのは、クラスターだけです。
ファイルから作成
ドメイン、URL、メールアドレスのリストをアップロードします。各行はドメインに変換され、PublicWWWが把握しているドメインだけが保持されます。インデックスにないドメインは閲覧も抽出もできないため、中身のない名前として保存するのではなく、除外されます。
これは逆方向の使い方に便利です。クエリから始めるのではなく、自社の顧客、競合、見込み顧客のリストから始めて、そのクラスターで検索結果を絞り込めます。
他のクラスターから作成
ブール演算を使うと、既存の2つのクラスターから新しいクラスターを作成できます。
| 演算 | 結果 | わかること |
|---|---|---|
| AND(積集合) | 両方に含まれるサイト。 | 両方を使っているのはどのサイトか? |
| OR(和集合) | いずれかに含まれるサイト(重複なし)。 | いずれかのバージョンを使っているすべてのサイト。 |
| 差分 | 1つ目に含まれ、2つ目に含まれないサイト。 | 使わなくなったのはどのサイトか?前回以降に新たに加わったのはどのサイトか? |
時間をまたいだ差分こそが、クラスターを単なる保存リスト以上のものにしています。今日クエリの結果を保存し、次回のPublicWWWの更新後にもう一度保存して、どちらかの方向に差し引きます。一方向ではシグネチャを導入したサイトが、逆方向では使わなくなったサイトがわかります。具体的な手順はウィジェットの変更を追跡で解説しています。
クラスターの読み出し
どのクラスターも、画面上でページごとに閲覧したり、ファイルとしてダウンロードしたり、別の演算の入力として使ったり、含まれるサイトのコンテンツを抽出したりできます。
次へ 抽出