Nửa trên là dây chuyền dữ liệu lớn: thu thập bản ghi thô, làm sạch (bỏ bản trùng, bản thiếu trường, bản sai định dạng) rồi mới phân tích; học sinh kéo số bản ghi và mức lọc để thấy số bản ghi dùng được và độ tin cậy của kết quả đổi theo. Nửa dưới là hệ đề xuất chạy từng vòng: máy luôn gợi ý chủ đề em hay xem nhất, mức quan tâm tăng lên, độ đa dạng tính bằng entropy tụt dần và bong bóng thông tin hình thành; kéo mức khám phá lên thì bong bóng vỡ ra.