Bạn mua một nghìn click, nhưng số đơn về như thể chỉ mua một trăm. Một phần lượt truy cập là robot, một phần là người từ những quốc gia offer không nhận, một phần là lượt quay lại của cùng các địa chỉ. Lọc traffic là việc kiểm tra từng lượt truy cập trước khi nó tới offer, với quyết định «cho qua» hoặc «loại» kèm lý do rõ ràng.
Nói ngắn gọn, lọc traffic là chọn lọc các lượt truy cập từ quảng cáo theo mạng, trình duyệt, hành vi và quy tắc chiến dịch: bot, gian lận, lượt trùng, geo và thiết bị không đúng mục tiêu, công cụ spy bị loại hoặc bị gắn nhãn, còn khách thật đúng mục tiêu đi tiếp. Mục tiêu không phải cắt càng nhiều càng tốt, mà là không phải trả giá cho rác ở offer và trong số liệu.
Lọc traffic là gì và vì sao cần nó
Nền tảng quảng cáo bán click cho bạn, nhưng không đảm bảo sau mỗi click là một người thuộc tệp khách của bạn. Không có bộ lọc, toàn bộ hỗn hợp đó đổ vào landing page và vào thống kê. Hậu quả có ba:
- tiền: offer và mạng CPA thấy lượt truy cập rác, CR giảm, còn bạn đưa ra kết luận về bộ chiến dịch dựa trên số liệu đã hỏng;
- số liệu: bot để lại click, thoát trang và đôi khi cả đơn, báo cáo theo creative bắt đầu sai lệch;
- đối thủ: công cụ spy sao chép landing và creative nếu không có gì ngăn chúng.
Lọc traffic quảng cáo giải quyết cả ba bằng một lần kiểm tra. Với người làm affiliate, đây là phần bình thường của bộ chiến dịch, bên cạnh tracker và postback.
Bộ lọc traffic loại bỏ những gì
| Lọc gì | Trông như thế nào | Nguy hiểm ở đâu |
|---|---|---|
| Bot và crawler | mạng trung tâm dữ liệu, chương trình thay vì trình duyệt, robot tạo bản xem trước | thổi phồng click, làm hỏng CR |
| Gian lận và click tặc | chuỗi click từ cùng địa chỉ, botnet, click farm | tiêu ngân sách mà không có cơ hội chuyển đổi |
| Geo không đúng mục tiêu | quốc gia offer không nhận, VPN đổi quốc gia | đơn không được trả tiền |
| Thiết bị và giờ không phù hợp | desktop trên offer mobile, lượt truy cập ban đêm khi call center làm ban ngày | lead không có ai xử lý |
| Lượt trùng | click lặp và đơn lặp của cùng một khách | thổi phồng thống kê, bị mạng CPA cắt |
| Công cụ spy | dịch vụ thu thập quảng cáo và landing của người khác | sao chép bộ chiến dịch |
Mỗi nhóm được nhận diện bằng dấu hiệu riêng. Chi tiết về dấu hiệu của bot có trong bài traffic bot: dấu hiệu và cách nhận biết, về công cụ spy — trong bài chống công cụ spy.
Riêng một nhóm là traffic không đúng mục tiêu, hoàn toàn không liên quan đến lừa đảo. Một người thật từ Brazil vào offer cho Đức chẳng có lỗi gì, nhưng offer không có gì để trả cho lượt đó. Ở đây bộ lọc hoạt động như targeting tầng hai: lọc theo geo, thiết bị và lịch chạy bắt nốt những gì nền tảng bỏ sót.
Các lớp lọc traffic: từ mạng đến hành vi
Một bộ lọc traffic tốt không quyết định dựa trên một dấu hiệu duy nhất. Nó kiểm tra lượt truy cập theo từng lớp, từ kiểm tra rẻ đến kiểm tra tốn kém.
Lớp 1. Mạng và yêu cầu
Kiểm tra trước cả khi trang tải xong: địa chỉ IP, mạng (ASN) và nhà cung cấp, việc thuộc trung tâm dữ liệu hay proxy, header của trình duyệt, có nhãn click quảng cáo như fbclid hay gclid không, quốc gia, thiết bị, thời gian. Ở đây loại được traffic không hợp lệ đơn giản: robot đã biết, server, địa chỉ trong danh sách đen. Lớp này ít ảnh hưởng đến người thật nhất.
Lớp 2. Kiểm tra trình duyệt
Một script nhỏ được gửi tới trang để xem trình duyệt có hành xử như trình duyệt không: JavaScript có chạy không, có dấu vết tự động hóa không, phiên bản khai báo có khớp với khả năng thực tế không. Ở đây bắt được bot giả làm người — headless browser và auto-clicker.
Lớp 3. Hành vi
Chuyển động chuột và ngón tay, thời gian trên trang, độ tự nhiên của tương tác. Lớp này chính xác nhất trước bot tinh vi, nhưng cũng rủi ro nhất: nó thêm thời gian chờ và đôi khi coi một người dùng điện thoại chậm là bot.
Điểm tin cậy thay vì một quy tắc
Các bộ lọc trưởng thành không loại lượt truy cập chỉ vì một dấu hiệu yếu. Một số kiểm tra loại ngay — robot rõ ràng, địa chỉ trong danh sách đen, quốc gia ngoài danh sách. Các dấu hiệu còn lại cộng dồn thành điểm tin cậy: mỗi tín hiệu đáng ngờ thêm một mức phạt, và chỉ khi tổng vượt ngưỡng thì lượt mới bị coi là bot. Nhờ vậy một người dùng VPN với trình duyệt bình thường không bị mất vì một dấu hiệu, còn một server không có JavaScript và quốc gia lạ thì bị loại.
Sơ đồ cấu hình từng lớp được phân tích trong bài cách lọc traffic bot trong quảng cáo.
Bộ lọc traffic đặt ở đâu
Việc sàng lọc có thể diễn ra ở nhiều nơi, và mỗi nơi có giới hạn riêng.
- Trên nền tảng quảng cáo. Google, Meta và các nền tảng khác tự loại một phần click không hợp lệ và không tính tiền chúng. Bạn không điều khiển quy tắc và không thấy chính xác ai bị loại. Chi tiết trong bài invalid traffic: là gì và được tính thế nào.
- Trong mạng CPA. Anti-fraud của mạng kiểm tra đơn và có thể từ chối chúng sau đó — lúc này tiền click đã tiêu.
- Trên website của bạn. Mã trên landing hoặc file trên server hỏi quyết định từ dịch vụ lọc trước khi hiển thị trang. Đây là điểm duy nhất bạn tự đặt quy tắc và thấy lý do cho từng lượt truy cập.
- Trong tracker. Tracker có thể gắn nhãn và phân phối traffic, nhưng các kiểm tra thường chỉ giới hạn ở mạng và quy tắc chiến dịch.
Sơ đồ hiệu quả là bộ lọc trên website cộng với anti-fraud tích hợp của nền tảng và mạng CPA.
Cách đo lợi ích của việc lọc traffic
Một bộ lọc không thể kiểm chứng chỉ là niềm tin. Đây là cách biết nó có hoạt động không.
- Xem lý do, không chỉ kết quả. Con số «đã loại 30%» không nói lên gì. Quan trọng là ai bị loại: robot của nền tảng, trung tâm dữ liệu, geo lạ hay người thật bị dính quy tắc khắt khe.
- So sánh chuyển đổi của lượt được cho qua. Nếu sau khi bật bộ lọc CR của lượt được cho qua tăng, còn số đơn tuyệt đối không giảm, bộ lọc đang dọn rác.
- Theo dõi số đơn tuyệt đối. Số lead giảm sau khi siết quy tắc là dấu hiệu chính cho thấy quy tắc đang cắt người thật.
- Chạy bộ lọc ở chế độ quan sát. Để nó trước tiên chỉ gắn nhãn ai sẽ bị loại, còn bạn đối chiếu với chuyển đổi.
- Tính tiền. Giả sử, để minh họa: trong 1000 click đã mua, bộ lọc gắn nhãn 200 click là bot. Với giá click 0,25 $, đó là 50 $ traffic không thể chuyển đổi. Con số như vậy là luận cứ để khiếu nại với nền tảng và để tắt nguồn.
Chi tiết về các chỉ số có trong bài chất lượng traffic: cách đánh giá và kiểm tra.
Lời khuyên. Tự bản thân tỷ lệ đi qua tới offer không đánh giá được traffic lẫn bộ lọc. Với nguồn mua có nhãn click, phần lớn lượt truy cập có thể đi qua, và điều đó bình thường. Chỉ nên lo khi gần như không ai tới được offer.
Lỗi lọc traffic: làm sao không cắt nhầm người thật
Lỗi đắt nhất của bộ lọc không phải là để lọt bot, mà là cắt mất người mua. Một con bot tốn một click, một người bị cắt tốn cả một chuyển đổi.
- Giới hạn click trên IP quá cứng. Sau một địa chỉ mobile có hàng trăm thuê bao, và người thật thường quay lại để đặt hàng. Giới hạn một click sẽ cắt cả hai nhóm.
- Chặn IPv6 không có lý do. Nhiều nhà mạng di động cấp IPv6, và nếu offer hỗ trợ, việc chặn sẽ cắt người thật.
- Bắt buộc có referrer cho mạng xã hội. Trong trình duyệt tích hợp của ứng dụng, nguồn chuyển tiếp thường bị mất. Đòi hỏi nó với traffic như vậy nghĩa là cắt một nửa tệp khách.
- Chặn nguyên dải mạng của nhà mạng di động. Một kẻ click không đáng giá hàng nghìn thuê bao.
- Siết theo cảm giác. Nếu một quy tắc được bật «cho chắc», hãy kiểm tra nó đã cắt bao nhiêu và trong số đó có chuyển đổi không.
- Tự kiểm tra bằng lượt truy cập của mình. Click thử từ IP văn phòng và không có nhãn nền tảng không giống click từ quảng cáo. Với các bài test của bạn, hãy dùng whitelist địa chỉ.
Nếu click đi không đúng nơi bạn mong đợi, lý do thường thấy ngay — xem bài vì sao click vào White Page.
Bộ lọc traffic cho từng nguồn
Dùng cùng một bộ quy tắc cho mọi nền tảng là nguyên nhân thường gặp của cả bot lọt lưới lẫn người thật bị mất. Các nguồn khác nhau ở chỗ truyền gì trong link, khách đến từ mạng nào và một lượt truy cập bình thường trông ra sao.
| Nguồn | Đặc điểm | Cần lưu ý gì trong bộ lọc |
|---|---|---|
| Tìm kiếm (Google Ads, Microsoft Ads) | truyền nhãn click, gần như mọi khách là trình duyệt bình thường | có thể yêu cầu JavaScript và xem xét chặt hơn các lượt không có nhãn |
| Mạng xã hội (Facebook, TikTok) | nhiều lượt từ trình duyệt tích hợp trong ứng dụng, referrer thường bị mất | không bắt buộc website nguồn, thận trọng khi chặn theo nhà cung cấp |
| Quảng cáo native và push | nhiều site đối tác, click lặp, zone rác | giới hạn click trên địa chỉ cao hơn, báo cáo theo zone là bắt buộc |
| Popunder | nhiều lượt mở tự động và lượt truy cập ngắn | kiểm tra trình duyệt và hành vi quan trọng hơn quy tắc mạng |
| Ứng dụng nhắn tin và kênh | hoàn toàn không có nhãn click | quy tắc dựa vào nhãn click không hoạt động ở đây |
Vì vậy hợp lý là bắt đầu từ bộ quy tắc dựng sẵn cho nền tảng, rồi điều chỉnh theo nhật ký lượt truy cập, chứ không làm ngược lại. Đặc điểm của từng nền tảng được tập hợp trong danh mục nguồn traffic.
Lọc traffic trong ArtisanClo hoạt động thế nào
Trong ArtisanClo, bộ lọc kết nối với website của bạn theo một trong hai cách: thẻ JS ở dòng đầu tiên trong <head> của landing hoặc file PHP trên server của bạn (với WordPress có plugin cài đúng cách PHP đó). Website vẫn ở chỗ bạn; cách chọn phương thức có trong bài cách kết nối cloaker với website.
Tiếp theo là cấu hình theo luồng:
| Gì | Hoạt động thế nào |
|---|---|
| Mức độ kiểm tra | công tắc «Nhẹ / Cân bằng / Nghiêm ngặt» với giá trị chọn sẵn theo nền tảng nguồn |
| Nhẹ | chỉ danh sách đen IP và bot tự động, không giới hạn theo IP |
| Cân bằng | thêm VPN, proxy, mạng trung tâm dữ liệu và giới hạn click từ một IP mỗi ngày |
| Nghiêm ngặt | thêm IPv6, bắt buộc JavaScript, thời gian tối thiểu trên trang và giới hạn IP cứng |
| Đối tượng | quốc gia, thiết bị, hệ điều hành, trình duyệt, ngôn ngữ, múi giờ, thành phố, vùng; từ Professional — mạng, nhà cung cấp, website nguồn |
| Lượt trùng | khách truy cập duy nhất với cửa sổ từ một giờ đến 30 ngày, theo IP hoặc theo IP và trình duyệt |
Quyết định được đưa ra theo thứ tự: trước là các lần cắt cứng, rồi đến quy tắc đối tượng, rồi điểm tin cậy. Mỗi lượt truy cập trong nhật ký click nhận một lý do — «VPN hoặc proxy bị chặn», «Ngoài giờ chạy chiến dịch», «Crawler của công cụ tìm kiếm hoặc nền tảng» và hàng chục lý do khác. Trong thống kê, phía trên danh sách lý do hiển thị lượt truy cập bị loại ở bước nào: «Mạng và yêu cầu», «Kiểm tra trình duyệt» hay «Kiểm tra không quay lại».
Để kiểm tra bộ lọc không rủi ro, có chế độ shadow: khi kết nối bằng file PHP, mọi người đều đi tới offer, còn nhật ký cho thấy bộ lọc lẽ ra đã loại ai. Chế độ «Tracker» làm điều tương tự một cách thường trực — bot chỉ được gắn nhãn trong báo cáo. Còn nếu trong một ngày chỉ một phần rất nhỏ lượt truy cập tới được offer hoặc tỷ lệ đi qua giảm mạnh, bạn sẽ nhận cảnh báo rằng quy tắc nhiều khả năng đang cắt người thật. Danh sách đầy đủ có trên trang tính năng.
Tóm lại
Lọc traffic là chọn lọc từng lượt truy cập quảng cáo trước offer: bot, gian lận, lượt trùng, geo và thiết bị không đúng mục tiêu, công cụ spy bị loại hoặc gắn nhãn, khách thật đúng mục tiêu đi qua. Nó hoạt động theo lớp — mạng, trình duyệt, hành vi — và cộng các dấu hiệu yếu thành điểm tin cậy. Giá trị của bộ lọc không đo bằng tỷ lệ bị loại, mà bằng lượng rác nó dọn được mà không đụng tới đơn. Hãy bắt đầu với mức kiểm tra vừa phải, thử quy tắc ở chế độ quan sát và luôn xem lý do của từng quyết định.



