Những trang bạn muốn Google bỏ qua (noindex, follow)
2026-08-16
Nhiều người mới tin rằng: đặt index, follow cho mọi trang để Google thấy hết. Thực ra đó là sai lầm. Một số trang nên cố ý giữ ngoài Google — và làm vậy bảo vệ SEO chứ không hại. Công cụ cho việc đó chỉ một dòng: noindex, follow.
Trước hết, tin vui: index, follow là mặc định. Một trang bình thường không có thẻ robots meta thì vốn đã được lập chỉ mục và liên kết được theo, nên bạn không bao giờ cần thêm content="index, follow" — bỏ trống cũng vậy. Thẻ bạn thật sự cần là cái ngược lại.
noindex, follow nghĩa là gì
Đặt dòng này vào <head> của trang:
<meta name="robots" content="noindex, follow">noindex— "đừng đưa trang này vào kết quả Google."follow— "nhưng vẫn thu thập các liên kết trên trang và truyền sức mạnh sang những trang chúng trỏ tới."
Vậy trang biến mất khỏi tìm kiếm, nhưng không thành ngõ cụt — link equity vẫn chảy qua. (noindex, nofollow hiếm khi là thứ bạn muốn; hãy giữ follow.)
Vì sao cố ý ẩn một số trang
- Crawl budget (ngân sách thu thập). Googlebot chỉ dành có hạn thời gian cho site của bạn. Mỗi trang rác hay trùng lặp nó thu thập là thời gian không dành cho nội dung thật — bạn muốn nó đọc sản phẩm và bài viết, không phải trang đặt lại mật khẩu.
- URL rác vô hạn. Nếu Google thu thập ô tìm kiếm, nó có thể sinh ra vô số trang mỏng —
/search?q=a,/search?q=ab, … — lãng phí ngân sách và trông như spam. - UX tệ & trùng lặp. Từ Google bấm vào lại rơi vào một trang kết quả tìm kiếm khác là trải nghiệm dở, và trang trùng làm loãng tín hiệu xếp hạng.
Những trang nào nên noindex, follow
Nguyên tắc: nếu một trang hữu ích cho người đã ở trên site, nhưng vô ích với người đang tìm trên Google, thì noindex nó.
| Loại trang | Ví dụ |
|---|---|
| Kết quả tìm kiếm nội bộ | /search?q=… |
| Trang tài khoản | /login, /signup, /forgot-password, /dashboard, /my-account |
| Trang "đã xong" | /thank-you, /success, /welcome |
| Pháp lý / quản trị (tuỳ chọn) | /privacy, /terms, /data-deletion — index cũng được, nhưng nhiều người noindex để Search Console gọn |
| Bản in / bản trùng | bản in thân thiện của một trang, để không cạnh tranh với bản thật |
Thêm: đã noindex thì khỏi cần schema
Nếu một trang noindex, đừng bận tâm thêm JSON-LD / dữ liệu có cấu trúc cho nó. Dữ liệu có cấu trúc chỉ để trang trông đẹp trong kết quả tìm kiếm — mà Google không bao giờ hiển thị trang đã noindex, nên nó sẽ không dùng schema. Đỡ công (ví dụ không cần schema SearchResultsPage cho trang tìm kiếm đã noindex).
Nguyên tắc nhanh
- Nội dung thật người ta tìm → để index (mặc định — không cần thẻ).
- Trang tiện ích, mỏng, hoặc trùng →
<meta name="robots" content="noindex, follow">.
Google: thẻ robots meta · Google: chặn lập chỉ mục với noindex · Google: crawl budget
Xem thêm Mọi thẻ SEO và website mẫu.