Trình trích liên kết nội bộ
Chỉ cần dán một URL hoặc đoạn HTML nguyên thủy, công cụ trích xuất sẽ tự động thu thập tất cả các thẻ liên kết – phân biệt giữa các thẻ liên kết nội bộ (cùng chủ máy chủ) và thẻ liên kết bên ngoài, đồng thời ghi lại văn bản liên kết, thuộc tính rel, địa chỉ đích, trạng thái nofollow và vị trí trong tài liệu. Công cụ này rất hữu ích cho các cuộc kiểm toán SEO, việc tìm kiếm các trang bị bỏ quên (orphan pages), cũng như phát hiện các thẻ rel="nofollow" xuất hiện vô tình trên các liên kết nội bộ quan trọng.
Cách trích xuất các liên kết nội bộ
-
1
Nhập một địa chỉ URL hoặc dán mã HTML
Đối với một URL đang chạy trực tiếp, công cụ sẽ tải và phân tích cấu trúc DOM; trong khi đó, mã HTML được dán vào sẽ được phân tích ngay trên trình duyệt của bạn.
-
2
Xem bảng liên kết
URL đích, văn bản liên kết, thuộc tính rel, mục tiêu, biểu tượng nofollow và vị trí liên kết (phần đầu trang / nội dung trang / phần cuối trang).
-
3
Chỉ lọc nội bộ
Thay đổi trạng thái bộ lọc “chỉ nội bộ” để ẩn các liên kết dẫn ra khỏi máy chủ hiện tại.
-
4
Xuất
Sao chép dưới dạng CSV hoặc JSON để sử dụng trong công cụ thu thập dữ liệu hoặc kiểm toán bảng tính.
Tại sao việc tạo liên kết nội bộ quan trọng đối với SEO
Các liên kết nội bộ liên quan đến ba yếu tố mà Google coi trọng:
- Phát hiện bằng cách lướt web. Các bot truy cập các trang mới bằng cách theo dõi các liên kết từ những trang mà chúng đã biết trước đó.
- Phân bố PageRank: Mỗi liên kết nội bộ đều truyền một phần quyền uy từ trang nguồn đến trang đó. Các trang chủ chốt nên nhận được nhiều liên kết nội bộ hơn.
- Tính liên quan về ngữ cảnh: Văn bản chính và đoạn văn xung quanh sẽ giúp Google hiểu được nội dung của trang đích.
Các đặc điểm được ghi nhận bởi công cụ
| Cờ | Ý nghĩa |
|---|---|
| Nội bộ / Bên ngoài | So sánh với máy chủ của trang (bao gồm các miền con). |
| Nofollow | Có rel="nofollow", không truyền tín hiệu xếp hạng. |
| Sponsored / UGC | rel="sponsored" hoặc rel="ugc", cùng hành vi thu thập dữ liệu. |
| Tab mới | target="_blank", mở trong một tab mới. |
| Điểm neo trống | Không có văn bản hiển thị (chỉ hình ảnh hoặc khoảng trắng). |
| Chỉ có hash | Các liên kết dạng mảnh như #section, không dẫn sang trang khác. |
| Vị trí | Tiêu đề / thanh điều hướng / nội dung chính / chân trang. |
Khắc phục các vấn đề phổ biến mà công cụ phát hiện
- nofollow nội bộ trên thanh điều hướng. Đôi khi một mẫu giao diện áp dụng
rel="nofollow"cho mọi liên kết nội bộ, hãy loại bỏ chúng. - Quá nhiều văn bản neo khớp chính xác. Nếu 40 liên kết nội bộ trỏ đến
/blog/pricingvới văn bản neo “pricing”, điều này có thể trông giống thao túng. - Các trang mồ côi. Thu thập dữ liệu toàn bộ trang web và kiểm tra xem URL nào không có liên kết nội bộ nào trỏ đến.
- Điểm neo chỉ có hình ảnh.
<a><img alt="..."></a>là hợp lệ, nhưng Google đọc văn bảnaltnhư điểm neo, vì vậy hãy đảm bảo nó có ý nghĩa.
Khi nào nên sử dụng việc lấy dữ liệu từ URL thay vì dùng HTML đã dán sẵn
- Dùng lấy dữ liệu từ URL cho các trang công khai và kiểm tra nhanh.
- Dùng HTML đã dán cho các trang cần xác thực (trang thử nghiệm sau lớp xác thực HTTP Basic), các SPA động sau khi được kết xuất bằng JavaScript, hoặc để phân tích ngoại tuyến một trang đã tải xuống.
Các lỗi phổ biến
- Coi liên kết miền con là liên kết bên ngoài. Các công cụ tìm kiếm thường làm vậy, blog tại
blog.example.comvà trang chính tạiexample.comphân bổ độ uy tín riêng biệt. - Bỏ sót các phần tử
<link>(canonical, alternate). Chúng không được đề cập ở đây; được tính là tham chiếu nội bộ nhưng khác về mặt ngữ nghĩa so với điểm neo. - Nhầm lẫn
rel="noopener"vớirel="nofollow". Cái đầu là thuộc tính bảo mật; nó không ảnh hưởng đến SEO.
Câu hỏi thường gặp
Một điểm neo mà máy chủ đích của nó trùng với máy chủ của trang hiện tại. Theo mặc định, các miền con được coi là bên ngoài; hãy bật hoặc tắt tùy chọn “bao gồm các miền con” để tính chúng là nội bộ trong các cuộc kiểm toán dành cho một thương hiệu duy nhất.
Khi bạn truy xuất một URL, hệ thống sẽ không xử lý mà trực tiếp phân tích phản hồi HTML thô. Đối với các SPA được hiển thị bằng JavaScript, hãy mở trang web, xem mã nguồn sau khi trang tải xong, rồi dán đoạn mã đánh dấu DOM vào công cụ.
Không phải thông qua việc tải URL (máy chủ trả về trang đăng nhập). Hãy đăng nhập, sao chép mã HTML đã được hiển thị và dán vào công cụ để phân tích tại chỗ.
Đúng vậy. Sao chép dưới dạng CSV để sử dụng trong bảng tính hoặc dưới dạng JSON để nhập vào kịch bản, mỗi liên kết gồm một hàng với các trường URL, văn bản liên kết (anchor text), thuộc tính rel và vị trí.
Công cụ liên quan
Trình kiểm tra độ dài mô tả siêu dữ liệu
Đo mô tả meta theo ký tự và pixel ước tính, so sánh các mốc biên tập và xem bố cục minh họa trên máy tính lẫn thiết bị di động.
Trình mô phỏng kết quả Google
Xem snippet gần đúng theo kiểu Google với giới hạn ký tự cho điện thoại và máy tính. Bản nháp chỉ ở trong phiên trình duyệt này.
Trình kiểm tra header bảo mật HTTP
Dán header phản hồi HTTP và kiểm tra cục bộ HSTS, CSP, clickjacking, MIME, referrer cùng chính sách cross-origin.
Trình kiểm tra sơ đồ trang web XML
Kiểm tra XML của sơ đồ trang web trong trình duyệt để tìm lỗi phân tích, vị trí còn thiếu, URL trùng lặp và giá trị trường phổ biến.
Trình tạo thẻ chuẩn
Tạo thẻ liên kết rel=canonical hợp lệ cho bất kỳ URL nào. Bao gồm xác thực URL và các lỗi phổ biến cần tránh.
Trình kiểm tra URL chuẩn
Dán HTML của một trang và kiểm tra thẻ rel=canonical: có tồn tại không, có phải URL tuyệt đối hợp lệ không, có khớp với URL trang không.
Công cụ này có phiên bản bằng các ngôn ngữ khác
- 内部リンク抽出ツール [JA]
- Extraktor för interna länkar [SV]
- Ekstraktor Tautan Internal [ID]
- Extractor de enlaces internos [ES]
- เครื่องมือดึงลิงก์ภายใน [TH]
- Ekstraktor linków wewnętrznych [PL]
- Extrator de Links Internos [PT]
- 내부 링크 추출기 [KO]
- Extractor voor interne links [NL]
- Interne Links Extraktor [DE]
- أداة استخراج الروابط الداخلية [AR]
- Extracteur de liens internes [FR]
- Internal Links Extractor [EN]
- Estrazione dei link interni [IT]
- Экстрактор внутренних ссылок [RU]
- İç Bağlantı Çıkarıcı [TR]
- 内部链接提取器 [ZH]