為何說「有價值的反向連結」很重要 ? 這裡要特別強調「有價值的」,因為建立一大堆沒有品質的反向連結,反而對網站是不利的。
Wikipedia 其實就藏著不少這類「有價值的」機會。
Wikipedia 上有大量文章引用外部網站作為資料來源,但是網站會關站、網址會改版、文章會被刪除,時間久了就會出現 Broken Link (斷鏈)。Wikipedia 還是需要這份資料,只是原來的來源已經不存在了。
這就出現了一種常見的 Link Building (連結建設) 的方法,叫做 Broken Link Building (斷鏈建設)。
概念並不複雜,你先找到一個已經失效、但原本具有引用價值的網站;研究它原先提供什麼資訊;如果你的網站可以提供品質相當甚至更完整的內容,再把新的來源提供給原本連結它的網站參考。
問題是 Wikipedia 那麼大,要去哪裡找跟自己產業有關的 Broken Link 呢?
這就是 SEO 研究院 Wikipedia Broken Links Finder 這個 Chrome 外掛產生的主要原因。
它不會幫你自動製造 Wikipedia Backlink,而是幫你把最花時間的第一步,也就是「找機會」的部分先處理掉。
更重要的是,找到 Broken Link 只是開始,後面還有一大堆工作。
原來的文章到底寫了什麼?Wikipedia 為什麼引用它?你的文章是否真的有資格取代?如果沒有,你應該怎麼重新建立內容?
這才是 Wikipedia Broken Link Building 真正值得研究的地方。
Wikipedia Broken Links Finder 外掛最主要的功能是什麼?
先說結論 ~
Wikipedia Broken Links Finder 外掛最主要的功能,就是根據你輸入的主題關鍵字,找出相關 Wikipedia 條目中的斷鏈,再協助你判斷哪些斷鏈值得進一步研究。
例如你經營的是 SEO 相關網站,你不會想把整個 Wikipedia 的 Broken Link 全部抓回來。因為醫療、歷史、電影、化學、生物學的斷鏈對你大多沒有意義。
你真正想知道的是:「跟 SEO、Google、搜尋引擎、Content Marketing 有關的 Wikipedia 條目裡,有沒有引用來源已經死掉的?」
找到這些網址之後,才有必要繼續研究它們是否可能成為你的反向連結機會。
什麼是 Wikipedia Broken Link Building?
Broken Link Building 的基本概念,是利用網路上原本已經存在、後來卻失效的連結,尋找新的連結機會,Wikipedia 也是一樣。
假設某一篇 Wikipedia 文章裡面有一句:
某項研究顯示,消費者在購買產品以前,會先使用搜尋引擎研究相關資訊。[來源]
但幾年前引用的研究網站已經關閉。
Wikipedia 仍然需要一份資料來支持這段敘述,只是原本的來源已經不存在。
這時候就會有三種可能 :
第一種是原來的文章只是換網址,找到新網址就可以修正;
第二種是 Internet Archive 等網站已經保存歷史版本,可以繼續使用封存資料;
第三種才是原本內容真的消失,也沒有合適的替代來源,這種才是 Broken Link Building 最值得研究的機會。
Wikipedia 自己的編輯指南其實也是這麼處理,對於失效的外部連結,官方建議先確認是不是真的失效、尋找同站的新網址、查看網頁封存,最後才是尋找「提供相同資訊的其他來源」。
所以 Broken Link Building 並不是 SEO 人自己發明出來的漏洞。
問題本來就存在,而你要做的是提供一個真的能提供正確資訊的新來源。
Wikipedia Broken Links Finder 外掛是什麼?它如何幫你省時間?
如果全部人工操作,你首先要搜尋相關 Wikipedia 條目,接著一篇一篇打開,檢查裡面的 Citation (引用),再確認哪些網址已經被標記成 Dead Link。
找到之後還不能結束 ~ 因為被 Wikipedia 標記為 Dead Link,不代表它一直依然是 Dead。
有些網站恢復了;有些換了網址;有些 HTTP Status Code (HTTP 狀態碼) 甚至仍然回傳 200,但實際內容早已不見,變成 Soft 404;有些網域則被其他人重新註冊,內容已經完全變了。
所以 Wikipedia Broken Links Finder 外掛做了兩件事情。
第一件事情是「找」到 Dead Link。
它會根據你的關鍵字去找含有相關主題,同時存在 Wikipedia Broken Link 標記的條目。
第二件事情是「驗證」 Dead Link 是否真的不見了。
找到候選網址後,外掛還能進一步確認目前網址屬於 Dead、Alive、Redirected、Soft 404、Server Error、Timeout、內容遭替換或無法確認等不同狀態,不是看到 HTTP 200 就直接說這個網址還活著。
這兩件事情加起來,就是 Wikipedia Broken Links Finder 這個外掛真正幫你省下時間的地方。
你不用把時間花在大海撈針,可以把時間留給真正需要人判斷的事情,也就是這個 Broken Link 到底值不值得做。
為什麼 Wikipedia Broken Link 很難找?
知道 Wikipedia 有 Broken Link,跟真正找得到「適合你」的 Broken Link,是兩回事,最大的問題是規模。
Wikipedia 有非常大量的文章與外部 Citation。你當然可以透過搜尋指令、Wikipedia 分類頁面或其他工具慢慢挖,但實際執行時,很快就會碰到第一個問題:找到很多,不代表找到有用的。
假設你的網站專門談數位行銷,你找到一百個 Broken Link,其中九十個是歷史人物、物理學、電影資料與城市介紹,有什麼用?
幾乎沒有。
所以潛在機會開發的第一個條件不是「存在 Broken Link」,而是:
這個 Broken Link 所在的主題,必須剛好落在你有能力提供專業內容的範圍內。
第二個問題是假斷鏈。
Wikipedia 某個 Citation 可能在幾年前被標記成 Dead Link,但是網址後來恢復了,或者原網址會重新導向到新的內容位置。
還有更麻煩的情況。
網址正常回傳 HTTP 200,看起來好像沒問題,打開之後卻只剩網站首頁、網域停放頁面,或者完全不同的內容。
所以只搜尋 Wikipedia 的 dead link 標籤還不夠,外掛還要重新驗證現在的狀態。
第三個問題是 Archive (網頁封存)。
如果 Wikipedia 已經透過 Internet Archive 找到原始內容的完整備份,這個 Broken Link 對 Wikipedia 而言不一定是一個急著需要替代的問題。
這也是 Wikipedia Broken Links Finder 預設會排除已經有 Archive URL 的斷鏈的原因。你也可以自行設定,把已有封存網址的結果包含進來。
對 Broken Link Building 而言,我反而建議先看:
真的失效,而且沒有完善 Archive 可以直接解決的來源,這個機會比較值得研究。
如何利用外掛找到 Wikipedia Broken Links?
實際操作並不複雜。
真正需要學習的是怎麼設定搜尋條件,以及怎麼從搜尋結果判斷哪些值得繼續往下做。
第一步:從你的專業主題開始搜尋
安裝 Wikipedia Broken Links Finder 後,可以直接從 Chrome Side Panel(側邊面板)操作。
第一個工作不是輸入你的品牌名稱,而是列出你的網站真正具有內容能力的主題。
例如 SEO 研究院可能研究:
SEO、search engine、Google Search、content marketing、structured data、local SEO。
如果是一個健身網站,可能研究:
weight training、strength training、protein、bodybuilding。
不要先問「哪裡有 Backlink 可以拿」,先問「哪些主題我真的有能力提供值得引用的資料」。
前者很容易變成亂撒連結。
後者才有可能找到真正適合的 Wikipedia Citation。
如下圖,在2個條目尋找到4個候選斷鏈 :
第二步:使用 AND/OR 搜尋把範圍縮小
單一關鍵字有時候太廣,所以外掛支援 AND 與 OR 條件。
同一組條件使用半形逗號 , 代表 OR;不同群組使用半形句號 . 代表 AND。
例如:
search engine,google.AI
代表:
((search engine) OR (google)) AND AI
如果搜尋結果太少,可以放寬條件;結果太雜亂,就加入第二個主題限制。
這跟一般關鍵字研究很像。
條件越廣,候選數量越多,但是雜訊也越多;條件越窄,候選數量會下降,但是相關性通常會提高。
另外要特別注意,外掛要求使用半形逗號與半形句號,全形的「,」與「。」不會被當成搜尋運算符號。
第三步:先看 Broken Link 出現在哪一篇 Wikipedia
搜尋完成後,不要第一眼只盯著斷掉的 URL。
先看 Wikipedia Article。
因為同一個 Broken Link 出現在「Search Engine Optimization」條目,跟出現在「History of the Internet」條目,內容需求可能完全不同。
Wikipedia 條目的主題,會先告訴你這個連結大概處在什麼語境。
接著才看 Citation Title、Publisher、原始 URL、標記日期、Archive URL,以及附近的 Citation Context。
Wikipedia Broken Links Finder 會把這些資訊整理在結果裡,目的就是讓你不需要一直在十幾個頁籤之間切換。
如下圖,可以看到哪個條目的哪個連結出現斷鏈,如果這個條目明顯跟你的預期不同,就不需要再往下研究 :
第四步:看 Citation Context,而不是只看網址
這是整套方法中非常重要的一步。
你要知道的並不是:「這裡有一個 404。」而是要知道:「Wikipedia 原本用這一份資料證明什麼?」
例如原本 Citation 支持的是一個市場統計數字,你的替代內容就必須能支持那個數字。
如果它支持的是一個歷史事件,你需要的是可靠的歷史資料。
如果原本連結是一份官方技術文件,你寫一篇自己的部落格心得,通常就不是等價替代。
Citation Context 可以讓你快速判斷這條斷鏈究竟值不值得研究。
例如這個 Wikipedia 條目 https://zh.wikipedia.org/wiki/%E5%AE%89%E5%BE%B7%E7%83%88%C2%B7%E5%8D%A1%E5%B8%95%E8%A5%BF?variant=zh-tw
斷鏈網址是 : https://beta.newsy-today.com/the-slovak-who-leads-ai-in-tesla-left-the-company-for-several-months-he-jokes-with-musk-about-tiktok/
(以上是斷鏈,就不用連結方式呈現)
引用標題是 : The Slovak, who leads AI in Tesla, left the company for several months. He jokes with Musk about TikTok
引用上下文是 : th Musk about TikTok |url=https://beta.newsy-today.com/the-slovak-who-leads-ai-in-tesla-left-the-company-for-several-months-he-jokes-with-musk-about-tiktok/ |access-date=2022-07-19 |website=Newsy Today |language=en-US }} {{Cite web |date=2020-06-23 |title=Slovák Andrej Karpathy z Tesly patrí podľa MIT medzi 35 top inovátorov |url=https://www.teslamagazin.sk/andrej-karpathy-tesla-ocenenie-mit/ |access-date=2022-07-19 |website=T
從以上的資訊可以知道,斷鏈是一段新聞,如此一來你的網站如果不是類似媒體,就很難補上這類的內容來獲得連結。
第五步:重新驗證 URL
接著再檢查網址現在是不是真的失效。
Wikipedia Broken Links Finder 會把結果區分成 Dead、Soft 404、Alive、Redirected,以及 Unable to Verify 等不同類型,如下圖 :
這一步可以砍掉非常多的假機會。
例如網址只是從:
example.com/report-2020
搬到:
example.com/research/report-2020
那就不是你的 Link Building 機會。
正確的修復方式,是把 Wikipedia 原網址改成新的官方網址。
又例如網址 Redirect 到同一網站首頁,原始資料已經不在,這才有必要繼續研究。
所以不要把「被標記為 Dead」跟「現在真的 Dead」混在一起。
第六步:把值得研究的結果整理出來
當搜尋數量開始增加,外掛可以把資料輸出成 UTF-8 CSV 或 JSON。
你可以把結果進一步整理成自己的 Link Prospecting 表格。
我自己會比較關注下面這幾個判斷:
| 判斷項目 | 要看什麼 |
|---|---|
| Topic Relevance | 是否跟自己的專業領域直接相關 |
| Current Status | 是否真的 Dead 或 Soft 404 |
| Archive Status | 是否已有可正常使用的封存版本 |
| Citation Context | 原始資料支持 Wikipedia 哪段內容 |
| Replacement Difficulty | 自己是否有能力提供等價或更好的資料 |
| Source Quality | 自己的網站是否可能符合 Wikipedia 的來源標準 |
到了這個階段,Wikipedia Broken Links Finder 的工作其實已經差不多完成了。
接下來才是 SEO 人真正需要做判斷的地方。
找到 Broken Link 之後,真正重要的是「看原本內容」
很多 Broken Link Building 教學會跳過最麻煩的一步,找到 404 之後,馬上開始寫文章。
我認為這個順序是錯的。
你連原本消失的頁面在講什麼都不知道,怎麼知道自己要取代什麼?
所以找到 Broken Link 後,第一件事不是寫 ~ 而是考古。
最直接的方法是把原始網址丟進 Internet Archive 的 Wayback Machine,看看過去有沒有保存。
Wikipedia 官方對 Dead Citation 的處理方式也是先尋找 Archive,再尋找其他能提供相同資訊的來源。
例如下圖,斷鏈並不存在於 Wayback Machine :
如果存在的話,會出現如下圖 :
你就可以選擇最接近維基百科引用時最可能的連結,打開封存版本以後,至少確認三件事情。
原始頁面的核心主題是什麼?它提供哪些實際資料?Wikipedia 當初到底引用其中哪一部分?
舉個例子。
假設消失的頁面標題是:
「Global Search Engine Market Share 2018」
Wikipedia 引用的是裡面的一組 2018 年統計數據。
這時候你真正需要取代的是「2018 年搜尋引擎市占資料」,而不是「搜尋引擎」這四個字。
如果你看到這條 Broken Link,就寫一篇:
「搜尋引擎是什麼?Google 搜尋完整介紹」
文章寫了五千字,內容也很好,但是沒有當初那份統計資料。
還是不能取代的。
Replacement Content 比較的不是誰寫得比較長,而是能不能完成原來源在 Citation 裡面的工作。
這個觀念抓住以後,會少做很多沒有意義的內容。
如何自己寫一篇再取代?
假設原始內容真的已經消失,也沒有適合的替代來源,你能不能自己重新寫一篇?
可以研究,但並不太簡單。
因為「內容寫得很好」與「Wikipedia 願意把它當成可靠來源」是兩個不同問題。
Wikipedia 對來源的基本要求,是一份來源必須足以可信地支持它引用的那一項主張。整體來說,Wikipedia 偏好可靠、已出版、獨立,而且具有事實查核與正確性聲譽的來源。
尤其 Self-published Source(自行出版來源)限制更多。Wikipedia 的 Reliable Sources Guideline 指出,個人網站、自行出版內容等來源大多不能直接視為可靠來源;如果作者本身是在相關領域已建立聲譽的專家,才有比較有限的例外空間。
所以不是:
「Wikipedia 缺一篇文章,我寫一篇就可以換。」
真正要問的是:
「如果我是 Wikipedia 編輯者,我有什麼理由相信這一篇?」
可以用下面這張表先判斷。
| 檢查項目 | 較好的 Replacement Content | 較弱的 Replacement Content |
|---|---|---|
| 資訊相關性 | 直接支持原 Wikipedia 敘述 | 只談相似主題 |
| 資料來源 | 有原始研究、官方資料或清楚引用 | 沒有來源 |
| 作者身分 | 有可驗證的相關專業背景 | 無法確認作者 |
| 編輯品質 | 有查核、更新、來源說明 | 為 SEO 臨時拼湊 |
| 商業程度 | 主要目的在提供資訊 | 大量推銷產品或服務 |
| 可驗證性 | 第三方可以重新檢查資料 | 只有作者自己的結論 |
如果原文章是一份統計報告,一個更有價值的替代做法可能不是「把文章重寫一次」,而是重新整理原始 Dataset(資料集),交代資料來源、統計時間、方法、限制,再補上更新版本。
如果原文章是一份教學,你的新版本可以補上現在仍然有效的步驟、最新介面,以及原文章已經過時的地方。
如果原文章本來就是某家公司的官方說明,就更要小心。
Wikipedia 很可能真正需要的是那家公司的第一手來源,不是你的二手解釋。
所以我的判斷是:
Broken Link 可以當成內容機會,但是不要為了一條 Backlink,硬做一篇本來沒有出版價值的文章。
Google 的垃圾內容政策也明確把「主要為了操控連結與排名信號而建立的低價值內容」列入 Link Spam(垃圾連結)的例子。
這條界線非常清楚 ~ 先有值得存在的內容,再談 Link Building。
怎麼把自己的文章放進 Wikipedia?
寫完之後,可以直接把自己的網址換進 Wikipedia 嗎?並不是。
Wikipedia 對 Conflict of Interest(COI,利益衝突)的立場很明確。如果你是網站擁有者、作者、公司人員,或因為工作關係而希望 Wikipedia 放上自己的網址,就已經存在利益衝突。
Wikipedia 的 COI Guideline 明確表示,這類編輯受到高度勸阻;如果有利益關係,較合適的方式是在相關條目的 Talk Page(討論頁)提出修改建議,讓其他編輯者審查,而不是把自己的來源直接換上去。
Wikipedia 也不是完全禁止引用自己寫過的資料。
官方說法是,在內容相關、符合來源政策而且不過量的前提下,可以有限度引用自己的作品。但是大量加入自己的 Citation,仍然可能被視為 Spam。
所以比較乾淨的流程是:
找到真正失效的 Citation,確認原始資訊已無法正常取得,準備一份真正能支持原敘述的新來源,再到 Talk Page 說明你找到的 Broken Link、建議的替代來源,以及你跟該網站的關係。
例如可以說:
這個 Citation 目前的網址已經失效。我找到一份新的資料可以支持這段內容。這份資料是由我/我們公司發布,因此我有利益關係,不直接修改條目,提供在這裡讓其他編輯者判斷是否適合作為替代來源。
這看起來比較麻煩,但是換個角度想,Wikipedia 本來就不是你的 Link Building 平台。
你真正想做的是讓一份值得被引用的資料,被需要這份資料的人接受。
這比想辦法繞過 Wikipedia 的審核機制健康多了。
Wikipedia Broken Link Building 最常失敗的 5 個原因
1. 看到 Dead Link 就認為是 Backlink 機會
不是每條斷鏈都值得做。
網址可能只是搬家,可能已有 Archive,也可能已經有其他來源支持相同敘述。
如果 Wikipedia 根本沒有「來源缺口」,你只是看到一個技術上的 Broken URL,這跟 Link Building Opportunity 是兩回事。
2. 沒看原始內容就開始寫 Replacement Article
這可能是最浪費時間的一種做法。
看到「SEO」相關的 Broken Link,就寫一篇 SEO 是什麼;看到「AI」就寫 AI 完整攻略。
最後文章主題看起來很相關,實際上卻無法支持 Wikipedia 原本的敘述。
相關,不等於可以取代。
3. 文章看起來就是為了拿 Backlink 才寫
十個 H2、幾千字、關鍵字都有,但是沒有新的資料、沒有研究、沒有實際經驗,也沒有值得引用的資訊。
這種內容就算寫得再「SEO Friendly」,也不會因此變成可靠來源。
而且 Google 也不鼓勵建立低價值內容,主要目的只為了操控連結與排名信號。
4. 用商業服務頁取代資訊來源
原本 Citation 是一份研究。
你換成:
「SEO 顧問服務,立即預約免費諮詢。」
被刪掉一點都不奇怪。
Wikipedia 的 External Links Guideline 本來就提醒,主要目的在推廣網站的連結通常應避免。
Wikipedia 要的是 Source,不是 Landing Page。
5. 以為換上去就永遠不會被拿掉
Wikipedia 是共同編輯的平台。
你的修改可能被其他編輯者重新檢查、修改甚至撤回。
尤其當帳號長期只有一種操作模式,例如不斷找 Broken Link、然後全部換成同一個網站,意圖很快就會變得非常明顯。
所以不要把成功 KPI(Key Performance Indicator,關鍵績效指標)設定成:
「這個月一定要從 Wikipedia 拿 20 條 Backlink。」
比較合理的是:
「這個月研究 50 個相關 Broken Link,找出真正值得建立內容的機會。」
前面是硬做連結,後面是在做 Research。
Wikipedia Backlink 對 SEO 到底有沒有用?
這應該是很多人最想問的問題。
答案是:有價值,但是不要把 Wikipedia Backlink 想成一條高 DR 網站傳 PageRank 給你的捷徑。
MediaWiki 的預設設定會替 Wiki 文字中的外部網址加入 rel="nofollow",目的正是提示搜尋引擎,不要把使用者自行加入的外部網址直接當成排名背書。
Google 在 2019 年調整 nofollow 的處理方式,從 2020 年開始,把 nofollow、ugc、sponsored 等 Rel Attribute(連結關係屬性)當成 Hint(提示),而不是過去那種完全不考慮的絕對規則。
這代表什麼?
代表我們不能簡單說:
「Wikipedia 的 Backlink 完全沒有 SEO 價值。」
但同樣也不能反過來說:
「只要拿到 Wikipedia Backlink,一定可以提升排名。」
目前沒有足夠依據可以這樣承諾。
我會把 Wikipedia Backlink 的價值拆成幾個層次看。
| 價值 | 我的判斷 |
|---|---|
| 直接排名效果 | 不確定 |
| Referral Traffic(推薦流量) | 有可能,取決於條目流量與引用位置 |
| Citation Discovery(引用發現) | 值得關注,其他研究者、作者或網站可能從 Wikipedia 發現你的資料 |
| 品牌可信度 | 視來源與情境而定,不能因為「出現在 Wikipedia」就自動等同權威 |
| 找內容題材 | 很有價值,可以直接看到哪些資訊曾經具有引用需求 |
其中我反而比較看重最後兩件事。
第一個是 Citation Discovery。
研究資料的人很常從 Wikipedia 的 Reference 往原始來源找。如果你的研究、統計或資料真的有用,被其他網站重新引用的機率自然存在。
第二個是 Content Opportunity。
一條 Broken Link 在某種程度上告訴你:
這個資訊以前值得被引用,而且現在可能少了一個來源。
這比單純打開 Keyword Tool(關鍵字工具)看到某個字每月有多少搜尋量,是完全不同的內容研究訊號。
所以如果問我:
「值得為了 Wikipedia Backlink 去大量生文章嗎?」
我的答案是不值得。
但如果問:
「值不值得用 Wikipedia Broken Link 找出已經存在的引用需求,再判斷自己是否能建立真正值得引用的資料?」
這就值得研究。
結論:外掛幫你找機會,內容才決定能不能取代
Wikipedia Broken Links Finder 外掛解決的是 Broken Link Building 裡非常麻煩的一個問題:
到底去哪裡找跟自己主題相關的 Wikipedia Broken Link?
你可以從關鍵字開始搜尋相關 Wikipedia 條目,找出已經被標記的 Broken Link,重新驗證網址目前的狀態,再查看 Citation、Publisher、Archive URL 與上下文。結果還可以匯出成 CSV 或 JSON,進一步做自己的 Link Prospecting 分析。
但需要再強調一次:
找到 Broken Link,不等於找到一條可以直接換成自己網址的 Backlink。
中間還隔著幾個真正需要專業判斷的問題。
原始內容到底是什麼?Wikipedia 為什麼需要它?現在是否真的缺少替代來源?你的網站有沒有資格提供這份資料?你的文章是不是真的比原本來源更完整、更可信、更容易驗證?
這些問題答不出來,外掛找到一千條 Broken Link 也沒有用。
反過來說,如果你真的找到了一個資訊缺口,而且你的專業剛好可以把它補起來,那條 Broken Link 的價值就不只是「一條反向連結」。
它可能告訴你:
網路上本來就需要這份資訊,只是原來提供資訊的人消失了。
Wikipedia Broken Links Finder 外掛負責幫你找到這些地方,至於你能不能取代原來的內容,最後還是看你做出來的東西,值不值得被引用。