Ahrefs 分析超過一百四十億個網頁,發現九成六以上完全拿不到 Google 的自然流量。常被忽略的成因之一,是不少網站的文章寫了一大堆,彼此卻像散落一地的紙張,沒有人幫它們收成一疊,搜尋引擎自然看不出哪篇是主、哪篇是輔。現在連 ChatGPT、Perplexity 這類 AI 引擎,理解你的網站在談什麼,靠的也是你怎麼把內容連在一起。
內部連結架構,講白了就是用連結把同主題的內容收攏成一個有中心、有層次的群組;最成熟的做法叫主題群集(topic cluster),底層是一種叫 hub-and-spoke 的結構。先從它是什麼、核心頁跟支線頁怎麼分工講起,再一步步拆開怎麼規劃、錨點文字怎麼寫,又有哪些地雷最容易一踩就傷。
主題群集是什麼?核心頁與支線頁的分工邏輯
主題群集就是把一個大主題拆成一篇總覽,加上多篇細分,再用內部連結把它們串成一張網。總覽那篇叫核心頁(pillar page),負責把整個主題講出全貌;圍繞它的那群細分文章叫支線頁(cluster page),每篇只深入講一個小子題。支線頁全部連回核心頁,核心頁也連向各支線頁,這種一個中心、多條輻條的長相,就是 hub-and-spoke 這個名字的由來。

可以把整個結構想成捷運的轉運站。核心頁像轉運站本身,把往各方向的動線指清楚;支線頁像各條支線,深入某個特定的目的地,但每一條支線都連得回轉運站,彼此也可能在某幾站交會。搜尋引擎和 AI 讀著這張連結圖,很快就能摸清楚你在這個主題底下鋪了多深、鋪成什麼形狀。
不少人會把主題群集跟網站原本就有的分類或標籤搞混,兩者其實不是同一件事。分類標籤只是後台的一個資料欄位,文章被歸進哪一類、貼了哪個標籤,對搜尋引擎來說只是一組後設資料,沒有真正在內文裡用有語意的句子把文章連起來。主題群集要做的,是在正文段落裡實際寫出連結與描述性的錨點文字,讓搜尋引擎與 AI 讀到的是完整的一句話,而不只是一個分類欄位。
要強調的是,主題群集不是把舊文章硬湊在一起就算數。它是先有主題規劃,才有內容與連結。少了這個前提,連得再多,也只是把原本就混亂的內容連得更亂。這套方法最早由行銷平台 HubSpot 在 2017 年正式提出並延續沿用至今,核心邏輯是用連結把分散的內容收成有層次的知識結構,而不是單靠關鍵字密度去堆疊排名。
為什麼內部連結是 AI 搜尋引擎讀懂你網站的關鍵?
搜尋引擎不是靠閱讀理解判斷一篇文章好不好,它是順著連結在網站裡移動,再把頁面之間的關係畫成一張圖。內部連結就是它畫這張圖的線索。Google 官方文件明白寫著,一個網站你在意的每一頁,都應該至少有站內另一頁連過去;沒有任何地方連過去的頁面,就算放進網站地圖,也很難被主動發現,這就是俗稱的孤兒頁面。
不是每一個連結傳遞的份量都一樣。Google 一份名為「合理衝浪者(Reasonable Surfer)」的專利文件指出,使用者點擊連結的機率會因為連結出現的位置與上下文而不同,放在正文段落裡、跟內容緊密相關的連結,比塞在導覽列或頁尾的連結更容易被點擊,傳遞的權重也更高。這也是為什麼同一個網站,首頁通常權重最高,因為幾乎每一頁都連得回去。
AI 搜尋則把這件事推得更遠。根據 OpenAI 官方文件,它把爬蟲拆成三種角色:GPTBot 負責訓練資料蒐集、OAI-SearchBot 負責搜尋索引、ChatGPT-User 則是使用者問問題當下才即時抓取。Perplexity 官方文件同樣拆出 PerplexityBot 與 Perplexity-User 兩種角色。分工愈細,代表這些引擎判讀一個網站,愈不是單純數連結數量,而是要理解這個連結出現在什麼語意脈絡裡。
它們背後的語言模型讀到的不只是一頁用某個錨點連到另一頁,而是連結前後那整句話,從中拆出問題、解法與目的地主題,織成一張類似知識圖譜的關係網。Princeton 大學與 Allen Institute for AI 等機構在一份 GEO(Generative Engine Optimization)研究裡也發現,內容有沒有具體數據與可查證的佐證,會明顯影響它被生成式引擎引用的機率。換句話說,內容的脈絡愈清楚、佐證愈具體,愈容易被 AI 判讀成一個能引用的知識點。
把這幾個訊號倒過來看,主題群集幾乎是為它們量身打造的,核心頁與支線頁互連撐起涵蓋度,描述性的錨點文字餵給 AI 足夠的上下文,群集也把重要內容拉到離首頁不遠的位置、顧到爬取效率。結構做得清楚,搜尋引擎與 AI 判讀你網站的難度就會低很多。
六步驟規劃你的 hub-and-spoke 內部連結架構
規劃主題群集,重點不在連結技巧,而在先想清楚主題地圖,再動手連。以下六個步驟照順序跑一遍,就有機會建出一套 Google 和 AI 都讀得懂的內部連結架構。

步驟一:鎖定一個你想在搜尋引擎稱霸的核心主題
別貪心一次做十個主題。先挑一個你真正想被搜尋引擎認定為專業的領域,它通常對應一個搜尋量大、競爭也大的主題詞,例如「內容行銷」或「電商經營」。這個主題要夠大,大到底下能拆出八到十二個子題;但也不能大到漫無邊際,連自己都說不清楚範圍在哪。判準很簡單,能不能用一句話講出「這個群集是在幫讀者解決什麼問題」,講不出來,主題就還沒收斂好。
步驟二:把核心頁寫成全貌,細節留給支線頁
核心頁的角色是把整個主題講個概觀,廣度要夠,但每個子題點到為止,細節留給支線頁展開。它像整個群集的總部,所有相關內容都會指向它。核心頁最好放在離首頁不遠的位置,重要頁面愈接近首頁,愈容易被使用者與爬蟲找到,Google 官方文件也建議重要頁面應該在幾次點擊內就能抵達。寫核心頁時,留一個頁內錨點式目錄會很有幫助,讀者方便跳轉,搜尋引擎與 AI 也更容易抓出這頁的結構。
步驟三:從搜尋意圖裡,列出八到十二個支線題目
接著把這個大主題能延伸的問題一一列出來,每一個問題寫成一篇支線頁。子題從哪裡找?最實在的來源是搜尋結果頁底下的相關問題與相關搜尋詞,那裡就是真實讀者的疑問清單。一個成熟的群集大約是核心頁搭配八到十二篇支線頁,太少撐不起權威,太多又容易子題重疊、彼此搶同一組關鍵字。每篇支線頁只專心回答一個子題,不要又想把整個大主題重講一遍。
步驟四:把連結織成三個方向都通的網
這一步是整個架構的核心動作。連結要做到三個方向都通:
- 每篇支線頁都要連回核心頁,讓搜尋引擎知道這些文章同屬一個主題中心。
- 核心頁要連向它底下的每一篇支線頁,形成中心發散的結構。
- 同主題的支線頁彼此之間也要挑相關的互連,每篇大約再連到兩三篇關係最近的同群文章。
第三點最常被忽略,卻是讓整個群集四面八方都走得通的關鍵。美國 SEO 顧問公司 Zyppy 分析約 2300 萬條內部連結、涵蓋 1800 個網站後發現,內部連結數落在四十到四十四條區間的頁面,從 Google 搜尋拿到的點擊量,大約是連結數只有零到四條頁面的四倍。連結是雙向、支線之間也互通,搜尋引擎與 AI 才能把這組內容讀成一張完整的網,而不是一條只能單向走的死路。

步驟五:把每個錨點文字都寫成具體描述
連到哪一頁,錨點文字就要說清楚那頁在講什麼。把「點這裡」、「看更多」這種空錨點,換成能描述目的地內容的自然語句。連結前後那句話也要帶出為什麼值得點過去,因為搜尋引擎與 AI 讀的是整段語意,不是孤立的幾個字。錨點文字的比例怎麼抓,下一節會用具體數字拆給你看。
步驟六:每發一篇新文章,就回頭幫舊文章補連結
群集不是一次蓋完就收工。每當新增一篇支線頁,回到三到五篇相關的舊文章,補上指向新文章的連結。這個動作一次做兩件事:新文章不會變成沒人連的孤兒,能更快被爬到、收錄、評分;舊文章也因為加了新連結,對爬蟲送出「這裡有更新」的新鮮度訊號。AI 引擎既然把索引用的爬蟲跟一般爬取分開處理,新文章上線就有幾條連結導入,往往能更快被找到。
下面這張表,把六個步驟濃縮成一眼可查的對照,方便動手時逐項核對。
| 步驟 | 在做什麼 | 關鍵判準 |
|---|---|---|
| 一、選核心主題 | 鎖定一個想被認定為權威的領域 | 一句話講得出這個群集要解決什麼問題 |
| 二、寫核心頁 | 把主題講個全貌、留頁內錨點目錄 | 廣度要夠,細節留給支線頁 |
| 三、列支線子題 | 從相關問題與搜尋詞拆出八到十二個子題 | 一篇支線只回答一個子題 |
| 四、織雙向連結 | 支線連回核心、核心連向支線、支線互連 | 每篇支線再連兩到三篇同群文章 |
| 五、寫描述性錨點 | 錨點與前後句都帶足語意 | 不用空錨點、不重複堆同一組關鍵字 |
| 六、持續補連結 | 新文上線就回補三到五條舊文連結 | 不留孤兒頁,送出更新訊號 |
錨點文字比例該怎麼抓,才不會被當成操縱排名?
錨點文字是超連結上那段可以點擊的文字,它是搜尋引擎判斷目的地頁面在講什麼的重要依據,也是 AI 拆解內容關係的入口。一條好的錨點,要讓人和機器光看那幾個字,就大致知道點過去會讀到什麼。
最該避開的是「點這裡」、「閱讀更多」這種空錨點。對讀者來說它沒提供任何預期,對搜尋引擎來說,它等於一個沒有標示的路牌。把它換成能描述目的地的句子,比方連到一篇講錨點文字寫法的文章,錨點寫成「錨點文字怎麼寫」就遠勝過「看更多」。
不過也別走到另一個極端,把每條連結都塞成一模一樣的精準關鍵字。如果整站的內部連結錨點都寫「內部連結架構」、「內部連結架構」,搜尋引擎反而會覺得刻意,像在操縱排名。前面提到的 Zyppy 研究也發現一個有意思的現象,錨點文字的變化程度,跟一個頁面從 Google 搜尋拿到的流量高度相關;至少用過一次精準匹配錨點的頁面,流量大約是完全沒有精準匹配錨點的頁面的五倍。這組數字合起來看的意思是,精準關鍵字不是不能用,而是不能只用同一種,健康的做法是混搭,主力用描述性的自然語句,搭配少量精準關鍵字,再加上品牌或泛指類的錨點。
| 錨點類型 | 大致比例 | 例子 |
|---|---|---|
| 描述性自然語句 | 約五到六成 | 「主題群集的規劃步驟」、「錨點文字怎麼分配」 |
| 品牌或泛指詞 | 約二到二點五成 | 品牌名、「這份指南」、「完整教學」 |
| 精準關鍵字 | 約一到一點五成 | 「內部連結架構」、「主題群集」 |
這組比例不是硬性規定,而是提醒你別讓精準關鍵字錨點佔太高,多用描述性的自然句子。對 AI 來說,描述性錨點加上完整上下文的句子,能餵給它更多語意線索——問題是什麼,解法是什麼,目的地談的是哪個主題,它就更容易把這條連結讀成一個清楚的知識點,在生成答案時引用。
還有一個常被漏掉的技術細節,連結最好寫在正文段落裡,而不是塞在側邊欄或頁尾。前面提過,合理衝浪者這份專利文件本來就指出,連結出現的位置會影響它被賦予的權重;正文中、跟上下文相關的連結,對搜尋引擎與 AI 傳遞的訊號都最強,環站的導覽列、頁尾連結雖然有助於爬取,語意分量卻低很多。
連結數量、點擊深度與孤兒頁面,最容易踩的地雷
內部連結真正的麻煩,往往不在不會連,而在幾個一錯就傷的細節。把這幾個地雷先認出來,比多連十條連結都實際。
數量失衡,兩個方向都會出事。 連太多,一篇文章硬塞十幾條不相關的連結,讀者不會點,搜尋引擎也會覺得像在刻意操作;連太少,重要頁面連匯入連結都湊不到幾條,權重撐不起來。前面提到的 Zyppy 研究就是很直接的對照組,連結數只有零到四條的頁面,拿到的點擊量遠不如連結數落在四十到四十四條區間的頁面。實務上,一篇一千五到兩千五百字的文章,內文放三到六條內部連結通常剛好;要被 AI 引用的核心頁,最好確保有幾條來自高權重頁面的連結匯入,才會被當成網站專業的中心。
點擊深度太深,頁面愈難被找到。 點擊深度指的是從首頁要點幾次才到得了某一頁。Google 官方文件建議,重要頁面應該讓使用者在幾次點擊內就能抵達;搜尋引擎的爬蟲同樣是靠連結一路點過去,藏得太深的頁面,爬蟲到訪的機會自然變低。這對 AI 更嚴格,因為多數 AI 引擎的爬取預算比 Google 主爬蟲更精打細算,連結太深的內容很可能直接被略過。實務上,重要頁面最好壓在三次點擊以內。
孤兒頁面,對 AI 幾乎等於隱形。 沒有任何內部連結指向的頁面,就是孤兒頁。Google 官方文件寫得很直接,你在意的每一頁都至少要有站內另一頁連過去,否則很難被主動發現與收錄。對 AI 來說,孤兒頁幾乎等於隱形,因為它是順著連結建立理解的,連不到,就當你沒有這一頁。每寫完一篇希望被看見的文章,務必確認它至少有幾個地方連得過去。

連結靠 JavaScript 動態產生,爬蟲可能只看到空白。 Google 官方文件說得很清楚,能被解析的連結必須是用 a 標籤搭配 href 屬性。搜尋引擎對其他格式的連結解讀有限,不少 AI 爬蟲也大多無法執行 JavaScript。主內容和內部連結若只在前端渲染、不存在於原始碼裡,爬蟲看到的就是一片空白。重要的連結,務必讓它出現在原始碼中。
架構上線後,多久該回頭健檢一次?
架構鋪好不代表就一勞永逸,內容會長、連結會斷,定期回頭檢查才能讓群集一直保持健康。抓一個節奏就好,每一季或每次網站大改版之後,跑一次完整健檢,檢查項目剛好對應前面提過的幾個地雷。
先看孤兒頁與點擊深度。用網站健檢類的爬蟲工具掃一遍全站,把沒有任何連結匯入的孤兒頁,以及藏得太深的重要頁面揪出來,從高權重頁面補連結把它們拉上來。再看收錄狀況,從搜尋引擎提供的網站管理後台確認重要頁面有沒有被正常收錄,沒被收錄的頁面,多半就是連結沒接好。
接著檢查錨點文字的分布。把全站的錨點文字攤開來看,如果某一組關鍵字佔了壓倒性多數,代表錨點缺乏多樣性,這時候就要把一部分改寫成描述性的自然語句。最後別忘了確認連結都直達終點,避免一條連結中間轉了好幾次跳轉,每多一次跳轉,爬蟲就多一分中途放棄的機會,權重也在路上漏掉。
新站和舊站的檢查重點不太一樣。新站內容少,重點是先把核心頁和最重要的幾篇支線頁建起來,讓搜尋引擎快速抓到方向,不用急著連很多頁。舊站的問題通常是內容太多、主題太散,這時候的工作比較像清盤:把重複的子題合併、把沒有搜尋價值的薄弱文章處理掉、把散落的內容重新串回對應的群集。方向不同,目的卻一樣,都是讓網站脈絡更清楚。
把這套節奏養成習慣,內部連結架構就不再是發文後才想到要補的瑣事,而是每一篇內容都在替整個主題群加分的長期資產。當 Google 和 AI 都能順著你的連結,一眼讀懂你專精什麼、內容鋪得多深,排名與被引用的機會自然會一點一點往你這邊靠。找一個你最想做出成績的主題,先把核心頁和它的支線群畫出來,剩下的交給時間累積。
