AI SEO/GEO 實測:ChatGPT 與 Gemini 引用來源重疊 17.8%

TL;DR
- 216 次實測顯示,ChatGPT 與 Gemini 回答同一批 SEO 問題時,引用來源的重疊率只有 17.8%
- 問「有沒有推薦的公司」時兩個引擎都會查資料(96.3% 與 92.6%);問操作與觀念時,ChatGPT 只有 3.7% 會查,Gemini 是 66.7%
- 三種問句類型被引用的網域幾乎不重疊。推薦型由人力銀行與電商平台的內容頁、加上同業自製的「SEO 公司推薦」清單文佔據
- 知識型問句的引用位置目前由小型個人部落格持有,其中包含一個以中文命名的網域,並非高權重站台
- 一篇鎖定「查無搜尋量」關鍵字的文章,在該問句的 6 次取樣中出現 5 次,覆蓋率高於台灣規模最大的幾家同業
- 原始資料以 CC BY 4.0 公開,本文每個數字皆可由 研究資料頁的兩個 CSV 重算
目錄
實測設計:36 個問句、兩個引擎、216 次取樣
查資料的比例:引擎之間的差距大於問句類型之間
推薦型問句的來源結構:平台內容頁與同業清單文
知識型問句的來源結構:小型個人部落格
兩個引擎的來源重疊率:17.8%
零搜尋量關鍵字的一個實例
本次實測的限制
對內容配置的實務意義
引言
討論「如何被 AI 引用」的內容,多半預設了一個前提:使用者提問時,AI 會去查資料。
這個前提只在部分情況成立。生成式助理回答問題有兩種模式,一種是即時檢索網頁並列出來源,另一種是直接以模型既有的知識作答、完全不產生任何引用。兩者在介面上的差別並不明顯,一般使用者不會特別注意回答底下有沒有來源標籤,但對經營內容的人來說,差別是決定性的——沒有觸發檢索的問題,內容寫得再好也進不了那個答案。
本次實測要回答的是一個可量測的問題:台灣使用者詢問 SEO 與 GEO(生成式引擎最佳化)相關問題時,哪一類問句會讓 AI 去查資料,而被引用的又是什麼類型的頁面。
實測設計:36 個問句、兩個引擎、216 次取樣
題庫為 36 個問句,依提問形態分為三組:
| 組別 | 題數 | 形態 | 例句 |
|---|---|---|---|
| 推薦型 | 18 | 尋找可委託的對象 | 台灣有哪些不錯的 SEO 顧問或公司可以推薦? |
| 知識型 | 9 | 詢問操作方式 | robots.txt 要怎麼設定才不會擋到 AI 爬蟲? |
| 比較型 | 9 | 詢問兩者差異與取捨 | GA4 跟 Google Search Console 差在哪?企業該先裝哪一個? |
每個問句在 ChatGPT 與 Gemini 各執行三次,合計 216 次取樣,全數完成、無失敗紀錄。取樣時間為 2026 年 9 月 12 日深夜至 13 日凌晨,使用未登入的網頁介面,同一台機器、同一個出口 IP,216 筆執行條件完全一致。
同一問句執行三次,是因為生成式助理的回答帶有隨機性,單次結果無法代表該問句的一般情況。這一點在另一組公開實測中已有紀錄:同一批問句相隔 28 天重測,前次被推薦的店家只有約三成仍在名單上。
統計「是否查資料」的判定方式,是該次回答的引用清單中是否含有指向外部網站內容頁的連結。介面自身的連結(登入、說明、地圖版權標示)與地圖收錄結果均不計入——這一項對 ChatGPT 的推薦型問句影響很大,它的回答經常附帶地圖面板,若把地圖連結算成來源會高估查資料的比例。同一個頁面經常以多個段落片段重複出現在引用清單中,所有頁數統計均已依網址去除片段後去重,避免單一頁面被重複計算。
本次實測另將 seobar.dev 一併納入觀測名單。該網域於 2026 年 8 月 27 日上線,至取樣當日為第 17 天,無任何外部連結,已發布十篇以自有實測數據為主的技術文章。把自己放進被觀測的對象,目的是取得一個乾淨的起點:一個零權威的新站,若持續產出具備方法與數據的專業內容,需要多久才會出現在 AI 的引用來源中。這個問題無法用既有的高權重網域回答——那些站台的能見度累積自多年經營,無法分辨是內容本身有效,還是網域權重在發揮作用。
查資料的比例:引擎之間的差距大於問句類型之間
| 問句類型 | ChatGPT | Gemini |
|---|---|---|
| 推薦型(54 次取樣) | 96.3%(52/54) | 92.6%(50/54) |
| 知識型(27 次取樣) | 3.7%(1/27) | 59.3%(16/27) |
| 比較型(27 次取樣) | 3.7%(1/27) | 74.1%(20/27) |
推薦型問句是唯一兩個引擎行為一致的一組,接近全數觸發檢索。使用者要的是一份具體名單,模型內部知識無法提供可驗證的業者資訊,檢索因此成為必要步驟。
知識型與比較型合併後的落差相當大:ChatGPT 只有 3.7%(2/54)的取樣出現外部來源,Gemini 為 66.7%(36/54)。同樣問「canonical 標籤設錯會有什麼後果」,Gemini 多半會列出幾個來源,ChatGPT 多半直接作答。
這項差異對內容策略的影響是雙向的。對 ChatGPT 而言,教學型內容幾乎沒有進入答案的機會,使用者得到的是模型的既有知識;內容經營者能施力的位置,主要在更長期的實體累積,而非單篇文章的即時檢索。對 Gemini 而言,同一批教學內容有明確且可量測的引用路徑。
推薦型問句的來源結構:平台內容頁與同業清單文
推薦型 18 個問句共取得 102 次含來源的回答。以「該網域出現在多少次取樣中」計算,兩個引擎的前段名單如下。
Gemini(50 次含來源的取樣):
| 網域 | 出現次數 | 性質 |
|---|---|---|
| nabi.104.com.tw | 28 | 人力銀行經營的內容平台 |
| ibest.tw | 22 | SEO 服務商 |
| winho.com.tw | 22 | SEO 服務商 |
| hotspot.com.tw | 16 | 行銷服務商 |
| 91app.com | 15 | 電商 SaaS 平台 |
ChatGPT(52 次含來源的取樣):
| 網域 | 出現次數 | 性質 |
|---|---|---|
| nss.com.tw | 13 | 主機與雲端服務商 |
| pro360.com.tw | 11 | 接案媒合平台 |
| stack.com.tw | 11 | 行銷服務商 |
| nabi.104.com.tw | 8 | 人力銀行經營的內容平台 |
| hotspot.com.tw | 7 | 行銷服務商 |
被引用的頁面高度集中在同一種文體:標題形如「2026 最新 SEO 公司推薦」「台灣 9 大 SEO 公司推薦」的清單式評比文章。其中一部分發布在服務商自有網域上,另一部分來自人力銀行與電商平台的內容行銷專區。
這個位置的競爭條件並不友善。清單文的作者多為經營多年的服務商,而人力銀行與電商平台帶有極高的網域權重,新進者難以在短期內取代。相對可行的路徑是進入既有清單文的名單之中,而非另寫一篇同型文章與之競爭。
知識型問句的來源結構:小型個人部落格
知識型問句的來源結構與推薦型幾乎沒有交集。Gemini 在 16 次含來源的取樣中,出現次數最高的網域為 kyiplay.com、bigboycancode.com 與 tw.wfublog.com,各出現 3 次;其後為 reddit.com 與 blog.csdn.net,各 2 次。清單中另有一個以中文命名的網域 樂創約.tw。
這批網域的共同特徵是規模小、多為個人經營的技術部落格,與推薦型問句中的人力銀行、電商平台形成明顯對比。同一個引擎,在不同問句類型下引用的是完全不同層級的來源。
ChatGPT 在知識型問句的 27 次取樣中,只有 1 次出現外部網頁來源,樣本過小不足以論斷結構。可觀察的現象是那一次列出的 9 個網域全為英文站台,包含 searchenginejournal.com 等國際 SEO 媒體;同一組問句在 Gemini 側則以中文來源為主。這項對比需要更多樣本才能確認,此處僅列為觀察。
對新建立的網站而言,知識型問句的引用位置比推薦型務實得多。目前佔據該位置的並非高權重站台,而競爭者的內容多半未針對可引用性做過處理。
兩個引擎的來源重疊率:17.8%
將 216 次取樣中所有被引用的外部網域去重後:
- ChatGPT 引用 77 個不重複網域,其中 39 個為
.tw結尾(51%) - Gemini 引用 102 個不重複網域,其中 41 個為
.tw結尾(40%) - 兩者的聯集為 152 個網域,同時被兩個引擎引用過的為 27 個,重疊率 17.8%
.tw 結尾僅是台灣來源的保守代理指標,會低估使用 .com 的台灣站台,不宜直接解讀為在地來源占比。重疊率的計算則不受此限制。
17.8% 這個數字的實務意義在於,「被 AI 引用」不是單一狀態。在其中一個引擎取得引用位置,不代表在另一個引擎也具備能見度;針對單一引擎的觀測結果,也不能外推成整體表現。以單次查詢或單一平台判斷品牌能見度,會得到偏差相當大的結論。
零搜尋量關鍵字的一個實例
實測中的問句之一為「台灣做 GEO(生成式引擎優化)的公司有哪些?」。該問句的 6 次取樣中,ahha.tw 的一篇文章出現在其中 5 次(ChatGPT 三次全數出現,Gemini 三次中出現兩次),覆蓋率高於同場的 awoo.ai(4 次)、geomkt.app(4 次)與 leaderweb.com.tw(3 次)。ChatGPT 側列出的網址帶有該平台自行附加的來源追蹤參數,屬於可點擊的引用,而非文字提及。
需要揭露的是,ahha.tw 為本站經營者所有,此處引用的是自有站台的實測結果。
值得注意的並非名次本身,而是這個關鍵字的搜尋端狀態:「GEO 顧問」「AI SEO 公司」這一批詞在關鍵字工具中查無資料,Search Console 的曝光紀錄亦為零。沒有搜尋量代表沒有人為它撰寫內容,不代表沒有人提出這個問題——使用者向助理提問的方式,與在搜尋框輸入的方式並不相同。當競爭者依搜尋量排序決定寫什麼,查無資料的題目就成為空白地帶。
這個觀察的適用範圍有限,僅為單一問句的單次實測結果,不足以支撐「零搜尋量關鍵字普遍可取得引用」這類推論。它提供的是一個檢查方向:既有的關鍵字規劃流程是否把某些實際會被提問、但工具查不到的題目排除在外。
本次實測的限制
- 每個問句僅取樣三次,單一時間窗、單一施測位置。回答具隨機性,本次結果只描述這批觀測。
- 僅涵蓋 ChatGPT 與 Gemini 的未登入網頁介面。登入狀態、付費方案與 API 的行為不必然相同。
- 推薦型問句受發問位置影響。實測中問句已載明「台灣」,兩個引擎仍回覆施測地所在城市的業者,因此區域性結果不可外推至其他地區。
- 「被列為來源」與「答案內容確實由該頁支持」是兩件事。本次僅統計前者,後者需另行人工標註。
- 引用來源的擷取依賴介面當時的呈現方式。介面改版會使擷取失效,且失效的表徵與「行為改變」完全相同——本次前導測試即曾因擷取程式未能取得 Gemini 的來源標籤,得出「Gemini 不查資料」的錯誤結論,修正後同一組問句的比例由 0% 變為 59% 至 74%。任何跨期比較都應先確認擷取方式仍然有效。
對內容配置的實務意義
三項可直接應用的判斷:
依問句類型決定內容形態,而非依關鍵字難度。 推薦型問句的引用位置由平台內容頁與經營多年的服務商清單文佔據,短期內難以取代;知識型問句的位置由小型站台持有,是新進者較務實的切入點。
能見度要分引擎觀測。 兩個引擎的來源重疊率僅 17.8%,單一平台的觀測結果不具代表性。若要作為經營指標,至少需涵蓋兩個引擎,並記錄取樣次數與施測條件。
關鍵字規劃不應只依搜尋量篩選題目。 提問方式與搜尋方式不同,部分在工具中查無資料的題目仍會被實際提出。這類題目的競爭密度通常較低。
回到納入觀測的那個新網域:首次實測的結果是零。seobar.dev 在 216 次回答與全部引用來源中出現次數為零。對一個上線 17 天、零外部連結的網域而言,這是預期中的起點值而非成效指標——沒有起點值,後續的任何變化都無從判讀是內容累積的結果還是取樣波動。
第 30、60、90 天將以相同題庫、相同引擎與相同施測條件重測,結果一併公開。若「產出具方法與數據的專業內容」這條路徑對 AI 引用確實有效,它應該會在某一個時間點反映在這組數字上;若三次重測後仍為零,同樣是值得記錄的結果。
本文所有統計的原始資料公開在研究資料頁,包含 216 次取樣紀錄與 560 列引用來源明細,附資料字典、判定規則與 SHA-256 校驗值,採 CC BY 4.0 授權。上面每一個百分比都可以從那兩個檔案重新算出來;算出不同的結果,歡迎指出。
同一系列的前一篇實測紀錄了更前端的一道門:ChatGPT 開始讀取新網域花了 7 天。內容能否被引用,前提是它先被讀得到。
常見問題
AI 回答問題時一定會查資料嗎?
不一定,而且差別很大。本次 216 次實測中,問「有沒有推薦的公司」時兩個引擎幾乎都會查(ChatGPT 96.3%、Gemini 92.6%);問操作方式與觀念差異時,ChatGPT 只有 3.7% 的回答出現外部網頁來源,Gemini 為 66.7%。沒有觸發檢索的問題,內容寫得再完整也不會進入那則回答。
為什麼同一個問題,ChatGPT 與 Gemini 給的來源不一樣?
本次實測中兩個引擎共引用 152 個不重複網域,同時被兩者引用的只有 27 個,重疊率 17.8%。以推薦型問句為例,Gemini 側出現最多的是人力銀行與電商平台的內容頁,ChatGPT 側則是另一批服務商與接案媒合平台。在一個引擎取得引用位置,不代表在另一個引擎也有能見度。
新網站想被 AI 引用,應該先寫哪一種內容?
依本次觀測,知識型內容較務實。推薦型問句的引用位置由人力銀行、電商平台與經營多年的服務商清單文佔據,短期難以取代;知識型問句的位置則由小型個人部落格持有,競爭密度明顯較低。前提是該引擎會對這類問題觸發檢索——ChatGPT 在知識型問句的 27 次取樣中只有 1 次引用外部網頁。
要怎麼判斷自己的網站有沒有被 AI 引用?
至少要涵蓋兩個引擎、同一問句重複取樣,並記錄施測時間與位置。單次查詢的結果不可靠:回答帶有隨機性,推薦型問句還會受發問位置影響——本次問句已載明「台灣」,兩個引擎仍回覆施測地所在城市的業者。另需注意「被列為來源」與「答案確實由該頁支持」是兩件事。
網站一直搜不到,想知道卡在哪一關?
抓取、索引、排名、AI 引用是四道不同的關卡,卡在哪一關決定要做什麼。把網址給我,我用實際量測看一遍再跟你說。
留言討論
只有會員能留言(防止垃圾訊息),留言顯示於此頁。
