我們先拿自己的網站開刀
2026 年 8 月 3 日和 4 日,我們對 oceanads.org 跑了兩次 GEO 檢測,抓 25 個頁面,六個維度打分,站點平均 80.1。同一天我們把 20 個問題丟給 ChatGPT,其中 17 題是客戶真的會問的那種,像是「我在台灣經營小型網店,有沒有推薦的公司能同時做網站設計、SEO 和 Google Ads」。
17 題,一次都沒有提到我們。被提到的是 Shopify 兩次、WordPress 兩次、Wix 一次。
這份報告把兩邊的數字都放上來,包含那個 0%。客戶問我們 GEO 有沒有用的時候,我們拿得出自己的檢測紀錄,而不是只給一份說明書。
站台被機器讀取的基本條件
這一層是進候選池的門票。缺一項,後面所有努力都收不到。
| 檢查項 | 結果 |
|---|---|
| 頁面可存取率 | 25 / 25 |
| sitemap.xml | 有,收錄 98 條網址 |
| llms.txt | 有 |
| robots.txt 封鎖 AI 抓取器 | 無 |
| 有效內容頁語言 | 中文 19 頁、英文 6 頁 |
25 個頁面全部回傳 200,靜態 HTML 裡都有正文。這件事值得說明一下。很多網站用純前端框架渲染,人用瀏覽器看得到內容,AI 抓取器拿到的是一片空白。我們的網站是靜態 HTML,這一項拿滿分 15 分。
六個維度的實際分數
總分 100,六項加起來 80.1。分數攤開來看比一個總分有用得多。
| 維度 | 滿分 | 全站平均 | 得分率 | 分布 |
|---|---|---|---|---|
| 可抓取性 | 15 | 15.00 | 100% | |
| 可抽取塊 | 25 | 22.80 | 91% | |
| 結構規範 | 20 | 17.43 | 87% | |
| 內容長度 | 15 | 12.29 | 82% | |
| 權威信號 | 15 | 9.56 | 64% | |
| 對題性 | 10 | 3.06 | 31% |
對題性 3.06 分,全站最高的一頁也只有 5.5 分。這是六項裡最難看的一項,偏偏它在實測研究裡是影響力最強的單一預測因子,相關係數 0.432,高過語義相似度的 0.356 和內容品質的 0.292。
它衡量的東西很簡單,標題和小標題裡有沒有出現客戶實際會用的字。我們的頁面標題寫「SEO 優化服務」「數位行銷」,客戶打進 ChatGPT 的是「台中做網站又能跑 Google Ads 的公司」。兩邊的用字對不上,機器就配不起來。
全站有 16 個頁面的標題體系不含目標問題關鍵詞。這是我們這一期最大的缺口,也是接下來要動的地方。
頁面等級分布
沒有 C 和 D。兩期之間站點平均分持平在 80.1,因為這兩天我們只跑檢測,還沒有動內容。
| 等級 | 頁數 | 含義 |
|---|---|---|
| A | 12 | 可直接被引用 |
| B | 13 | 基本可用 |
| C | 0 | 需要改造 |
| D | 0 | 等於不存在 |
分數最低的幾頁集中在英文區和部落格。
| 分數 | 詞數 | 缺的抽取塊 | 頁面 |
|---|---|---|---|
| 71.2 | 753 | 對比、操作步驟 | en/case-esim.html |
| 72.5 | 844 | 對比、操作步驟 | en/case-yuxiang.html |
| 73.1 | 1068 | 定義、FAQ | blog/article-8.html |
| 73.2 | 673 | 操作步驟、FAQ | en/pricing.html |
| 74.0 | 992 | 對比、操作步驟 | en/case-gpnet.html |
| 74.2 | 918 | 無 | 首頁 |
首頁 74.2 分,比幾篇部落格文章還低。它的抽取塊沒有缺,扣分扣在正文沒有可見的發布或更新日期,機器判斷不了時效性。
全站抽取塊缺口
可抽取塊在評分裡權重最重,佔 25 分。這張表是 GEO 最大的施力點。
| 抽取塊 | 缺失頁數 | 實測影響力增益 |
|---|---|---|
| 操作步驟 | 5 / 25 | +41.2% |
| 對比 | 3 / 25 | +55.3% |
| FAQ | 3 / 25 | 無顯著增益,利於問答召回 |
| 定義 | 1 / 25 | +57.3% |
| 數字事實 | 0 / 25 | +61.6% |
數字事實一頁都不缺,這是我們寫文案的習慣帶來的,交付天數、覆蓋國家數、收錄率都寫在正文裡。缺得最多的是操作步驟,五個頁面沒有可被抽走的步驟塊。
AI 答案採樣,以及必須先講清楚的口徑
這一段的數字最容易被誤讀,所以先說明採樣條件。
| 項目 | 本期設定 |
|---|---|
| 平台 | OpenAI(ChatGPT) |
| 端點 | API |
| 聯網檢索 | 關閉 |
| 證據等級 | B(API 可復現樣本) |
| 題數 | 20 題,其中品牌驗證 3 題 |
| 採樣日期 | 2026-08-03 |
聯網關閉,代表這次測的是模型參數裡記得什麼,不是它上網搜尋後會找到什麼。這兩件事的數字不能合併計算,網頁版 ChatGPT 會檢索,API 預設不會。我們只跑了 API,所以只能報 API 的結果。
17 題推薦類與比較類問題的結果如下。
| 指標 | 數值 |
|---|---|
| 品牌提及率 | 0% |
| 首位率 | 0% |
| Top3 率 | 0% |
| 自家網域被引用率 | 0% |
| 競品提及 | Shopify 2、WordPress 2、Wix 1 |
另外 3 題直接點名問我們,例如「有人跟海水不可斗量數位工作室合作過嗎,他們是正派經營的嗎」。三題的辨識率同樣是 0%。ChatGPT 的回答裡有一句話把原因講得很直白。
I don't have specific information about individual companies or their reputations beyond October 2023.
OpenAI API 回答原文 · 2026-08-03 · 題號 q116
它接著建議提問者去 Google 評論、Facebook 或台灣本地論壇查看評價,再看看對方的作品集。
這個結果對一家 2023 年之後才把網站做起來的工作室來說是合理的。它同時說明了兩件事。模型的參數化記憶裡沒有我們,短期內也不會有,那不是改幾個標題能解決的。而 ChatGPT 建議去查的地方,Google 評論、Facebook、本地論壇、作品集,全部在我們的網站以外。
官網在整條引用鏈裡的真實位置
有一組實算數字改變了我們分配力氣的方式。
| 信源類別 | 佔全庫引用 | 分布 |
|---|---|---|
| 內容平台 | 16.4% | |
| 綜合新聞媒體 | 13.6% | |
| 商業推薦與榜單站 | 9.1% | |
| 品牌官網與企業站 | 1.37% |
官網的職能是事實源,讓 AI 描述你的時候口徑正確、別把你歸錯行業。引用來源在別的地方。把官網從 60 分做到 90 分的邊際收益,低於在一個榜單站拿到一則詞條。
這也是為什麼我們把外部信源建設排在 P1,而不是排在技術修復後面的 P2。
本期的待辦清單
沒有 P0。robots 沒封、頁面沒空殼、sitemap 和結構化資料都在,門票問題這一關算是過了。
| 優先級 | 動作 | 影響頁數 |
|---|---|---|
| P1 | 標題體系補進目標問題的實際用字 | 16 |
| P1 | 正文補到 1000 詞門檻以上 | 8 |
| P1 | H2 小節拆到 6 至 10 節 | 5 |
| P1 | 補「操作步驟」塊 | 5 |
| P1 | 補「對比」塊 | 3 |
| P1 | 補「FAQ」塊 | 3 |
| P1 | 補「定義」塊 | 1 |
| P1 | 首頁補上可見的發布或更新日期 | 1 |
| P2 | 補外部來源引用,加強證據鏈 | 25 |
我們提供的 GEO 服務
上面那份報告是我們替自己做的。同一套流程、同一份評分口徑,可以照樣用在你的網站上。服務分五項,可以整包做,也可以只做其中一兩項。每一項下面都寫清楚做什麼、交什麼、怎麼算完成。
GEO 健檢報告
適合誰 網站已經上線、想知道自己在 AI 答案裡實際位置的人。不確定 GEO 值不值得投入的人也適合,健檢的用途就是讓你有數字可以判斷。
先確認要不要做,再談怎麼做。健檢是我們接一個新客戶的第一件事。
- 做什麼
- 把你的網站整站抓下來,每一頁按六個維度打分,同時檢查站點層的設定。抓完之後,我們會挑出你這個行業客戶真的會問的問題,丟給 AI 平台跑一輪採樣,看看目前的答案裡有沒有你、有沒有你的同行。
- 交什麼
- 一份跟上面同樣格式的報告,包含站點層檢查結果、六維分數與得分率、頁面等級分布、分數最低的頁面清單、全站抽取塊缺口、AI 採樣指標與環境紀錄,以及一份分好優先級的待辦清單。
- 怎麼算完成
- 報告交出來,我們用一次線上會議帶你看完,說明哪幾條是門票問題、哪幾條可以延後。你看完再決定要不要繼續。
頁面技術修復
適合誰 所有網站都要做,這是最低成本、最快見效的一層。用 JavaScript 框架做的網站尤其該先做這一項。
這一層處理的是能不能被抓到、抓到以後讀不讀得懂。
- 做什麼
- robots.txt 逐段檢查與重寫,放行該放行的 AI 抓取器、擋掉不帶流量的工具爬蟲。補上 llms.txt 與 sitemap.xml。檢查是否有前端渲染造成的空殼頁,靜態 HTML 裡沒有正文的頁面要補回伺服器端輸出。JSON-LD 結構化資料按頁面類型補齊,Organization、FAQPage、Article、BreadcrumbList 這幾種最常缺。
- 交什麼
- 改好的 robots.txt 與 llms.txt、每頁的 JSON-LD 片段、修復前後的可抓取性分數對照。
- 怎麼算完成
- 重抓一次網站,可抓取性維度拿到滿分 15 分,站點層檢查全部通過。這一項可以程式判定,不靠口頭確認。
內容工程
適合誰 已經做完技術修復、想真正進入 AI 答案的客戶。這一項最花時間,通常需要三到六個月的內容累積。
分數權重最重的一層,也是拉開差距的地方。抽取塊有五種,實測影響力增益分別是數字事實 61.6%、定義 57.3%、對比 55.3%、操作步驟 41.2%。FAQ 沒有顯著增益,但利於問答召回。
- 做什麼
- 按問題庫盤點站內有沒有對應的內容承接,缺的補新頁,有的改寫。改寫的重點放在四件事上,標題與小標題改成客戶實際會打的字,正文補到 1000 詞門檻以上,H2 拆到 6 到 10 節,補進缺的抽取塊。
- 交什麼
- 每個目標問題一份內容大綱,含標題候選、章節骨架、字數與抽取塊要求。需要我們代筆的話,正文由人按大綱寫,不用模型直接生成後就發布。
- 怎麼算完成
- 改過的頁面重跑檢測,可抽取塊與對題性兩個維度的分數要往上動,缺口統計裡的對應項目歸零。
外部信源建設
適合誰 技術與內容都做到位、但採樣結果仍然看不到自己的客戶。多數情況下,問題出在這一層。
我們把這一項排在 P1,理由在上面那張引用來源分布表。官網只佔全庫引用的 1.37%。
- 做什麼
- 從採樣結果裡看 AI 實際引用了哪些網域,按那份名單去鋪,不按主觀印象鋪。內容平台、產業媒體、商業推薦與榜單站是三個主要方向。同時處理實體消歧,讓品牌名在各處的寫法與描述口徑一致。
- 交什麼
- 一份按採樣結果排序的信源清單,含每個目標站台的收錄條件與投稿方式,以及統一過的品牌事實卡。
- 怎麼算完成
- 這一項有部分無法程式判定。詞條有沒有過審、投稿有沒有刊出,需要人工確認後標記。我們會在工單裡標成待人工,不會混進自動驗收的數字裡。
AI 答案監測
適合誰 已經投入 GEO、需要向老闆或客戶交代成效的人。也適合競爭激烈的產業,同行動作會反映在你的排序上。
做完不等於結束,指標本身會漂移。
- 做什麼
- 按固定週期把問題庫丟給各家 AI,記錄答案原文、是否聯網、終端類型與採樣時間。API 與網頁端分開算,網頁版與 App 分開算。指標看四層,提及率、首位率與 Top3、描述準確率、引用品質。
- 交什麼
- 每期一份報告,含與上期的差異對照、新出現的高優先級問題、AI 實際引用的網域排行。採樣原始檔一併交付,你可以自己複核。
- 怎麼算完成
- 這是持續性服務,沒有完成的時點。我們建議頁面檢測每週跑一次,答案採樣每兩週或每月一次。跑太密看不出訊號,採樣本身也有成本。
費用與合作方式
健檢報告免費。正式合作依網站規模、頁數與目標市場報價,不綁長約。
所有帳號開在你名下,我們以受邀權限進去操作。合作結束你撤銷權限即可,報告、採樣原始檔與資產全部留在你手上。
動你的網站之前,我們會先把要改的項目列清楚給你過目,你點頭才執行。
我們不承諾的事
沒有人能保證某個平台一定會引用某個頁面。GEO 提高的是被檢索到、被選進引用清單、被吸收進答案的機率,不是保證。
這份報告裡的數字是觀察到的相關性。要把排名上升講成某個動作造成的因果,需要基線窗口、對照題組和競品對照,我們會標明哪一段有這些條件、哪一段沒有。
沒有答案原文、截圖或採樣環境紀錄的結果,我們不會標成真實採樣。每一筆採樣都留原始回答與環境參數。
品牌事實卡裡查不到的欄位一律標待確認,不用常識填充。成立時間、工商登記主體、可具名客戶案例,在客戶補齊之前保持空白。
檢測日期 2026 年 8 月 4 日。評分口徑、閾值依據與採樣紀律,見分析方式說明。