geo report · oceanads.org

我們先拿自己的網站開刀

2026 年 8 月 3 日和 4 日,我們對 oceanads.org 跑了兩次 GEO 檢測,抓 25 個頁面,六個維度打分,站點平均 80.1。同一天我們把 20 個問題丟給 ChatGPT,其中 17 題是客戶真的會問的那種,像是「我在台灣經營小型網店,有沒有推薦的公司能同時做網站設計、SEO 和 Google Ads」。

17 題,一次都沒有提到我們。被提到的是 Shopify 兩次、WordPress 兩次、Wix 一次。

這份報告把兩邊的數字都放上來,包含那個 0%。客戶問我們 GEO 有沒有用的時候,我們拿得出自己的檢測紀錄,而不是只給一份說明書。

檢測日期 2026-08-04 抓取頁數 25 採樣題數 20 證據等級 B
大人與孩子在工作坊的木桌前一起動手組裝零件
80.1 站點六維平均分(滿分 100)
25 / 25 頁面可存取,靜態 HTML 有正文
31% 對題性得分率,六項裡最弱
0% ChatGPT 17 題的品牌提及率
crawlability

站台被機器讀取的基本條件

這一層是進候選池的門票。缺一項,後面所有努力都收不到。

站點層檢查 · 2026-08-04
檢查項 結果
頁面可存取率 25 / 25
sitemap.xml 有,收錄 98 條網址
llms.txt
robots.txt 封鎖 AI 抓取器
有效內容頁語言 中文 19 頁、英文 6 頁

25 個頁面全部回傳 200,靜態 HTML 裡都有正文。這件事值得說明一下。很多網站用純前端框架渲染,人用瀏覽器看得到內容,AI 抓取器拿到的是一片空白。我們的網站是靜態 HTML,這一項拿滿分 15 分。

six dimensions

六個維度的實際分數

總分 100,六項加起來 80.1。分數攤開來看比一個總分有用得多。

全站 25 頁平均 · 依得分率排序
維度 滿分 全站平均 得分率 分布
可抓取性 15 15.00 100%
可抽取塊 25 22.80 91%
結構規範 20 17.43 87%
內容長度 15 12.29 82%
權威信號 15 9.56 64%
對題性 10 3.06 31%

對題性 3.06 分,全站最高的一頁也只有 5.5 分。這是六項裡最難看的一項,偏偏它在實測研究裡是影響力最強的單一預測因子,相關係數 0.432,高過語義相似度的 0.356 和內容品質的 0.292。

它衡量的東西很簡單,標題和小標題裡有沒有出現客戶實際會用的字。我們的頁面標題寫「SEO 優化服務」「數位行銷」,客戶打進 ChatGPT 的是「台中做網站又能跑 Google Ads 的公司」。兩邊的用字對不上,機器就配不起來。

全站有 16 個頁面的標題體系不含目標問題關鍵詞。這是我們這一期最大的缺口,也是接下來要動的地方。

page grades

頁面等級分布

沒有 C 和 D。兩期之間站點平均分持平在 80.1,因為這兩天我們只跑檢測,還沒有動內容。

25 頁等級分布
等級 頁數 含義
A 12 可直接被引用
B 13 基本可用
C 0 需要改造
D 0 等於不存在

分數最低的幾頁集中在英文區和部落格。

分數最低的頁面 · 由低至高
分數 詞數 缺的抽取塊 頁面
71.2 753 對比、操作步驟 en/case-esim.html
72.5 844 對比、操作步驟 en/case-yuxiang.html
73.1 1068 定義、FAQ blog/article-8.html
73.2 673 操作步驟、FAQ en/pricing.html
74.0 992 對比、操作步驟 en/case-gpnet.html
74.2 918 首頁

首頁 74.2 分,比幾篇部落格文章還低。它的抽取塊沒有缺,扣分扣在正文沒有可見的發布或更新日期,機器判斷不了時效性。

extractable blocks

全站抽取塊缺口

可抽取塊在評分裡權重最重,佔 25 分。這張表是 GEO 最大的施力點。

缺失頁數與實測影響力增益
抽取塊 缺失頁數 實測影響力增益
操作步驟 5 / 25 +41.2%
對比 3 / 25 +55.3%
FAQ 3 / 25 無顯著增益,利於問答召回
定義 1 / 25 +57.3%
數字事實 0 / 25 +61.6%

數字事實一頁都不缺,這是我們寫文案的習慣帶來的,交付天數、覆蓋國家數、收錄率都寫在正文裡。缺得最多的是操作步驟,五個頁面沒有可被抽走的步驟塊。

ai answer sampling

AI 答案採樣,以及必須先講清楚的口徑

這一段的數字最容易被誤讀,所以先說明採樣條件。

採樣環境紀錄
項目 本期設定
平台 OpenAI(ChatGPT)
端點 API
聯網檢索 關閉
證據等級 B(API 可復現樣本)
題數 20 題,其中品牌驗證 3 題
採樣日期 2026-08-03

聯網關閉,代表這次測的是模型參數裡記得什麼,不是它上網搜尋後會找到什麼。這兩件事的數字不能合併計算,網頁版 ChatGPT 會檢索,API 預設不會。我們只跑了 API,所以只能報 API 的結果。

17 題推薦類與比較類問題的結果如下。

17 題推薦與比較類問題 · OpenAI API 端
指標 數值
品牌提及率 0%
首位率 0%
Top3 率 0%
自家網域被引用率 0%
競品提及 Shopify 2、WordPress 2、Wix 1

另外 3 題直接點名問我們,例如「有人跟海水不可斗量數位工作室合作過嗎,他們是正派經營的嗎」。三題的辨識率同樣是 0%。ChatGPT 的回答裡有一句話把原因講得很直白。

I don't have specific information about individual companies or their reputations beyond October 2023.

OpenAI API 回答原文 · 2026-08-03 · 題號 q116

它接著建議提問者去 Google 評論、Facebook 或台灣本地論壇查看評價,再看看對方的作品集。

這個結果對一家 2023 年之後才把網站做起來的工作室來說是合理的。它同時說明了兩件事。模型的參數化記憶裡沒有我們,短期內也不會有,那不是改幾個標題能解決的。而 ChatGPT 建議去查的地方,Google 評論、Facebook、本地論壇、作品集,全部在我們的網站以外。

where citations come from

官網在整條引用鏈裡的真實位置

有一組實算數字改變了我們分配力氣的方式。

187,818 條去重引用的來源分布
信源類別 佔全庫引用 分布
內容平台 16.4%
綜合新聞媒體 13.6%
商業推薦與榜單站 9.1%
品牌官網與企業站 1.37%

官網的職能是事實源,讓 AI 描述你的時候口徑正確、別把你歸錯行業。引用來源在別的地方。把官網從 60 分做到 90 分的邊際收益,低於在一個榜單站拿到一則詞條。

這也是為什麼我們把外部信源建設排在 P1,而不是排在技術修復後面的 P2。

action items

本期的待辦清單

沒有 P0。robots 沒封、頁面沒空殼、sitemap 和結構化資料都在,門票問題這一關算是過了。

工單 · 依優先級與影響頁數排序
優先級 動作 影響頁數
P1 標題體系補進目標問題的實際用字 16
P1 正文補到 1000 詞門檻以上 8
P1 H2 小節拆到 6 至 10 節 5
P1 補「操作步驟」塊 5
P1 補「對比」塊 3
P1 補「FAQ」塊 3
P1 補「定義」塊 1
P1 首頁補上可見的發布或更新日期 1
P2 補外部來源引用,加強證據鏈 25
geo services

我們提供的 GEO 服務

上面那份報告是我們替自己做的。同一套流程、同一份評分口徑,可以照樣用在你的網站上。服務分五項,可以整包做,也可以只做其中一兩項。每一項下面都寫清楚做什麼、交什麼、怎麼算完成。

GEO 健檢報告

適合誰 網站已經上線、想知道自己在 AI 答案裡實際位置的人。不確定 GEO 值不值得投入的人也適合,健檢的用途就是讓你有數字可以判斷。

先確認要不要做,再談怎麼做。健檢是我們接一個新客戶的第一件事。

做什麼
把你的網站整站抓下來,每一頁按六個維度打分,同時檢查站點層的設定。抓完之後,我們會挑出你這個行業客戶真的會問的問題,丟給 AI 平台跑一輪採樣,看看目前的答案裡有沒有你、有沒有你的同行。
交什麼
一份跟上面同樣格式的報告,包含站點層檢查結果、六維分數與得分率、頁面等級分布、分數最低的頁面清單、全站抽取塊缺口、AI 採樣指標與環境紀錄,以及一份分好優先級的待辦清單。
怎麼算完成
報告交出來,我們用一次線上會議帶你看完,說明哪幾條是門票問題、哪幾條可以延後。你看完再決定要不要繼續。

頁面技術修復

適合誰 所有網站都要做,這是最低成本、最快見效的一層。用 JavaScript 框架做的網站尤其該先做這一項。

這一層處理的是能不能被抓到、抓到以後讀不讀得懂。

做什麼
robots.txt 逐段檢查與重寫,放行該放行的 AI 抓取器、擋掉不帶流量的工具爬蟲。補上 llms.txt 與 sitemap.xml。檢查是否有前端渲染造成的空殼頁,靜態 HTML 裡沒有正文的頁面要補回伺服器端輸出。JSON-LD 結構化資料按頁面類型補齊,Organization、FAQPage、Article、BreadcrumbList 這幾種最常缺。
交什麼
改好的 robots.txt 與 llms.txt、每頁的 JSON-LD 片段、修復前後的可抓取性分數對照。
怎麼算完成
重抓一次網站,可抓取性維度拿到滿分 15 分,站點層檢查全部通過。這一項可以程式判定,不靠口頭確認。

內容工程

適合誰 已經做完技術修復、想真正進入 AI 答案的客戶。這一項最花時間,通常需要三到六個月的內容累積。

分數權重最重的一層,也是拉開差距的地方。抽取塊有五種,實測影響力增益分別是數字事實 61.6%、定義 57.3%、對比 55.3%、操作步驟 41.2%。FAQ 沒有顯著增益,但利於問答召回。

做什麼
按問題庫盤點站內有沒有對應的內容承接,缺的補新頁,有的改寫。改寫的重點放在四件事上,標題與小標題改成客戶實際會打的字,正文補到 1000 詞門檻以上,H2 拆到 6 到 10 節,補進缺的抽取塊。
交什麼
每個目標問題一份內容大綱,含標題候選、章節骨架、字數與抽取塊要求。需要我們代筆的話,正文由人按大綱寫,不用模型直接生成後就發布。
怎麼算完成
改過的頁面重跑檢測,可抽取塊與對題性兩個維度的分數要往上動,缺口統計裡的對應項目歸零。

外部信源建設

適合誰 技術與內容都做到位、但採樣結果仍然看不到自己的客戶。多數情況下,問題出在這一層。

我們把這一項排在 P1,理由在上面那張引用來源分布表。官網只佔全庫引用的 1.37%。

做什麼
從採樣結果裡看 AI 實際引用了哪些網域,按那份名單去鋪,不按主觀印象鋪。內容平台、產業媒體、商業推薦與榜單站是三個主要方向。同時處理實體消歧,讓品牌名在各處的寫法與描述口徑一致。
交什麼
一份按採樣結果排序的信源清單,含每個目標站台的收錄條件與投稿方式,以及統一過的品牌事實卡。
怎麼算完成
這一項有部分無法程式判定。詞條有沒有過審、投稿有沒有刊出,需要人工確認後標記。我們會在工單裡標成待人工,不會混進自動驗收的數字裡。

AI 答案監測

適合誰 已經投入 GEO、需要向老闆或客戶交代成效的人。也適合競爭激烈的產業,同行動作會反映在你的排序上。

做完不等於結束,指標本身會漂移。

做什麼
按固定週期把問題庫丟給各家 AI,記錄答案原文、是否聯網、終端類型與採樣時間。API 與網頁端分開算,網頁版與 App 分開算。指標看四層,提及率、首位率與 Top3、描述準確率、引用品質。
交什麼
每期一份報告,含與上期的差異對照、新出現的高優先級問題、AI 實際引用的網域排行。採樣原始檔一併交付,你可以自己複核。
怎麼算完成
這是持續性服務,沒有完成的時點。我們建議頁面檢測每週跑一次,答案採樣每兩週或每月一次。跑太密看不出訊號,採樣本身也有成本。

費用與合作方式

健檢報告免費。正式合作依網站規模、頁數與目標市場報價,不綁長約。

所有帳號開在你名下,我們以受邀權限進去操作。合作結束你撤銷權限即可,報告、採樣原始檔與資產全部留在你手上。

動你的網站之前,我們會先把要改的項目列清楚給你過目,你點頭才執行。

boundaries

我們不承諾的事

不保證特定平台一定引用

沒有人能保證某個平台一定會引用某個頁面。GEO 提高的是被檢索到、被選進引用清單、被吸收進答案的機率,不是保證。

歸因預設寫成觀察相關

這份報告裡的數字是觀察到的相關性。要把排名上升講成某個動作造成的因果,需要基線窗口、對照題組和競品對照,我們會標明哪一段有這些條件、哪一段沒有。

沒有紀錄的不算真實採樣

沒有答案原文、截圖或採樣環境紀錄的結果,我們不會標成真實採樣。每一筆採樣都留原始回答與環境參數。

查不到的事實標為待確認

品牌事實卡裡查不到的欄位一律標待確認,不用常識填充。成立時間、工商登記主體、可具名客戶案例,在客戶補齊之前保持空白。

檢測日期 2026 年 8 月 4 日。評分口徑、閾值依據與採樣紀律,見分析方式說明

free geo audit

想知道你的網站在 AI 答案裡長什麼樣

給我們網址,我們用同一套口徑跑一次,把你的六維分數、抽取塊缺口和採樣結果整理成同樣格式的報告。看完再決定要不要做。