AI 可發現性
這項檢查會在你的頁面上讀什麼
語意元素只數五個:article、section、aside、nav、main,看頁面用了哪幾個、總共用了幾個,以及有沒有用 main 元素或 role=main 標出內容區。接著在可見文字裡找版權宣告(©、「all rights reserved」或「版權所有」)和授權聲明(Creative Commons、「licensed under」或「授權條款」這類)。連到 llms.txt 的連結會偵測並回報,但不計分,因為沒有任何主要引擎會讀它。
我們對證據的判定
依證據重新界定範圍重新界定為頁面上的機器可讀性訊號(語意化 HTML、授權清晰度)。已失效的 ai-plugin manifest 檢查已移除,而 llms.txt 僅維持資訊性用途,因為沒有任何主要引擎會讀取它。
Vercel and MERJ AI crawler study (569M GPTBot requests: zero JavaScript execution, no image fetches) · Google Search Central guidance on AI features (no special schema needed, no ideal page length)
讀的是標籤,不是版面:主要內容放在一個普通 div 裡的頁面,人一眼就找得到,這裡照樣低分,靠語意元素分塊的解析器也會用同樣的方式漏掉它。引擎會怎麼處理授權聲明,這裡不知道,只看得出有沒有用解析器找得到的字把它寫出來。這一項要修的東西,沒有一樣需要新檔案或新服務:每一分都是範本裡本來就有的標籤,或是頁尾的一句話。
值多少分
佔「AI 就緒度」的 10%,相當於總分 100 分裡的 3 分。
受檢頁面在這一項的表現
依據 30,738 個受檢頁面。
中位數頁面得 59 分,中間一半的頁面落在 43 到 70 分之間。
- 良好(75 到 100)4,189 (14%)
- 普通(50 到 74)16,122 (52%)
- 待加強(25 到 49)7,416 (24%)
- 嚴重不足(0 到 24)3,011 (10%)
34% 的受檢頁面在這一項低於 50 分。
哪些產業最常不及格、哪些最少
最常不及格的產業
- Gaming:817 個受檢頁面中有 45% 不及格
- Government / GovTech:141 個受檢頁面中有 45% 不及格
- Publishing / News Media:905 個受檢頁面中有 43% 不及格
- Wealth Management / Investment:214 個受檢頁面中有 43% 不及格
- Banking / Neo-banking:363 個受檢頁面中有 42% 不及格
最少不及格的產業
- AI / Machine Learning:477 個受檢頁面中有 17% 不及格
- Digital Health / Health Tech:128 個受檢頁面中有 20% 不及格
- AdTech / Advertising:138 個受檢頁面中有 20% 不及格
- Mental Health / Wellness:117 個受檢頁面中有 21% 不及格
- Cybersecurity:108 個受檢頁面中有 23% 不及格
該怎麼修
- 內容包進 main 元素,每篇獨立的內容用 article,裡面的各部分用 section。
- 選單用 nav、側欄用 aside,解析器才分得出它們和內容的差別。
- 頁尾寫明版權;允許轉載的話,說明是依哪一種授權。