結構化資料品質
本頁為英文版的中文翻譯,僅供參考。如中英文版本有任何歧義,概以英文版為準。
這項檢查會在你的頁面上讀什麼
這一項看的是 HTML 裡引擎可以直接抽出數值的結構,而且只算內文:放在 nav、header、footer 或側欄裡的清單和表格一律排除。給分的有四種:有標題列的表格、正文裡三項以上的清單、用兩欄表格或 dl 定義清單列出來的對應資料(左邊名稱、右邊數值),還有說明這張表在比什麼的 caption。Schema.org 標記在這裡只拿來判斷頁面類型,不計分,那是「Schema 標記完整性」的事。
我們對證據的判定
依證據重新界定範圍重新界定為 HTML 本身中可擷取的資料結構(表格與清單),這些結構能可衡量地提升機器擷取效果。這與 schema.org 標記不同,後者在對照測試中並未顯示對 AI 引用的提升。
GEO: Generative Engine Optimization (arXiv 2311.09735) · Ahrefs controlled schema test (1,885 treated pages vs matched controls)
數字放在欄位標題底下,它的意思會跟著欄位一起被引出去;同一個數字夾在句子中間,引擎只能從前後文去猜。這一項說得準的,也就只有一件事:頁面上的數值旁邊,有沒有掛著它自己的標籤。看的是標記的結構,不是內容:表格裡的數字對不對、這張表是不是讀者要的那一張,這裡都不管,標題列擺錯欄位一樣有分。
值多少分
佔「頁面內容」的 18%,相當於總分 100 分裡的 4.5 分。
受檢頁面在這一項的表現
依據 30,738 個受檢頁面。
中位數頁面得 13 分,中間一半的頁面落在 0 到 27 分之間。
- 良好(75 到 100)106 (0%)
- 普通(50 到 74)1,097 (4%)
- 待加強(25 到 49)7,881 (26%)
- 嚴重不足(0 到 24)21,654 (70%)
96% 的受檢頁面在這一項低於 50 分。
哪些產業最常不及格、哪些最少
最常不及格的產業
- AI / Machine Learning:477 個受檢頁面中有 99% 不及格
- MarTech / Marketing Platform:201 個受檢頁面中有 99% 不及格
- Data & Analytics:144 個受檢頁面中有 99% 不及格
- Digital Health / Health Tech:128 個受檢頁面中有 99% 不及格
- IT Infrastructure / Cloud:445 個受檢頁面中有 98% 不及格
最少不及格的產業
- Banking / Neo-banking:363 個受檢頁面中有 86% 不及格
- Online Learning / Course Platform:228 個受檢頁面中有 87% 不及格
- Government / GovTech:141 個受檢頁面中有 88% 不及格
- Wealth Management / Investment:214 個受檢頁面中有 91% 不及格
- InsurTech / Insurance:144 個受檢頁面中有 92% 不及格
該怎麼修
- 比較表、規格表、價目表都做成有標題列的表格,引擎才能把某一格連同欄位名稱一起引出來。
- 每張資料表格加一行 caption,說明這張表在比什麼。
- 可以條列的重點,寫成三項以上的清單,放在文章正文裡,不要塞進側欄或頁尾。
- 尺寸、方案上限、營業時間這類左邊名稱、右邊數值的資料,用兩欄表格或 dl 定義清單來寫。