SEO 最低可行清單:能被抓、能被讀懂、能被收錄
SEO 這個詞被各種「秘籍」搞得神神叨叨,其實對一個人的小站來説,值得做的部分很小、很明確:讓爬蟲抓得到、讓引擎讀得懂、讓收錄查得着。這一節只講做了就有效、不做就歸零的部分,每一條都能自己動手核對。
傳統 SEO 是個大行業:外鏈建設、競品詞庫、站羣、老域名…那套東西面向有團隊有預算的公司。一個人做產品,學那些是浪費生命。好消息是,搜索引擎這些年一直在把遊戲往一個方向推:把內容做好、把技術障礙清掉的站,自然會被善待。
所以最低可行清單的邏輯是:只做那些不做就直接出局的事。按照上一節漏斗的分層,它們正好分成三組:能被抓(抓取層)、能被讀懂(理解層)、能被收錄(索引層)。三組都通了,剩下的交給內容質素,那是第 5 節的事。
| 分組 | 解決什麼 | 不做的後果 |
|---|---|---|
| 能被抓 | 爬蟲來了能拿到正文 | 抓到空殼,後面全歸零 |
| 能被讀懂 | 引擎知道每頁在講什麼 | 收錄了也不知道該在什麼問題下展示你 |
| 能被收錄 | 引擎知道你存在、有哪些頁 | 收錄靠隨緣,快慢不可觀測 |
先治最要命的病。AI 生成的前端偏愛單頁應用:頁面打開先是個空殼,內容由 JS 請求數據再渲染出來。用戶看到的一切正常,爬蟲拿到的是另一回事。下面同一個產品頁,切換兩種實現方式,右邊是爬蟲實際抓到的源碼。
上傳合同,自動生成合規的發票申請單。支持增值稅普票和專票,三分鐘搞定過去要跑一下午的事。
免費開始主流引擎宣稱能執行 JS,但執行有配額、有延遲,小站排不上優先隊列;多數 AI 爬蟲乾脆不執行 JS,抓到什麼算什麼。對策不用推翻架構:關鍵頁面(首頁、功能頁、文章頁)保證 HTML 源碼裏就有正文,交互部分繼續用 JS 沒問題。用 AI 寫頁面時把這句放進提示詞,成本為零。
能被抓之後,第二件事是讓引擎讀懂每一頁。原則只有一條:一頁回答一個問題。什麼都講的頁面,引擎不知道該在什麼問題下展示它,最後哪個問題都輪不到。主題定了,title 和 description 就是這頁在搜索結果裏的臉:用戶掃一眼這兩行字,決定點不點。
下面是一個工具站在搜索結果頁裏的三條真實病例,點一條,睇下佢點樣改。
拍一張體檢單,自動存檔並設定下次提醒。支持多寵家庭,數據可導出給獸醫。
· 體重曲綫自動生成
· 就診記錄一鍵分享
這局對決順便回答一個常見糾結:炫和被搜到衝突嗎?不衝突,有先後。先保證 HTML 裏有完整正文,動畫和交互往上疊加,本章這些課件頁自己就是這麼做的:你現在讀的每一個字都在源碼裏,交互組件全是額外加的。
抓得到、讀得懂之後,最後一組動作是主動把站送到引擎面前。四樣東西,一個下午能全部做完,做完收錄從玄學變成一個能看數字的過程。
| 動作 | 做什麼 | 為什麼值得 |
|---|---|---|
| sitemap.xml | 一個 XML 文件列出你全部頁面的地址,放在站點根目錄。多語言站每個 URL 還要用 hreflang 互指各語言版本 | 引擎照着清單抓,不用自己摸索你的站有幾頁。本站 2026 年 8 月補上英韓頁面後,sitemap 條目從約 330 漲到約 950 |
| robots.txt | 根目錄下的一個文本文件,聲明哪些路徑歡迎抓、哪些別抓,末尾指向 sitemap 的地址 | 它是爬蟲進站看的第一個文件。寫錯一行 Disallow 能把全站封掉,改完務必用站長工具驗證 |
| canonical | 每頁 head 裏一行 <link rel="canonical">,聲明這頁的正式地址 | 帶參數的地址、多個入口指向同一頁時,引擎知道該把權重記在誰頭上,不會自己人分自己人的票 |
| 站長平台提交 | Google Search Console 和 Bing Webmaster 各註冊一次,驗證域名、提交 sitemap。Bing 順手開通 IndexNow:發版後把變更頁面的地址推給它 | 從此收錄數、抓取錯誤、展示次數全部有報表。別只提交 Google:下一節的 GEO 會講為什麼 Bing 同樣重要 |
這四樣都不需要每天維護。sitemap 讓構建腳本自動生成,站長平台每週看一眼報表,就夠了。
這張清單漏一項會怎樣 · 第 4 節本站就漏過:sitemap 少了 470 個地址、Bing 沒提交。第 4 節整節複盤這些坑的代價和修法。這一節講的東西全部收進十項清單。對照你的站逐項點亮做到的,沒有站就先收藏,上綫那天回來過一遍。
這一節的多數要求,可以在讓 AI 寫頁面時一次性説清。下面這段拿去就能用,貼在你的項目提示詞或規則文件裏:
一段話的成本,換來每個新頁面天生合格。這也是本章反覆出現的模式:能進提示詞和腳本的要求,就別放進記憶和自覺裏。
最低可行三組:能被抓(正文進 HTML)、能被讀懂(一頁一主題,title 説人話)、能被收錄(sitemap、robots、canonical、站長平台)。只做不做就出局的事。
JS 空殼是 AI 前端的頭號病:用戶看着正常,爬蟲抓到空白。給 AI 提需求時寫明「關鍵頁面正文要在 HTML 源碼裏」,零成本。
title 和 description 是搜索結果頁裏唯一的開口機會:title 寫用戶會搜的問題,description 寫這頁幫他做什麼。
提交平台把收錄變成可觀測:Google 和 Bing 都要提交,從此有報表有基綫。十項清單打完分,缺哪補哪。
能進提示詞和腳本的要求,別放進記憶和自覺:那段固定提示詞貼進項目規則,每個新頁面天生合格。
內容來源:小山學堂「被搜到」專題原創。文中 sitemap 條目數(約 330 → 約 950)為本站 2026 年 8 月改造的真實數據,詳見第 4 節完整複盤。