這篇不是教學文,也不推薦任何工具。我們做的事情很單純:用 MCP 把 AI 助理接上瑪尼國際自己的官網與主機,讓它參與一個月的實際維運工作,然後把過程與數字完整寫下來。實驗場是我們自己的網站,不是客戶的——這件事必須先講清楚。
會寫這篇,是因為過程中量到一組我們沒預期的數字:過去 30 天,AI 引擎對 mani.tw 的抓取次數是傳統搜尋引擎的 2.5 倍。這個比例如果在其他企業網站上也成立,那麼「網站要為誰而寫」這件事,已經和三年前不一樣了。
問題:沒有 MIS 的公司,網站是怎麼爛掉的
先講要解決的問題。台灣多數中小企業沒有專職資訊人員,網站上線之後就進入無人管理狀態。爛掉的過程通常不是一次崩潰,而是慢慢的:
- 合作過的客戶收攤了,官網上的作品連結指向已經易主的網域。
- 價格調整過,但只改了產品頁,部落格文章裡還是舊價格,兩邊互相矛盾。
- 頁面改過內容,sitemap 的更新時間戳沒跟著動,搜尋引擎不知道要回來重讀。
- 存取記錄裡有大量被防火牆擋掉的請求,但沒有人打開來看過。
- 五年前的舊頁面還留在主機上,沒有人記得它們存在。
這些事情不難,只是瑣碎、無聊、而且要定期做。人不做不是因為不會,是因為沒空、也不會有人因為沒做而抱怨——直到有一天客戶問「你們網站上這個連結怎麼連到奇怪的網站」。
做法:AI 能碰什麼,不能碰什麼
核心設定是三層權限:可以自由讀取、寫入要先提案、實際套用前由人確認。不是「讓 AI 全自動管理」,這點差別很重要。
開放讀取的範圍
- 網站原始碼與設定檔
- 伺服器存取記錄(本次分析共 48,724 行)
- Google Search Console 的成效與索引狀態
- 公開頁面的線上抓取結果
完全不開放的範圍
- 含個人資料的資料庫與後台系統——這類資料的所有權不在我們,任何理由都不讀取。
- 金流與付款相關程式。
- 憑證、金鑰與存取權杖——不讀取、不輸出、不寫進任何會被版控或部署的位置。
- DNS 的網站驗證記錄與郵件設定——刪錯一筆的代價遠大於任何效率收益。
另外有一條硬性規則:凡是刪除資料、調整價格、公開對外發言(例如回覆評論)這三類動作,一律先問過人。AI 可以準備好內容,但按下送出的是人。
為什麼這篇不寫成教學
把 AI 助理接上主機,本質上是給一個會自己做決定的程式檔案寫入權限。做得好是助力,做不好是資安事故。這件事需要的不是安裝步驟,而是「出事時知道怎麼回復」的能力——備份策略、版本比對、逐步驗證。所以本文只公開我們的做法與數據,不提供設定教學。如果您想在自己的主機上做類似的事,建議先具備完整備份與還原的把握。
結果一:AI 引擎的抓取量已是傳統搜尋引擎的 2.5 倍
這是本次實測最值得單獨拿出來講的數字。統計區間 2026 年 7 月 30 日至 8 月 29 日,來源是主機的原始存取記錄,共解析 48,724 行:
| 類別 | 30 天抓取次數 |
|---|---|
| AI 引擎合計 | 5,958 |
| 傳統搜尋引擎合計 | 2,388 |
| 比值 | 2.5 倍 |
不過只看合計會誤導,所以把兩邊都拆開:
| AI 引擎 | 次數 | 傳統搜尋引擎 | 次數 |
|---|---|---|---|
| Meta-ExternalAgent | 3,616 | bingbot | 1,022 |
| ClaudeBot | 1,159 | Googlebot | 879 |
| GPTBot | 339 | Baiduspider | 419 |
| Applebot | 258 | DuckDuckBot | 41 |
| OAI-SearchBot | 247 | Yandex | 27 |
| ChatGPT-User | 163 | ||
| CCBot(Common Crawl) | 66 | ||
| Bytespider | 39 | ||
| Amazonbot | 38 | ||
| Youbot | 30 | ||
| PerplexityBot | 3 |
誠實的補充:Meta 一家就佔了 AI 那一側的 61%。把 Meta 拿掉之後,AI 端剩 2,342 次、搜尋端 2,388 次,兩邊其實是打平的。所以「2.5 倍」這個數字成立,但它主要由單一來源撐起來——這種細節不講清楚,數字就變成話術。
比合計數更值得注意的是 ChatGPT-User 的 163 次。這個 user agent 和其他爬蟲不同:它不是排程抓取,而是有真人在 ChatGPT 裡問了問題、ChatGPT 為了回答而即時來讀取頁面。換句話說,這 163 次背後有 163 個當下正在問問題的人。它們讀了哪些頁:
| 頁面 | 被讀取次數 |
|---|---|
| 首頁 | 53 |
| /host-co-location.php(主機代管) | 33 |
| /host-linux.php(Linux 虛擬主機) | 17 |
| /host-materiality.php(實體主機) | 11 |
| 其他頁面 | 各 2 到 6 次 |
有人在問 ChatGPT 主機代管的事,而 ChatGPT 去讀了我們的頁面。這條路徑在 Google Analytics 上看不到、在 Search Console 上也看不到——只有伺服器的原始存取記錄留得住。這也是為什麼我們把這份分析做成每月自動產出的報表。
結果二:這一個月實際改了什麼
不列形容詞,只列可以驗證的事:
- 清掉 28 個五年前的舊頁面。它們早就有 301 轉址、對外讀不到,但檔案還留在主機上,裡面有指向已易主網域的連結。移除前先完整打包備份。
- 下架 250 個沒有任何頁面引用的檔案(其中 174 張圖片,共 6.1 MB),移到網站目錄之外保留而非直接刪除。
- 逐一連線檢查 65 筆舊作品的網站是否還存在。結果:26 個網域已經消失、14 個易主變成無關內容,只有 18 個仍正常。作品集因此重新挑選過。
- 建立完整的 VPS 產品線頁面,從規格、價格到結構化資料。
- 補強主機代管頁:新增名詞對照與上架流程兩個段落,常見問題從 4 題增為 6 題並同步進結構化資料。
- 把 sitemap 的 45 個網址逐一對照檔案修改時間,修正過期的更新時間戳。
- 建立每月自動產出的 AI 引擎能見度報表,含爬蟲分佈與被防火牆誤擋的檢查。
搜尋成效的部分,統計區間 2026 年 5 月 27 日至 8 月 26 日(Search Console 三個月資料):
| 查詢詞 | 曝光 | 平均排名 |
|---|---|---|
| idc 機房 費用 | 9 | 4.2 |
| 雲端虛擬主機 | 12 | 4.9 |
| 主機代管費用 | 156 | 5.1 |
| 中華電信主機代管費用 | 10 | 8.5 |
| 主機代管(單獨的關鍵字) | 658 | 23.3 |
值得注意的是最後一行。帶著「費用」「比較」「推薦」的長尾字全部在第一頁,但單獨的「主機代管」還在第 23 名。同一個網址、同一個頁面,差別不在品質而在搜尋意圖——單獨的關鍵字,第一頁被「主機代管是什麼」這類解釋型內容與維基百科佔住。這一項還沒打下來,寫出來是因為只講贏的部分沒有意義。
AI 犯過的錯(這段才是重點)
一個月下來,AI 至少有五次被人攔下來。它們有共同的模式,值得逐項寫清楚:
一、把中文字打成形近字,而且公開貼了出去
回覆 Google 商家評論時,把客戶姓名中的一個字打成形近字,錯誤版本公開存在約兩分鐘。更麻煩的是第一次修正時又打錯成另一個形近字。根本原因是用截圖放大去核對——螢幕上那幾個字長得幾乎一樣。後來改成用程式輸出每個字的 Unicode 碼位來比對,才真的確認正確。
二、一個錯誤的資安警報
AI 檢查舊頁面時,用了會自動跟隨轉址的方式抓取網址,看到回應碼 200 就判定「這些頁面對外開放,而且連向不當網站」。實際上那個 200 是轉址之後目的頁的回應——那批頁面早就設定了 301,外界根本讀不到。這個錯誤的警報差點導致不必要的緊急處理。正確做法是不跟隨轉址、直接看原始回應碼。
三、清理工作只做了一半
全站檢查誇大用語時,比對清單漏掉了幾種說法,結果第一輪清理後仍有 16 處殘留,是後來從搜尋結果的摘要片段才發現的。批次處理的風險就在這裡:清單沒列到的,工具不會提醒你它沒列到。
四、改了內容卻忘了更新 sitemap 時間戳
頁面改完、上線驗證也做了,但 sitemap 的 lastmod 沒動——搜尋引擎因此不知道該回來重讀。這一項是人提醒之後才補的。
五、憑印象提出的假設
分析品牌關鍵字的競爭狀況時,AI 給了一個聽起來合理但沒有查證的推論,實際去搜尋後發現競爭來源完全不是它猜的那些。合理的推論和查證過的事實,在語氣上讀起來一模一樣——這是最需要警覺的一點。
五次錯誤裡有四次是同一個模式:用不完整的檢查就下結論。AI 產出的速度很快,快到人容易忘記要求它出示證據。我們後來的做法是把每一次錯誤都記錄下來,連同「下次該用什麼指令驗證」一起寫進工作備忘,讓同一個坑不要踩第二次。
一個月下來的結論
AI 明顯拉高了產出速度與檢查密度,但它需要覆核。它願意把 48,724 行存取記錄逐行讀完,不會嫌無聊;它不會忘記備份;它可以在同一個下午裡完成規格整理、頁面撰寫與上線驗證。這些是人力做得到但通常不會去做的事。
可是它會犯人不太會犯的錯——打錯形近字、看到轉址後的結果就誤判、把推論當成事實陳述。所以真正的價值不在「把工作交出去」,而在「有一個願意做瑣事、但需要有人看著的助手」。這一個月裡,人的角色從執行者變成覆核者,工作量沒有消失,只是換了位置。
這對您的網站意味著什麼
不論您是否要用 AI 維運,有兩件事值得現在就確認:
- 去看看您的伺服器存取記錄裡,AI 爬蟲佔了多少。這個數字在 Google Analytics 上看不到。如果比例和我們接近,那麼「內容要讓 AI 讀得懂」就不再是可有可無的事。
- 確認您的 robots.txt 沒有無意間擋掉 AI 引擎。很多網站的 robots.txt 是十年前設定的,裡面的規則早就沒人檢視過。擋掉 GPTBot、ClaudeBot 這類 user agent,等於自願退出 AI 回答這個曝光管道。
如果您的網站放在我們這裡,這兩件事我們可以直接幫您看——存取記錄本來就在主機上。相關的服務內容可以參考網站代管與主機維運服務,主機方案則見虛擬主機與主機代管。
常見問題
Q:什麼是 MCP?把 AI 接上主機和一般的 AI 聊天差在哪?
MCP(Model Context Protocol)是一套讓 AI 助理連上外部工具與資料來源的開放協定。差別在於:一般的 AI 聊天只能根據你貼上去的文字回答,AI 看不到你的網站實況;透過 MCP 串接之後,AI 可以直接讀取伺服器上的檔案、存取記錄與搜尋成效資料,回答的是這一台主機此刻的真實狀態,而不是通則。實務上的價值不在於「AI 會寫程式」,而在於「AI 看得到證據」——它能自己去翻 log 確認假設,而不是憑印象猜測。
Q:讓 AI 連上自己的主機安全嗎?
取決於你給它多少權限,以及有沒有人審。我們的做法是分三層:AI 可以自由讀取(存取記錄、程式碼、搜尋成效),寫入必須先提出具體變更內容,實際套用前由人確認。同時有幾類東西完全不開放:含個資的資料庫與後台、金流相關程式、DNS 驗證記錄、以及任何憑證與金鑰。每次變更前先備份、變更後立刻用 php -l 與線上抓取驗證。如果沒有這套流程,把寫入權限交給 AI 是有風險的,我們不建議一般使用者自行嘗試。
Q:AI 爬蟲會吃掉我的頻寬嗎?要不要用 robots.txt 擋掉?
以我們實測的量級(30 天約 5,958 次)而言,對一般企業網站的頻寬影響很有限,遠低於圖片與影片的流量。是否要擋要看目的:如果你希望自己的服務出現在 ChatGPT、Claude、Perplexity 的回答裡,擋掉等於自己退出這個管道。我們的選擇是明確允許 GPTBot、OAI-SearchBot、ChatGPT-User、ClaudeBot、PerplexityBot 與 Google-Extended。真正需要留意的不是頻寬,而是被高頻抓取時的伺服器負載,以及 WAF 是否誤把它們當攻擊擋掉——這點要實際去看回應碼才知道。
Q:GEO 是什麼?和 SEO 有什麼不同?
GEO(Generative Engine Optimization,生成式引擎最佳化)指的是讓內容更容易被 AI 生成式引擎讀取與引用。和 SEO 的差別在於目標:SEO 追求在搜尋結果列表中排名靠前,讓使用者點進來;GEO 追求被 AI 摘要引用,使用者可能根本不點連結,但你的公司名稱與說法會出現在答案裡。做法上的重點也不同——AI 引擎偏好結構清楚、有具體數字、能直接回答問題的段落,而不是關鍵字密度。兩者不衝突,結構化資料與清楚的問答式標題對兩邊都有幫助。
Q:AI 維運會取代網站管理人員嗎?
以我們一個月的實測結果,不會。AI 明顯拉高了產出速度與檢查密度——它願意把 48,724 行存取記錄逐行看完,也不會忘記更新 sitemap 的時間戳。但它會犯人不太會犯的錯:把中文字打成同音或形近字、用不完整的檢查就下結論、看到轉址後的回應碼就誤判頁面狀態。這一個月裡我們至少攔下五次這類錯誤,其中一次是錯誤的資安警報。合理的定位是「一個產出快但需要覆核的助手」,不是「可以放著不管的系統管理員」。