我們讓 AI 維運自己的官網一個月
實測數據、權限邊界,以及它犯過的錯

作者:邦邦(瑪尼國際 工程師)· 2026 年 8 月 29 日 · 閱讀時間約 10 分鐘

這篇不是教學文,也不推薦任何工具。我們做的事情很單純:用 MCP 把 AI 助理接上瑪尼國際自己的官網與主機,讓它參與一個月的實際維運工作,然後把過程與數字完整寫下來。實驗場是我們自己的網站,不是客戶的——這件事必須先講清楚。

會寫這篇,是因為過程中量到一組我們沒預期的數字:過去 30 天,AI 引擎對 mani.tw 的抓取次數是傳統搜尋引擎的 2.5 倍。這個比例如果在其他企業網站上也成立,那麼「網站要為誰而寫」這件事,已經和三年前不一樣了。

問題:沒有 MIS 的公司,網站是怎麼爛掉的

先講要解決的問題。台灣多數中小企業沒有專職資訊人員,網站上線之後就進入無人管理狀態。爛掉的過程通常不是一次崩潰,而是慢慢的:

  • 合作過的客戶收攤了,官網上的作品連結指向已經易主的網域。
  • 價格調整過,但只改了產品頁,部落格文章裡還是舊價格,兩邊互相矛盾。
  • 頁面改過內容,sitemap 的更新時間戳沒跟著動,搜尋引擎不知道要回來重讀。
  • 存取記錄裡有大量被防火牆擋掉的請求,但沒有人打開來看過。
  • 五年前的舊頁面還留在主機上,沒有人記得它們存在。

這些事情不難,只是瑣碎、無聊、而且要定期做。人不做不是因為不會,是因為沒空、也不會有人因為沒做而抱怨——直到有一天客戶問「你們網站上這個連結怎麼連到奇怪的網站」。

做法:AI 能碰什麼,不能碰什麼

核心設定是三層權限:可以自由讀取、寫入要先提案、實際套用前由人確認。不是「讓 AI 全自動管理」,這點差別很重要。

開放讀取的範圍

  • 網站原始碼與設定檔
  • 伺服器存取記錄(本次分析共 48,724 行)
  • Google Search Console 的成效與索引狀態
  • 公開頁面的線上抓取結果

完全不開放的範圍

  • 含個人資料的資料庫與後台系統——這類資料的所有權不在我們,任何理由都不讀取。
  • 金流與付款相關程式
  • 憑證、金鑰與存取權杖——不讀取、不輸出、不寫進任何會被版控或部署的位置。
  • DNS 的網站驗證記錄與郵件設定——刪錯一筆的代價遠大於任何效率收益。

另外有一條硬性規則:凡是刪除資料、調整價格、公開對外發言(例如回覆評論)這三類動作,一律先問過人。AI 可以準備好內容,但按下送出的是人。

為什麼這篇不寫成教學

把 AI 助理接上主機,本質上是給一個會自己做決定的程式檔案寫入權限。做得好是助力,做不好是資安事故。這件事需要的不是安裝步驟,而是「出事時知道怎麼回復」的能力——備份策略、版本比對、逐步驗證。所以本文只公開我們的做法與數據,不提供設定教學。如果您想在自己的主機上做類似的事,建議先具備完整備份與還原的把握。

結果一:AI 引擎的抓取量已是傳統搜尋引擎的 2.5 倍

這是本次實測最值得單獨拿出來講的數字。統計區間 2026 年 7 月 30 日至 8 月 29 日,來源是主機的原始存取記錄,共解析 48,724 行:

類別30 天抓取次數
AI 引擎合計5,958
傳統搜尋引擎合計2,388
比值2.5 倍

不過只看合計會誤導,所以把兩邊都拆開:

AI 引擎次數傳統搜尋引擎次數
Meta-ExternalAgent3,616bingbot1,022
ClaudeBot1,159Googlebot879
GPTBot339Baiduspider419
Applebot258DuckDuckBot41
OAI-SearchBot247Yandex27
ChatGPT-User163
CCBot(Common Crawl)66
Bytespider39
Amazonbot38
Youbot30
PerplexityBot3

誠實的補充:Meta 一家就佔了 AI 那一側的 61%。把 Meta 拿掉之後,AI 端剩 2,342 次、搜尋端 2,388 次,兩邊其實是打平的。所以「2.5 倍」這個數字成立,但它主要由單一來源撐起來——這種細節不講清楚,數字就變成話術。

比合計數更值得注意的是 ChatGPT-User 的 163 次。這個 user agent 和其他爬蟲不同:它不是排程抓取,而是有真人在 ChatGPT 裡問了問題、ChatGPT 為了回答而即時來讀取頁面。換句話說,這 163 次背後有 163 個當下正在問問題的人。它們讀了哪些頁:

頁面被讀取次數
首頁53
/host-co-location.php(主機代管)33
/host-linux.php(Linux 虛擬主機)17
/host-materiality.php(實體主機)11
其他頁面各 2 到 6 次

有人在問 ChatGPT 主機代管的事,而 ChatGPT 去讀了我們的頁面。這條路徑在 Google Analytics 上看不到、在 Search Console 上也看不到——只有伺服器的原始存取記錄留得住。這也是為什麼我們把這份分析做成每月自動產出的報表。

結果二:這一個月實際改了什麼

不列形容詞,只列可以驗證的事:

  • 清掉 28 個五年前的舊頁面。它們早就有 301 轉址、對外讀不到,但檔案還留在主機上,裡面有指向已易主網域的連結。移除前先完整打包備份。
  • 下架 250 個沒有任何頁面引用的檔案(其中 174 張圖片,共 6.1 MB),移到網站目錄之外保留而非直接刪除。
  • 逐一連線檢查 65 筆舊作品的網站是否還存在。結果:26 個網域已經消失、14 個易主變成無關內容,只有 18 個仍正常。作品集因此重新挑選過。
  • 建立完整的 VPS 產品線頁面,從規格、價格到結構化資料。
  • 補強主機代管頁:新增名詞對照與上架流程兩個段落,常見問題從 4 題增為 6 題並同步進結構化資料。
  • 把 sitemap 的 45 個網址逐一對照檔案修改時間,修正過期的更新時間戳。
  • 建立每月自動產出的 AI 引擎能見度報表,含爬蟲分佈與被防火牆誤擋的檢查。

搜尋成效的部分,統計區間 2026 年 5 月 27 日至 8 月 26 日(Search Console 三個月資料):

查詢詞曝光平均排名
idc 機房 費用94.2
雲端虛擬主機124.9
主機代管費用1565.1
中華電信主機代管費用108.5
主機代管(單獨的關鍵字)65823.3

值得注意的是最後一行。帶著「費用」「比較」「推薦」的長尾字全部在第一頁,但單獨的「主機代管」還在第 23 名。同一個網址、同一個頁面,差別不在品質而在搜尋意圖——單獨的關鍵字,第一頁被「主機代管是什麼」這類解釋型內容與維基百科佔住。這一項還沒打下來,寫出來是因為只講贏的部分沒有意義。

AI 犯過的錯(這段才是重點)

一個月下來,AI 至少有五次被人攔下來。它們有共同的模式,值得逐項寫清楚:

一、把中文字打成形近字,而且公開貼了出去

回覆 Google 商家評論時,把客戶姓名中的一個字打成形近字,錯誤版本公開存在約兩分鐘。更麻煩的是第一次修正時又打錯成另一個形近字。根本原因是用截圖放大去核對——螢幕上那幾個字長得幾乎一樣。後來改成用程式輸出每個字的 Unicode 碼位來比對,才真的確認正確。

二、一個錯誤的資安警報

AI 檢查舊頁面時,用了會自動跟隨轉址的方式抓取網址,看到回應碼 200 就判定「這些頁面對外開放,而且連向不當網站」。實際上那個 200 是轉址之後目的頁的回應——那批頁面早就設定了 301,外界根本讀不到。這個錯誤的警報差點導致不必要的緊急處理。正確做法是不跟隨轉址、直接看原始回應碼。

三、清理工作只做了一半

全站檢查誇大用語時,比對清單漏掉了幾種說法,結果第一輪清理後仍有 16 處殘留,是後來從搜尋結果的摘要片段才發現的。批次處理的風險就在這裡:清單沒列到的,工具不會提醒你它沒列到。

四、改了內容卻忘了更新 sitemap 時間戳

頁面改完、上線驗證也做了,但 sitemap 的 lastmod 沒動——搜尋引擎因此不知道該回來重讀。這一項是人提醒之後才補的。

五、憑印象提出的假設

分析品牌關鍵字的競爭狀況時,AI 給了一個聽起來合理但沒有查證的推論,實際去搜尋後發現競爭來源完全不是它猜的那些。合理的推論和查證過的事實,在語氣上讀起來一模一樣——這是最需要警覺的一點。

五次錯誤裡有四次是同一個模式:用不完整的檢查就下結論。AI 產出的速度很快,快到人容易忘記要求它出示證據。我們後來的做法是把每一次錯誤都記錄下來,連同「下次該用什麼指令驗證」一起寫進工作備忘,讓同一個坑不要踩第二次。

一個月下來的結論

AI 明顯拉高了產出速度與檢查密度,但它需要覆核。它願意把 48,724 行存取記錄逐行讀完,不會嫌無聊;它不會忘記備份;它可以在同一個下午裡完成規格整理、頁面撰寫與上線驗證。這些是人力做得到但通常不會去做的事。

可是它會犯人不太會犯的錯——打錯形近字、看到轉址後的結果就誤判、把推論當成事實陳述。所以真正的價值不在「把工作交出去」,而在「有一個願意做瑣事、但需要有人看著的助手」。這一個月裡,人的角色從執行者變成覆核者,工作量沒有消失,只是換了位置。

這對您的網站意味著什麼

不論您是否要用 AI 維運,有兩件事值得現在就確認:

  1. 去看看您的伺服器存取記錄裡,AI 爬蟲佔了多少。這個數字在 Google Analytics 上看不到。如果比例和我們接近,那麼「內容要讓 AI 讀得懂」就不再是可有可無的事。
  2. 確認您的 robots.txt 沒有無意間擋掉 AI 引擎。很多網站的 robots.txt 是十年前設定的,裡面的規則早就沒人檢視過。擋掉 GPTBot、ClaudeBot 這類 user agent,等於自願退出 AI 回答這個曝光管道。

如果您的網站放在我們這裡,這兩件事我們可以直接幫您看——存取記錄本來就在主機上。相關的服務內容可以參考網站代管與主機維運服務,主機方案則見虛擬主機主機代管

常見問題

Q:什麼是 MCP?把 AI 接上主機和一般的 AI 聊天差在哪?

MCP(Model Context Protocol)是一套讓 AI 助理連上外部工具與資料來源的開放協定。差別在於:一般的 AI 聊天只能根據你貼上去的文字回答,AI 看不到你的網站實況;透過 MCP 串接之後,AI 可以直接讀取伺服器上的檔案、存取記錄與搜尋成效資料,回答的是這一台主機此刻的真實狀態,而不是通則。實務上的價值不在於「AI 會寫程式」,而在於「AI 看得到證據」——它能自己去翻 log 確認假設,而不是憑印象猜測。

Q:讓 AI 連上自己的主機安全嗎?

取決於你給它多少權限,以及有沒有人審。我們的做法是分三層:AI 可以自由讀取(存取記錄、程式碼、搜尋成效),寫入必須先提出具體變更內容,實際套用前由人確認。同時有幾類東西完全不開放:含個資的資料庫與後台、金流相關程式、DNS 驗證記錄、以及任何憑證與金鑰。每次變更前先備份、變更後立刻用 php -l 與線上抓取驗證。如果沒有這套流程,把寫入權限交給 AI 是有風險的,我們不建議一般使用者自行嘗試。

Q:AI 爬蟲會吃掉我的頻寬嗎?要不要用 robots.txt 擋掉?

以我們實測的量級(30 天約 5,958 次)而言,對一般企業網站的頻寬影響很有限,遠低於圖片與影片的流量。是否要擋要看目的:如果你希望自己的服務出現在 ChatGPT、Claude、Perplexity 的回答裡,擋掉等於自己退出這個管道。我們的選擇是明確允許 GPTBot、OAI-SearchBot、ChatGPT-User、ClaudeBot、PerplexityBot 與 Google-Extended。真正需要留意的不是頻寬,而是被高頻抓取時的伺服器負載,以及 WAF 是否誤把它們當攻擊擋掉——這點要實際去看回應碼才知道。

Q:GEO 是什麼?和 SEO 有什麼不同?

GEO(Generative Engine Optimization,生成式引擎最佳化)指的是讓內容更容易被 AI 生成式引擎讀取與引用。和 SEO 的差別在於目標:SEO 追求在搜尋結果列表中排名靠前,讓使用者點進來;GEO 追求被 AI 摘要引用,使用者可能根本不點連結,但你的公司名稱與說法會出現在答案裡。做法上的重點也不同——AI 引擎偏好結構清楚、有具體數字、能直接回答問題的段落,而不是關鍵字密度。兩者不衝突,結構化資料與清楚的問答式標題對兩邊都有幫助。

Q:AI 維運會取代網站管理人員嗎?

以我們一個月的實測結果,不會。AI 明顯拉高了產出速度與檢查密度——它願意把 48,724 行存取記錄逐行看完,也不會忘記更新 sitemap 的時間戳。但它會犯人不太會犯的錯:把中文字打成同音或形近字、用不完整的檢查就下結論、看到轉址後的回應碼就誤判頁面狀態。這一個月裡我們至少攔下五次這類錯誤,其中一次是錯誤的資安警報。合理的定位是「一個產出快但需要覆核的助手」,不是「可以放著不管的系統管理員」。

想知道您的網站被 AI 引擎讀了多少次?

這個數字只存在於伺服器的原始存取記錄裡。主機放在我們這裡的客戶,可以直接向我們索取這份分析。

免費諮詢 →

免費諮詢專線 0800-670000

📞 技術支援(24小時):0921-070-027  |  📞 免費諮詢:0800-670000 📍 411 台中市太平區育賢路366號4樓之2  |  ✉ mani@mani.com.tw