医療機関AI検索ラボMEDICAL AI SEARCH LAB

擴大到全國 7,643 家機構加以查證——美容相關診所的網站,是否處於 AI 可讀的狀態

我們將大阪 400 家機構的機器可讀性調查擴大到全國,對 7,643 家美容相關診所的機器可讀性進行了全數調查。AI 爬蟲全部允許 88.7%、llms.txt 9.1%、結構化資料 40.0%。而且登記 URL 中約有一成無法連通。

LLMO

本文重點

  1. 全國 7,643 家美容相關診所機器可讀性的實際狀況
  2. 檢驗先行的大阪 400 家機構的分布是否能代表全國
  3. 公共資料庫中登記的 URL 約有一成無法連到網站的所見

結論

AI 爬蟲 12 種全部允許為 88.7%、llms.txt 的設置為 9.1%、結構化資料的輸出為 40.0%。與大阪 400 家機構的分布幾乎一致,確認了先行調查的趨勢並非地區特有,而是整個產業的現狀。此外,登記了 URL 的機構中約有一成連網站本身都無法連通,觀測到網路資訊的陳舊化。

本文使用的詞彙
robots.txt
放在網站入口、給爬蟲(自動前來讀取網站的程式)看的說明文。是一個記載哪個程式可讀取哪些部分、哪些不可讀取的文字檔。
AI 爬蟲
ChatGPT、Gemini 等 AI 服務前來讀取網站時所使用的程式。GPTBot、ClaudeBot、PerplexityBot 等,各服務都有各自固定的名稱。
llms.txt
面向 AI、摘要說明「本網站有什麼」而放置的引導檔。是相對較新的提案,設置與否為任意。
sitemap.xml
將網站內的頁面清單整理成機器可讀形式的檔案。可讓搜尋引擎與 AI 更容易找到頁面。
結構化資料(JSON-LD)
將頁面內容以機器可理解的形式附加標註者。把「這是診療時間」「這是醫師姓名」等意義,與面向人類的顯示分開持有。
機器可讀性調查
並非網站內容的品質,而是從外部以機器方式調查上述「從機器看到的形式」是否齊備。

日前我們公開大阪府 400 家美容相關診所的機器可讀性調查(機器可讀性——AI 是否能讀取網站的狀態——的調查)時,寫道「全國調查正在進行中」。該全國調查現已完成,因此在此作為後續報告。

關於設計。在源自厚生勞動省醫療資訊網的全國醫科診所中,我們以標榜美容外科、美容皮膚科、整形外科、皮膚科其中任一項的 11,421 家機構為母體,調查了能夠確認網站 URL 的 7,643 家機構的全數。這次不是抽樣,而是全數。判定項目與大阪調查相同,對 robots.txt 中主要 AI 爬蟲 12 種的允許狀況、llms.txt 的設置、sitemap.xml、結構化資料(JSON-LD)、https 等外形項目進行機器判定(測量期間:2026 年 7 月 13 日至 14 日。對各機構網站的存取僅一次,間隔開來實施)。

關於結果。允許全部主要 AI 爬蟲 12 種的,在 7,643 家機構中有 6,776 家(88.7%)。封鎖部分或全部的有 172 家(2.3%)。設置 llms.txt 的有 697 家(9.1%)。結構化資料(JSON-LD)的輸出有 3,060 家(40.0%)。

與先行的大阪 400 家機構的分布(全部允許 89%、llms.txt 10%、結構化資料 52%)並列來看,AI 爬蟲的允許率與 llms.txt 幾乎一致。可以說大阪的數字並非地區特有,而是代表了整個產業的現狀。只有結構化資料在全國低出 12 個百分點,但這可能是抽取方法的差異所致(大阪調查優先以標榜美容外科、美容皮膚科的 400 家機構為抽取對象,而全國是包含皮膚科的全數),我們不下定論。

這次全數調查中首次浮現的所見有一項。URL 登記於公共資料庫的 7,643 家機構中,能夠正常連到首頁的有 6,832 家(89.4%)。其餘 811 家(約一成)無法連到網站本身:無法解析網域(358 件)、頁面不存在(404 有 214 件)、逾時或 SSL 錯誤等等。歇業、搬遷、網域失效、改版導致的 URL 變更——原因被認為各式各樣,但共通之處在於「公共登記資訊與網路實際狀況出現落差」。當 AI 談論醫療機構時,這類陳舊化的資訊也可能成為素材的一部分。確認貴診所的資訊在何處、以何種方式登記,作為 AI 對策之前的基礎,具有其意義。

關於解讀的注意事項。本調查是外形的機器判定,並非測量內容的品質或在 AI 搜尋中實際被對待的方式,有無某項目也不代表機構的優劣。對於以 JavaScript 繪製的網站或平台型網站,判定可能與實際狀況產生落差,我們將其區分為無法判定(無法判定率依項目而異為 7 至 11%)。

大多數醫療機構處於「並未拒絕 AI,但也未積極準備」的狀態,這一構圖自大阪調查以來未曾改變。外形的整備並不困難,只要整備好,在前提條件上便進入領先集團。在那之後——已成為可讀狀態的網站實際上被 AI 如何對待——才是本網站以實測所處理的領域。

本文常見問題

Q. 為什麼數字與大阪的調查略有不同?
A. 因為對象的抽取方法不同。大阪調查是優先以標榜美容外科、美容皮膚科的 400 家機構為抽取對象,而這次是能夠確認 URL 的全國 7,643 家機構的全數。AI 爬蟲允許率與 llms.txt 設置率幾乎一致,趨勢是相同的。
Q. 要確認貴診所的 URL 是否仍是舊的,應該檢查哪裡?
A. 起點是確認醫療資訊網(厚生勞動省)的貴診所頁面、Google Business Profile、以及主要入口網站上登記的 URL,是否與目前的網站一致。搬遷或改版時舊 URL 殘留,正是差異的典型案例。
Q. 全國調查的原始資料會公開嗎?
A. 個別機構的判定結果並未公布。公開的僅是匿名的分布。至於貴診所本身的狀態,任何人都能透過確認 robots.txt 與結構化資料的輸出,以相同的觀點加以檢視。