當有人問 AI「雙北植牙推薦哪家」,AI 都說了誰?
越來越多人做醫療決策前先問 AI。我們用真實使用者的問法問了 Claude 45 次,統計每一家診所被提到幾次;再用同一套問法問 ChatGPT 與 Gemini 各 45 次做對照——三個 AI,三份幾乎不重疊的名單。
我們怎麼測
- 從 PTT 牙板與 Dcard 蒐集 15 個真實使用者問法(不是我們發明的關鍵字),涵蓋推薦、怎麼選、價格合理性、植體品牌、補骨粉、導板、恐懼風險、保固、幫長輩問等七類意圖。
- 每個問法在全新對話中問 3 次(AI 每次回答不同,單次結果沒有意義),共 45 則回答,全部開啟網路搜尋。
- 用固定的名稱別名表做確定性字串比對統計出現次數——計數過程沒有任何 AI 判斷。
- 主軸是 Claude(消費者預設模型)。發現一到三以 Claude 的 45 則為準;另以同一套問法、同樣條件測了 ChatGPT 與 Gemini 各 45 則,見發現四。三個平台各自統計,從不合併。
發現一:可見度極度集中,長尾隨時會消失
45 則回答共出現 55 個診所/醫院,但其中絕大多數只出現過 1 次或從未被點名。穩定出現(3 次以上)的只有 6 個單位:
| 出現次數 / 45 | 單位 |
|---|---|
| 5 | 台北榮民總醫院 |
| 5 | 台大醫院 |
| 3 | 永和雅德思牙醫診所 |
| 3 | 永和博誠美學牙醫診所 |
| 3 | 台大醫院北護分院 |
| 3 | 馬偕紀念醫院 |
換句話說:如果你的診所今天有被 AI 提到,多數情況是偶然。明天換一個問法、換一次抽樣,你就不在名單上了——而你不會知道。
發現二:AI 讀你的網站,然後推薦別人
引用最多的來源幾乎都是診所自有網站。一開始我們以為這代表「投資內容 → 被 AI 推薦」。逐則答案檢查之後,發現不是這樣:
| 診所網站(匿名) | 被引用的答案數 | 其中點名該診所 |
|---|---|---|
| 診所 A 的官網 | 21 | 1 |
| 診所 B 的官網 | 17 | 1 |
| 診所 C 的官網 | 15 | 0 |
| 診所 D 的官網 | 15 | 0 |
| 診所 E 的官網 | 12 | 0 |
| 診所 F 的官網 | 9 | 0 |
同一則答案裡,AI 引用了某家診所的網站,卻推薦了另一家。內容被當成品類的參考資料吃進去,功勞卻沒有回到寫這些內容的人身上。
這對投入內容的診所是壞消息,但也是唯一真正可行動的發現:問題不在「有沒有內容」,而在內容有沒有讓 AI 把你當成答案,而不只是當成資料。
(網域與診所的對應已逐一人工核對確認。公開版將這六家匿名處理——這份報告的目的是讓大家看見現象,不是讓任何一家診所難堪。如果您想知道自己是不是其中之一,來信即可,我們只告訴您本人。)
發現三:Dcard 被引用了 23 次
社群討論串會直接進入 AI 的回答依據。這代表兩件事:口碑聲量真的會影響 AI 怎麼說你;反過來,有人惡意操作社群內容時,也會影響 AI 怎麼說你——而這正是我們做這項監測的原因。
發現四:換一個 AI,換一份名單
同一套 15 個問法、同樣全新對話、同樣開啟搜尋,再問 ChatGPT 與 Gemini 各 45 則。每個平台各自統計,不合併——因為它們給的是三份幾乎不重疊的名單:
| 平台(模型) | 45 則裡出現 3 次以上的單位 | 至少被提到 1 次的單位數 |
|---|---|---|
| Claude(claude-sonnet-5) | 台北榮總 5、台大醫院 5、雅德思 3、博誠美學 3、台大北護 3、馬偕 3 | 46 |
| ChatGPT(gpt-5.1) | 蒔美 7、永漾 4、雲天 3 | 12 |
| Gemini(gemini-3.7-flash) | 蒔美 10、台大醫院 10、台北榮總 9、悅庭 8、世樺 6、歐仕美 5、馬偕 5、勤美悠植 4、翡冷翠 3、永漾 3 | 18 |
三件事值得注意:
- 診所幾乎只在「推薦型」問法被點名。15 個問法裡有 5 個是直接問「推薦哪家」(含幫長輩問),其餘 10 個問的是保固、價格、植體、補骨粉這類知識。三個平台加起來 90 則知識型回答,點名診所的只有 2 則。所以「AI 有沒有推薦你」只能看那 15 則推薦型回答;知識型回答量的是另一件事——你的內容有沒有被拿去用。
- 名單從哪裡抄,決定誰被點名。Claude 引用最多的是診所自家網站(前四名都是),Gemini 引用最多的卻是 Dcard、排名清單網站、PTT、Facebook。Claude 讀了診所的文章然後推薦醫學中心;Gemini 讀了論壇然後推薦論壇上有人提的診所。
- 發現二在別的平台會反轉。發現二那六家「被 Claude 讀了卻沒被推薦」的診所,有三家在 ChatGPT 或 Gemini 的穩定名單上——同樣的網站內容,一個 AI 只當資料來源,另一個 AI 拿來推薦。三個 AI 給了三種待遇,而診所自己不會知道,除非有人替它三邊都問一遍。
這份調查的限制
我們認為誠實比漂亮重要:
- 測了三個 AI 平台(Claude claude-sonnet-5、ChatGPT gpt-5.1、Gemini gemini-3.7-flash),彼此結果差異很大;Perplexity、Grok 尚未測,結果可能又不相同。
- 每個問法僅重複 3 次,出現次數為指示性數字,非精確估計。
- 名稱比對採別名表,冷僻寫法可能漏計(漏計會讓次數被低估,不會高估)。
一個容易誤讀的地方
「出現 1 次」不代表這家診所不好。它代表的是:在這 45 則回答裡,AI 只有一次把它放進答案。原因可能是網站內容不易被檢索、可能是沒有被討論、也可能只是這次抽樣的偶然——45 則答案不足以區分這三者。
這也是為什麼我們把重複次數、平台數與比對方法全部寫在上面:沒量到的東西,不能當成量到了。

與日月爭輝