攻擊手法聽起來很技術官僚,做起來卻很簡單:找一個活躍的群組,偷偷把裡面一則舊訊息改掉,換上經過AI修改的違法內容,內容藏在群組成員平常不會回頭去看的地方,所以不會被真人舉報。接著,操作者用一批自動化帳號集體檢舉自己貼上去的這則訊息,把訊號做給Apple看——這裡有違法內容,快處理。Telegram創辦人Pavel Durov把這整套流程稱為「takedown extortionist」,是他這週在X上解釋App被短暫從App Store下架時給出的說法。

Durov的說法裡最尖銳的一句,是Apple在下架Telegram之前,並沒有先聯絡Telegram本人。換句話說,整套判斷是Apple單方面依照檢舉訊號做出的反應,Telegram這邊完全被排除在流程外,等到App已經消失才收到結果。Durov的推論是,這類操作者的目的其實是勒索:如果平台不付錢換平安,他們就會持續用同樣的手法製造檢舉訊號,逼平台一次次面對下架風險。

他把這件事定性為「潛在的系統性風險」,而且刻意強調對象不只是Telegram,是所有承載使用者生成內容的App。這句話拆開來看,其實是在質疑Apple審核機制本身的判斷順序——當自動檢舉數量到達某個門檻,App Store會不會在沒有人工核實、沒有通知開發者的情況下就先執行下架。

用戶生成內容該由誰負責,這個問題本來就纏著社群平台很多年,Telegram和Durov也不是第一次被放在這個爭論的中心。這次不一樣的地方,是AI讓「製造一段看起來違法的內容」變得比以前快也比以前容易,而Apple的審核流程如果主要依賴檢舉量而不是內容核實,等於給了這類操作者一個現成的槓桿。Durov的貼文沒有提供更多技術細節或後續處理時間點,Apple方面目前也沒有公開回應。