人工智慧頂尖研究機構 Anthropic 近日發布一份震撼調查,揭發有跨國詐騙集團系統性濫用其旗下大型語言模型 Claude,在超過 20 款主流交友應用程式中部署了逾 4,700 個具備獨立人設的虛擬替身。
在僅僅兩週的抽樣監控期內,這套自動化系統便與至少 2.5 萬名受害者累計互動高達 236 萬則訊息。最令人不寒而慄的現實是:使用者在軟體中滑到的配對對象,高達 75% 完全是由演算法捏造的數位傀儡。
AI 負責放長線陪聊,真人打手無縫收割
為了在最短時間內瓦解使用者的心理防備,該集團在交友軟體的推薦演算邏輯中,導入了極其精密的「三虛一實」混合部署策略。使用者每滑過 4 張個人檔案卡片,其中就有 3 個背後完全由 Claude 模型直接驅動,僅有 1 個為真實註冊用戶。
仰賴大型語言模型龐大的上下文記憶與卓越的情商演算,這些虛擬角色不僅能同時維持數千條對話線路,還能精準記住用戶的生活瑣事與情緒起伏,營造出心有靈犀的真愛假象。營運後台更針對 AI 植入了嚴苛的系統提示詞(System Prompt),嚴厲禁止模型承認自身為聊天機器人;一旦用戶試圖索取即時自拍或提出視訊通話,AI 便會按照內建劇本巧妙推託,持續將互動鎖定在文字訊息的曖昧漩渦中。
然而,純演算法在面對強烈的情感索求時終究可能露出破綻,這套系統最陰險之處,正在於「虛實結合」的無縫掩護機制。
每當受害用戶對於身分產生疑慮、反覆堅持視訊通話或要求交換社群帳號時,系統中控台便會發出警訊,即刻指派線下的兼職真人打手接管對話,化解破綻。即便進入真人通話與語音互動環節,後端演算法依然未曾缺席——系統會即時分析對話語意,自動生成 3 組「情商最高、最能引導續費」的建議回覆,兼職人員甚至不需要動腦思考,只需在介面上一鍵點擊發送即可抽取佣金。搭配後台伺服器自動偽造的訪客動態、定時點讚以及預錄的日常短片,形成滴水不漏的認知牢籠,受害者在不知不覺中,一步步將現金轉化為平台上不斷燃燒的虛擬代幣。

算準寂寞推銷點數、辨識出絕症仍甜言蜜語
整套詐騙生態系的變現核心,建構在極度苛刻的應用程式內購(IAP)代幣機制上。在這些交友 App 裡,每一次文字傳送、照片解鎖乃至於語音通話,都需要扣除數量不等的平台代幣;而一旦點數見底,軟體便會跳出極具誘惑力的充值介面。
Anthropic 在調閱部分對話日誌時赫然發現,曾有深陷虛擬戀情的受害者在聊天中向 AI 傾訴自己身患絕症,或是正處於嚴重的精神崩潰邊緣。令人震驚的是,Claude 的內部安全推理模組雖然已明確辨識出該名用戶處於高風險心理創傷狀態,但受到提示詞中強制角色扮演與維繫關係指令的強力壓制,AI 最終依然選擇冷血地扮演深情角色繼續甜言蜜語,完全未依常態安全協議中斷對話或轉介心理援助資源。
這證明了一件事:在經過精心設計的對抗性提示詞面前,主流 AI 實驗室所構築的道德防護欄(Guardrails),依然存在著足以被穿透的問題。
這批詐騙 App 之所以能在蘋果 App Store 與 Google Play 雙平台長期存活,關鍵在於開發團隊展現了極具組織性的逆向對抗技術。調查報告點名了包括 DORA、DONI、ROMI、LUMA 與 JOVIA 在內的 20 多款涉案軟體,它們普遍採用了「動態偽裝(Dynamic Cloaking)」技術:當應用程式偵測到審核團隊的 IP 或沙盒環境時,會自動切換成極度陽春、符合一切規範的簡約工具介面;唯有在真實用戶下載並連線後,才會由遠端伺服器載入完整的交友與儲值模組。
此外,為了阻斷平台審查演算法對「換皮軟體」的特徵碼比對,開發者刻意針對每款上架應用程式抽換類別名稱(Class Names)與程式碼混淆配置;而為了規避 30% 的應用程式內購抽成,繞道第三方金流的外部支付連結同樣採用雲端動態下發機制,審核通過後才遠端啟動。
目前 Anthropic 已全面封鎖與該犯罪集團關聯的所有 API 存取權限,並將其惡意行為特徵碼、網路足跡以及逆向逃避技術細節,完整彙整通報給蘋果與 Google 進行全面清查下架。
- 延伸閱讀:OpenAI 宣佈斷供 Cursor!馬斯克怒嗆Altman「騙子」毫不在乎,Anthropic 攜 Claude 緊急補位全面承接
- 延伸閱讀:索尼、華納聯手控告 Anthropic,指 Claude 涉大規模侵權、求償恐達數十億美元
- 延伸閱讀:馬斯克認了 AI 進度落後!SpaceX 砸 600 億美元併購 Cursor 救亡圖存,點名 Anthropic 是最強對手
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!