兒女哭喊借錢別急匯!最新AI「複製聲音僅3秒」 77%父母分不出

實習編輯 張宣恩 報導
2026/09/05 13:07:00
過去民眾熟知的「假綁架、猜猜我是誰」電信詐騙,往往因口音生硬、語調機械或背景雜音破綻百出,多數人能輕易識破。然而,隨著人工智慧「零樣本語音克隆(Zero-Shot Voice Cloning)」技術急速平民化,電信詐欺犯罪已正式跨入多模態深偽的新時代。(圖/翻攝自Pixabay)

一通突如其來的電話,話筒那頭傳來兒女撕心裂肺的哭喊聲,顫抖著說「出車禍撞到人、被扣留急需數十萬賠償」,任何為人父母者恐怕都會在一瞬間理智斷線。然焦急求救的聲音,極可能完全不是真人。內政部警政署刑事警察局近日發布科技防詐警訊示警,新型態生成式「AI語音深偽(Deepfake Audio)」詐騙正全面升級。國際資安大廠最新調查更揭露,詐騙集團僅需截取民眾在社群平台上公開的3秒日常談話影音,便能以假亂真複製聲紋;犯罪組織更精準鎖定週末家庭成員分散的「通訊時間差」發動突襲,迫使警政與資安單位緊急推動「家庭通關密語」防線。

國際資安大廠邁克菲(McAfee)發布的全球深偽詐欺調查報告《The Artificial Impostor》指出,目前的生成式AI語音工具僅需3至5秒音質清晰的語音樣本,就能精準分析並複製目標人物的基頻、共振峰與咬字習慣;該調查顯示,全球已有近兩成受訪者曾遭遇或知悉親友面臨AI語音詐騙,高達77%的受害者在第一時間完全無法辨識真偽而蒙受財務損失。現代年輕族群習慣在Instagram Reels、TikTok或YouTube Shorts等公開平台發布日常Vlog、對話或開箱影片,這些未設隱私權限的音訊已成為詐團最唾手可得的「免費聲紋庫」。

請繼續往下閱讀…

結合情感合成模型後,系統甚至能自動加入「急促啜泣、大口喘氣、語無倫次」等極端情緒特徵,反應延遲更被壓縮至0.5秒以內,足以在電話中與長輩進行即時對答。當父母在慌亂中接起電話,聽見與親生骨肉音色完全一致的求救哭嚎,大腦防禦機制往往瞬間瓦解。

除了技術升級,詐欺集團在犯罪心理學的操作上更顯縝密。根據警政署165全民防騙諮詢專線的實務統計與案件分析,此類案件極度好發於週五晚間至週日。辦案人員分析,週末往往是年輕子女出遊、聚會、戶外運動或補眠的時間,回覆通訊軟體的速度較平日上班時間顯著拉長。詐騙分子通常捏造「開車撞傷孕婦」、「替友人擔保遭地下錢莊押走」、「涉及刑案被警方留置需要交保金」等緊急事由,並以「敢掛電話就打斷手腳」或「絕對不能驚動警方」等言詞恐嚇,刻意製造資訊孤島,阻斷長輩向外求證的黃金時間。在高度時效威脅與恐慌情緒夾擊下,被害人極易遵從指示前往銀行臨櫃提款、面交車手或透過ATM操作匯款。

面對「眼見為憑、耳聽為真」的常識被科技顛覆,內政部警政署刑事警察局會同美國聯邦貿易委員會(FTC)發布的消費者防詐指引,共同提出三道家庭自保防線:  

實體約定「家庭通關密語」: 警政署預防科建議,直系親屬間應在實體家庭聚會時,共同設定一組「僅有核心成員知曉」的暗號或冷門問答。  

切斷通話、以「原留管道」直接查證: 國家通訊傳播委員會(NCC)與電信業者提醒,境外竄改來電常帶有「+886」等前綴符號,且詐團會以言語施壓「嚴禁掛斷」。  

拋出「假資訊陷阱」反向刺探: 若對方透過言語恐嚇阻止掛斷,可故意拋出虛構的情節進行誘捕測試。若對方為了急於取得款項而順著話柄含糊應答,即可百分之百斷定為詐騙話術。