仿聲詐騙速度快、成本極低 講10字就能複製
ISO專業認證AI提示詞工程師許天祥表示,現在深偽聲音最常見的犯罪就是詐騙,而且成本極低,只要在社群平台上取得任何人的聲音,生成2句話的成本不到5元。更可怕的是,只要講10個字的聲音就可以完整複製聲線、音調等等。
辨識詐騙 從「驗證來源」著手
許天祥向《大紀元時報》說,他在國防大學授課時曾使用總統的聲音,只用了「大家好,我是賴清德」就能模仿說出一大串話,但AI迭代更新速度非常快,現在可能只要5個字就能辦到。因此,他建議民眾若接到不明來電、推銷電話時,最好是直接掛斷,或是先聽對方說什麼,否則光是「喂,你好,不需要,謝謝,拜拜」,就足夠讓詐團向親友借款了。
「AI時代來臨,最重要的素養,不是學會從(影像的)嘴型、眨眼、瑕疵等來判斷真假」,許天祥強調,因為這些破綻遲早都會因為技術進步而消失,偵測工具也不可能永遠跑在生成工具前面。面對深偽詐騙,真正可靠的方法是「停、換、問、存」,從原本的「肉眼辨識」轉向「驗證來源」。
許天祥說明,只要影音內容涉及匯款、投票、醫療、投資、密碼、個資、政府命令或緊急事件等,就不應只靠一段錄音或影片就採取行動,並改用對方實際電話、官方網站、其他家人或公司既有流程等第二管道進行查證,家人間也可以事先約定通關密語,並應保存網址、帳號、對話、影音、時間及匯款紀錄等證據。
AI法規 專家籲補「5拼圖」
台灣目前的《人工智慧基本法》明定尊重人格權、保護個資、透明揭露、問責及避免資訊誤導與造假,並要求數位發展部推動風險分類框架,各主管機關應在施行後2年內檢討與修正相關法規。但許天祥表示,該法僅止於建立治理制度的基本原則,真正要處罰詐騙,還是必須視犯罪行為回到《刑法》、《個資法》、《選罷法》、《食安法》或其他領域法規。
許天祥說,台灣目前也普遍缺乏AI素養,民眾從風險出現到是否要標示、違法界線在哪、誰需負責、違反原則有什麼後果等,幾乎沒有概念,在現行法規中也是一片空白。參考歐盟《人工智慧法案(AI Act)》,它是全球首部針對AI全面立法的綜合性法規,依照潛在危害程度進行分級管理,最嚴重可明訂禁止某個用途,並對開發者、使用者課予法律義務。
許天祥向《大紀元時報》表示,台灣未來至少需要補上5塊拼圖。第一,應建立「數位身分權」,明確保護個人的聲音、臉孔、外貌與其他足以識別身分的特徵,同時也應明確保留新聞報導、公共評論、研究等合理例外用途。第二,應建立統一的「標示標準」,尤其高風險內容,不應只在資訊欄註明,而是在第一時間就揭露,並搭配來源資訊或數位浮水印。
第三,應採「情境分級」,若是一般娛樂創作、明顯諷刺與新聞教育等,可以保留較大使用空間;但若涉及性影像、兒少、選舉、政府命令、金融、醫療、災害及國家安全等領域時,則應有更高的同意、查證與標示義務。第四,應建立完整的「責任鏈」,不能每次出事都只追究最末端的小編、剪輯或創作者,也要看是誰委託、出資、核准,以及平台是否幫助散布。
第五,應建立「快速下架、證據保存及申訴制度」,既不能讓被害人等到判決確定才有機會讓假影片消失,也不能讓政府只以「疑似假訊息」為由就任意下架政治評論,因此必須搭配司法審查與創作者申訴機制。刑責則是最後一道防線,主要處理刻意欺騙、營利、干預選舉等重大犯罪,以免造成AI創作領域寒蟬效應。◇












