AI 潤稿讓文字千篇一律!研究揭語言同質化危機 專家示警:本土語言恐面臨「數位生存戰」

作者: 陳子凡
2026-08-25

國際權威期刊《自然人類行為》(Nature Human Behaviour)最新研究指出,大型語言模型改寫在保留文意的同時,使人類寫作風格趨於同質性,寫作複雜度變異驟降 2 至 5 成,並顯著抹除年齡與心理狀態等個人特質線索。針對這項趨勢,台灣科技媒體中心邀請國內專家深入剖析,示警AI潤飾不僅衝擊憂鬱情緒偵測與人才招募等應用,更恐讓繁體中文、客語及原住民族語等本土語系,在數位浪潮中加速邊緣化。

此項由美國南加州大學電腦科學系與心理學系團隊執行的跨領域研究,蒐集社群論壇「Reddit」文章、學術論文摘要與演說等七大資料集、逾 88 萬篇文本,並透過12種提示詞,實測 GPT-3.5、Llama 3 及 Gemini Pro 等主流模型改寫。數據顯示,經由演算法修飾後的稿件雖有 87% 維持原意,但辨識作者個人特徵的準確率平均下降 6%,其中年齡判別受損最鉅;改寫後的文字更一面倒呈現同理心偏低、道德關懷較強,且立場偏向自由派的單一標準樣貌。

Ai潤飾改寫使人類寫作風格趨於同質性,複雜變異程度驟降 2 至 5 成,並顯著抹除年齡與心理狀態等個人特質線索。
AI潤飾改寫使人類寫作風格趨於同質性,更顯著消除年齡與心理狀態等個人特質線索。(圖片來源/AI生成)

國立成功大學敏求智慧運算學院副教授李韶曼指出,AI 模型雖保留了我們說什麼,卻改變了我們怎麼說,但怎麼說本身,實際承載了個人身分與心理資訊。心理狀態偵測、招募甄選、個人化服務這些常見的應用,都建立在作者資訊留存於文字的前提上。「AI 改寫一旦刪去這些訊息,對所有藉語言理解人的應用就會造成影響,比如憂鬱與輕生意念的語言資訊若被抹去,我們更難從文字及早發現需要幫助的人。」李韶曼表示,在最大的公開網頁語料庫中,英文約占 4 成,中文簡繁合計不足 5% 且多為簡體,台語、客語與原住民族語更近乎缺席。「若把台灣人的寫作與表達交給AI改寫,會呈現什麼樣貌?這個問題,需要以台灣語料做同等研究來回答。」

專家認為,ai改寫若抹除憂鬱與輕生意念的語言資訊,將更難從文字及早發現需要幫助的人。
專家認為,AI改寫若抹除憂鬱與輕生意念的語言資訊,將更難從文字及早發現需要幫助的人。(圖片來源/AI生成)

面對潛在的文化斷層,國立聯合大學客家研究學院院長、文化創意與數位行銷學系教授張陳基分析,這篇論文不僅證實了語言同質化的存在,更深刻指出這種同質化帶有強烈偏向性,會讓全人類的語言在不知不覺中向特定優勢族群靠攏。他示警,「若 AI 主要支援華語與英語,使用者為了取得準確、便利的服務,就會被迫轉換語言,結果不是客語回到主流,而是在數位社會加速被遺棄。」AI 若不會聽、不會說、不會寫客語,就會傳達這種語言「不值得使用」的訊號,客語 AI 不是科技加值,而是數位時代的語言生存工程。張陳基呼籲產官學界落實「AI 族群主流化」,從語料、模型到服務三方向開放,並建立多樣性檢測機制,避免地方詞彙遭到抹除。

專家示警,語言同質化帶有強烈偏向性,會讓全人類的語言在不知不覺中向特定優勢族群靠攏。
專家示警,語言同質化帶有強烈偏向性,會讓全人類的語言在不知不覺中向特定優勢族群靠攏。(圖片來源/AI生成)

值得探討的是,該論文發現「地方新聞」是各類文體中,唯一未出現明顯同質化現象的類別,推測專業編輯台的人工審查,有效阻隔了風格趨同效應。專家提醒,社會在享受自動化便利的同時,更應警惕語言單一化對多樣性帶來的侵蝕,唯有強化本土語料自主權與人機協作把關,方能在科技狂潮中守住真實且多元的人性價值。

研究論文連結:https://doi.org/10.1038/s41562-026-02550-0

推薦文章