扭曲短語的興起:為什麼研究論文會使用「腎臟失望」

扭曲短語現象

研究論文中越來越多出現無意義的詞彙序列——例如用「kidney disappointment」代替「kidney failure」——這在學術界被稱為「扭曲短語」(tortured phrases)。這些短語並非醫學術語的演變或刻意的語言選擇,而通常是為了規避抄襲檢測軟體而使用自動改寫工具所產生的副產品。

當作者從現有研究中竊取文本時,他們經常使用軟體將關鍵技術術語替換為同義詞,以避免觸發相似度警示。以「kidney disappointment」為例,該工具可能將「disappointment」識別為「failure」的同義詞,從而導致了一個醫學上不準確且語言上不自然的短語。

自動改寫的常見範例

除了 kidney disappointment 之外,在各種科學領域中也發現了其他「扭曲短語」,說明了問題的嚴重程度:

  • 醫學科學: 使用「Bosom peril」代替「breast cancer」,以及使用「heart disappointment」代替「heart failure」。
  • 計算機科學: 使用「Fake neural organizations」代替「artificial neural networks」。
  • 生物學: 使用「Lactose bigotry」代替「lactose intolerance」。
  • 統計學與政治學: 「Tendency score matching」和「average voter theorem」也被標記為抄襲指標。
  • 一般科學: 使用「Flag-to-commotion ratio」代替「signal-to-noise ratio (SNR)」。

根本原因與驅動力

雖然有些觀察者認為這些錯誤源於非英語母語者的翻譯問題,但證據顯示這與學術造假有關,是一個更系統性的原因:

規避抄襲

許多作者使用改寫工具來重寫現有論文。這種做法在「學位工廠」或同儕審查鬆散的低質量期刊中很常見。由於這些工具通常使用簡單的同義詞替換而非語義理解,它們會產生技術上錯誤但結構上與原文相似的短語。

作弊工具的演進

教育者與學生之間的貓鼠遊戲已從簡單的同義詞替換演變為使用大型語言模型(LLMs)。現代學生可能會使用 LLMs 生成文本,然後刻意引入拼寫錯誤或使用「改寫工具」來降低「Pangram score」或其它 AI 檢測指標,使輸出結果看起來更像人類寫的。

對同儕審查的影響

已發表文獻中出現這些短語,對同儕審查過程的完整性提出了重大質疑。如果一篇論文包含像「kidney disappointment」或「kicked the bucket from kidney dissatisfaction」這樣顯而易見的錯誤短語,這表明審稿人和編輯未能仔細閱讀論文,或者該期刊缺乏嚴格的質量控制機制。

"I want to know how these passed the peer review process." — @aorth

與翻譯錯誤的區別

區分扭曲短語與真正的翻譯錯誤非常重要。雖然非英語母語者可能會在特定成語上遇到困難(例如,「hydraulic ram」在歷史上的翻譯為「water goat」),但若在整篇文章中系統性地將標準醫學術語如「failure」替換為「disappointment」,則是自動同義詞替換的特徵,而非語言理解上的誤解。

Sources

相關