本文來自微信公眾號: 心智觀察所 ,作者:心智觀察所
2026年7月7日,《Nature》的一篇報道將一款名為Academic Humanizer(學術(shù)人性化)的開源工具推上了風口浪尖,在學界引發(fā)激烈爭論.有人將其視為寫作助手,有人則斥之為學術(shù)欺騙的幫兇。
這款工具于6月20日由明尼蘇達大學機器學習研究員Jie Ding在GitHub上發(fā)布。它的功能聽起來簡單得令人不安:讓AI撰寫的論文和資助申請書聽起來像是人寫的,具體來說,是像“作者本人”寫的。
用更多的AI,掩蓋AI的痕跡
據(jù)《Nature》報道,Academic Humanizer本質(zhì)上只是一個Claude技能,換句話說,它在用更多的AI來“修正”AI在學術(shù)寫作中留下的問題。它做的事情包括:去掉AI常見的句式構(gòu)造(比如“not just X, but Y”這種結(jié)構(gòu))、刪除過多的破折號、削減浮夸的措辭和過長的句子。更貼心的是,它可以參考用戶以往的作品,從而讓新生成的文本聽起來更像這個作者本人寫的。
Ding在GitHub自述文件中寫道:“AI輔助的草稿往往泛泛而談、啰嗦冗長,用詞浮夸,句子過長。它們還會偏離作者本人的語氣,丟失學術(shù)研究賴以立足的精確性?!?
而這款工具最初版本的自述文件更加直白,表明它的設(shè)計目的是“從論文和資助申請書中剝離AI寫作的痕跡”。有人就此提出質(zhì)疑,Ding于是迅速修改了表述,將其改為“銳化清晰度和語氣”。他還增加了一則倫理與披露說明,明確“該工具是編輯輔助工具,并不免除作者披露AI協(xié)助的義務(wù)”。
分裂的學術(shù)圈:有人叫好,有人憤怒
這款工具在科學界引發(fā)了截然相反的評價。
里斯本大學健康信息學研究員Francisco Calisto是它的忠實用戶:“我經(jīng)常使用這個工具,主要用于輔助寫電子郵件和代碼文檔。這是我用過的最好的工具?!?
密歇根大學科技政策研究員Misha Teplitskiy也支持使用學術(shù)人性化工具。他指出,許多母語非英語的科學家用AI工具潤色寫作,而學術(shù)人性化工具則讓AI文本聽起來更自然,進一步“拉平了競爭環(huán)境”。
但反對的聲音同樣尖銳。
西班牙瓦倫西亞理工大學植物生物學家Miguel Rodriguez直言道:“我不喜歡它,它在欺騙?!笨▋?nèi)基梅隆大學信息科學家Cassidy Sugimoto也表達了擔憂:“我擔心這一應(yīng)用場景有損科學。”
洛桑聯(lián)邦理工學院的生物化學家Mathieu Rebeaud說:“你必須在AI的使用上保持透明。依我看,人性化處理挺可疑的?!?
學術(shù)誠信的裂縫:當“人性化”成為掩飾
反對者的核心擔憂很直接:人性化工具讓科學家更容易掩蓋AI的使用痕跡。而根據(jù)許多期刊和資助機構(gòu)的規(guī)定,不披露AI的輔助,本身就是學術(shù)不端。
美國國立衛(wèi)生研究院前外部資助主管Michael Lauer的措辭更為嚴厲:使用人性化工具來逃避AI檢測軟件將是“一種非常嚴重的不當行為”,試圖掩蓋的行為“比實際違規(guī)更糟糕”。
Lauer提到一個案例。一名研究人員曾用AI同時提交了40項資助申請,直接促使美國國立衛(wèi)生研究院發(fā)出警告,反對“實質(zhì)性”地使用AI撰寫資助申請。
學術(shù)界的AI濫用問題遠不止于此。薩里大學的學者們?nèi)ツ昃娣Q,他們正被大量“公式化的研究文章”淹沒,這些文章帶有“膚淺且過于簡化的分析”,明顯是由大語言模型生成的。更諷刺的是,AI檢測工具GPTZero在神經(jīng)信息處理系統(tǒng)會議接收的51篇論文中,發(fā)現(xiàn)了100條虛構(gòu)的參考文獻,而這些論文中的每一篇都經(jīng)過了3到5位專家評審。
根據(jù)一項研究,2023年生物醫(yī)學論文中約有12.5%的摘要使用了AI輔助撰寫,而這個比例在2024年迅速攀升。與此同時,出版商和期刊正在努力應(yīng)對如何界定“可接受的AI使用”與“學術(shù)不端”之間的邊界。人性化工具的出現(xiàn),讓這條邊界變得更加模糊。
一場沒有贏家的軍備競賽
這款工具的誕生,不過是AI生成與AI檢測這場軍備競賽的最新回合。
2025年,一項關(guān)于對抗性改寫的研究已經(jīng)表明,這場競賽不會靠某個聰明的檢測器一勞永逸地解決:文本可以針對檢測器的反饋反復改寫,直到不僅能避開該檢測器,還能避開其他檢測器。
檢測工具本身的可靠性也存疑。一項同行評審研究對14款檢測工具的測試顯示,沒有一款能達到80%的準確率,五分之一的AI生成文本能夠逃過檢測。另一項研究發(fā)現(xiàn),某些檢測器將人類寫的文章誤判為AI生成的比例高達16%。
Pangram公司首席執(zhí)行官Max Spero對Academic Humanizer這款新工具進行初步測試,發(fā)現(xiàn)他們的系統(tǒng)能捕捉到大部分(但不是全部)經(jīng)過人性化處理的AI語言。他表示,他們公司正在設(shè)計升級版本,用以專門檢測這款工具。
攻防雙方都在升級,但問題的本質(zhì)從未改變。
人性化工具的市場版圖
Academic Humanizer并非孤例。事實上,人性化工具已經(jīng)擁有了一個不小的市場。
從專門的防檢測品牌,到主流寫作套件的附加功能,再到開源學術(shù)技能,人性化工具已經(jīng)滲透到寫作的各個環(huán)節(jié)。據(jù)2026年一項系統(tǒng)化網(wǎng)絡(luò)搜索,研究者發(fā)現(xiàn)了至少55個提供人性化服務(wù)的網(wǎng)站,它們的推銷話術(shù)驚人地一致:免費或低價試用,承諾“自然”的散文,以及明示或暗示它們可以擊敗檢測系統(tǒng)。
Ding的辯護:工具無罪,行為有責
面對鋪天蓋地的質(zhì)疑,Ding的回應(yīng)始終如一:“我會把工具和行為分開看待?!?
他強調(diào),在要求披露的情況下未能披露AI輔助,無論文本是如何生成的,都屬于不當行為?!暗赖聠栴}在于不披露及其背后的意圖,而不是編輯輔助工具的存在?!?
他在GitHub上增加了倫理與披露說明,明確“該工具是編輯輔助工具,并不免除作者披露AI協(xié)助的義務(wù)”。他形容自己的工具“不是用來生成新內(nèi)容或規(guī)避審稿”,而是“幫助研究人員更精確地表達自己的想法”。
一個更深的困境:我們到底在檢測什么?
人性化工具的爭議,迫使人們重新思考一個更根本的問題:學術(shù)檢測到底應(yīng)該檢測什么?
是一段文字里有沒有破折號、有沒有“not just X, but Y”這樣的句式?還是這段文字背后的思考過程、研究工作和責任歸屬?
美國疾病控制與預(yù)防中心2026年5月發(fā)布的新指南提出了一個方向:將AI披露視為一項實際的科學寫作任務(wù),而非道德上的污點。國際醫(yī)學期刊編輯委員會的建議同樣指出,在未發(fā)表手稿上使用AI可能造成保密問題,并要求在出版中使用AI時披露工具和用途。
這些指導原則指向同一個方向:與其把檢測器當作測謊儀、把人性化工具當作真品證書,不如把注意力轉(zhuǎn)向?qū)懽骱脱芯康娜^程。一篇打磨過的句子,不足以說明是誰做出了判斷、選擇了來源、發(fā)現(xiàn)了真相。
兩年之內(nèi),人機難辨?
新加坡南洋理工大學生物學家Richard She做出了一個令人不安的預(yù)測:兩年之內(nèi),經(jīng)過人性化工具處理的文本將與人類書寫的文本難以區(qū)分。
“事情很簡單,有了這么一款了不起的工具,人們就會去用。他們會用,他們就會為之辯護。”
She的話揭示了一個更深層的現(xiàn)實。人性化工具不會消失,即使“人性化”這個名字可能消失。此外,基礎(chǔ)模型在遵循個人偏好方面也變得越來越強,使得文本更平實、更短、更像某個人的風格。QuillBot和Grammarly也已經(jīng)將人性化功能明晃晃地擺在語法、改寫、語氣和檢測功能旁邊。
問題的核心從來不是工具本身,而是學術(shù)評價體系對“過程”的忽視。在教育出版中,更穩(wěn)妥的辦法是提供過程記錄:提案筆記、來源追溯、簡短的口頭答辯、修訂歷史、以及與作者實際經(jīng)驗相關(guān)聯(lián)的作業(yè)。在論文發(fā)表上,則需要提供來源、可追責的作者、經(jīng)過驗證的引文,以及對實質(zhì)性AI輔助的坦誠聲明。
如今的AI可以寫出越來越“人性化”的文字,再加上人性化工具可以抹去AI的最后一絲痕跡,透明、可追溯、可問責的學術(shù)誠信基石也就面臨著前所未有的考驗。
Ding說應(yīng)該分開看待工具和行為。但如果一個工具的存在導致不端行為更容易發(fā)生、更難被發(fā)現(xiàn),這種區(qū)分還能站得住腳嗎?
這個問題沒有簡單的答案。但有一件事是確定的:學術(shù)共同體必須盡快找到答案,因為兩年時間看似很長,其實眨眼之間也就過去了。
參考文獻
https://www.nature.com/articles/d41586-026-02105-3
https://etcjournal.com/2026/07/07/humanizer-tools-making-ai-writing-sound-less-like-ai/
