人工智慧和機器學習長期以來一直被用於维基媒体计划,主要用於協助編輯現有條目。例如,2007年的ClueBot依賴簡單的啟發式演算法來識別可能的破壞,而其2010年的後繼者ClueBot NG則透過人工神經網路使用機器學習。機器翻譯軟體也被維基媒體貢獻者使用了多年。2022年12月6日,維基百科貢獻者Pharos進行了一項早期實驗,他使用ChatGPT生成初稿建立了條目「」。另一位試驗過這個早期版本ChatGPT的編輯表示,ChatGPT對該主題的概述還不錯,但引用的文獻是偽造的。2023年,考慮到AI為編輯提供的生產力優勢,社群認為全面禁止AI「過於嚴厲」。2023年,維基百科社群成員建立了一個名為的維基專題,以協助從維基百科中移除劣質AI內容。
來自西班牙的前維基媒體成員Miguel García在2024年表示,當ChatGPT最初推出時,網站上AI生成的條目數量達到頂峰。他補充說,由於社群努力打擊,AI條目的比例現已穩定下來。他說,大多數沒有來源的條目會被立即刪除或被提名刪除。2024年10月,普林斯頓大學的一項研究發現,英語維基百科上3,000個新建立的條目(2024年8月建立)中,約有5%是使用AI建立的。該研究稱,一些AI條目是關於無害的主題,AI可能僅用於協助寫作。對於其他一些條目,AI則被用來推廣商業或政治利益。2024年10月,維基專題「AI清理」的創始人Ilyas Lebleu表示,他們和其他編輯注意到了一種不自然的寫作模式,可能與ChatGPT有關。他們補充說,AI能夠大量生產聽起來真實但完全虛假的內容,導致維基百科上出現惡作劇條目,他們只能負責刪除。
2025年6月,維基媒體基金會開始測試一項「簡易條目摘要」(Simple Article Summaries)功能,該功能將提供AI生成的維基百科條目摘要,類似於Google搜尋的AI摘要(AI Overviews)。這一決定立即遭到部分維基百科編輯的嚴厲批評,他們稱該功能是個「可怕的主意」和「公關炒作噱頭」。他們批評由於AI傾向於產生幻覺,會導致對網站的信任度下降,並質疑該功能的必要性。這些批評導致維基媒體基金會在同月暫停了簡易條目摘要的推出,但仍表示有興趣將生成式AI更多地整合到維基百科中。該專案暗示了社群內部以及社群與基金會之間關於何時使用AI的緊張關係。使用AI的其他跡象包括過度使用長破折號、濫用單詞「moreover」(此外)、條目中包含將某事物描述為「breathtaking」(令人屏息)的宣傳性材料,以及格式問題,如使用彎引號而非直引號。在討論實施快速刪除方針期間,一位身為條目審核員的使用者表示,他「不停地被AI生成的糟糕草稿淹沒」。其他使用者表示,AI條目包含大量「謊言和虛假參考文獻」,並且需要花費大量時間來修復這些問題。維基百科於2025年8月建立了一份關於如何識別AI寫作跡象的指南,標題為「」。在Google識別線上論壇有毒評論的Perspective API開發過程中,使用了一個包含數十萬條維基百科討論頁評論且帶有人工標記毒性等級的資料集。
截至2023年,維基百科語料庫的子集被認為是用於AI訓練的最大且精心策劃的資料集之一,根據的說法,它是迄今為止訓練每個大语言模型的基礎。他們還注意到2025年訪問維基百科的訪客減少了8%,他們將此歸因於生成式AI和社群媒體的日益普及。
2025年,維基媒體基金會提到其承擔了與人工智慧公司抓取資料相關的成本增加,並正在尋求更有效地向公司提供訓練資料,以及使其資料更有用,包括透過特別授權協議和付費API來限制並回收向AI公司提供資訊的部分成本。
反應
2023年,史蒂芬·哈里森引用了長期維基百科人的擔憂,擔心維基百科會「失去其最初的勇於嘗試精神,並對變革產生下意識的抵制」。2025年10月,威爾斯鼓勵使用AI進行編輯任務,如發現不一致和指出缺失資訊,但尚未鼓勵用於撰寫整篇條目。
在2025年8月的一次採訪中,Ilyas Lebleu將快速刪除描述為應對更嚴重AI使用情況的「權宜之計」,並表示AI使用的更大問題將繼續存在。他們還表示,一些AI條目在被刪除前會被討論一週。
參見
- AI垃圾
- 開源人工智慧
- Grokipedia
參考資料
外部連結
- Artificial intelligence
- Machine Learning/LiftWing
评论 (0)