Reddit用AI打AI!一天攔23萬次垃圾內容

2026-07-07 1

Reddit最新公布,已經把大型語言模型(LLM)部署進垃圾內容偵測系統,每天能攔下2300萬次垃圾訊息瀏覽,並額外揪出大約2.5萬則新的垃圾貼文。乍看是一次技術升級,但背後藏著一個相當諷刺的現實:這些氾濫的垃圾內容,有不少本身就是LLM生成的。換句話說,Reddit現在是用AI,去打另一群AI。


為什麼會走到這一步?

這幾年,強大的語言模型讓造假變得又快又便宜。

虛假產品推薦、協同帶風向式的假訊息,批量生產起來幾乎沒有技術門檻,傳統那套靠固定規則判斷的偵測系統,面對這種規模和精緻度,早就顯得力不從心。

Reddit這次的做法,說白了就是「以彼之道還施彼身」:既然造假的是AI,那就換一套同類型的AI來抓。根據Reddit官方博客,新工具特別針對「高度隱蔽、有組織的虛假行為和人為炒作模式」設計,目標很明確,就是衝著過去容易被漏掉的複雜垃圾內容而來。


幾組數據,看懂這場「AI對AI」的攻防

每天攔截2300萬次垃圾訊息瀏覽

這個數字說明的是攔截規模。代表過去很可能有相當一部分用戶,每天都在被動接觸這些內容,而現在這道防線被大幅前移。

每天新增揪出約2.5萬則垃圾貼文

這反映的是識別精度。意味著系統不只是攔阻曝光,還能主動抓出新產生的違規內容,而不是被動等它擴散開來。

1月至3月用戶接觸垃圾內容頻率下降20%

這是橫向對比的結果,說明的不只是「攔得多」,而是實際體感層面,普通用戶滑手機時遇到垃圾內容的機率確實變低了。


這件事,市場真正在意的是什麼?

首先,這代表AI正在改變平台衡量審核成效的方式。過去,內容審核大多仰賴規則庫和人工篩查;如今,越來越多平台開始相信,用同一代AI技術去對抗AI生成內容,才是跟上造假速度的關鍵。

其次,這件事牽扯的不只是Reddit一家。YouTube、Meta、Instagram現在都要求用戶標註AI生成內容,TikTok則讓用戶自己調整這類內容的可見度。也就是說,能更快識別AI生成的貼文,理論上也能加速對仇恨言論、有組織虛假行為等其他違規內容的標記效率。

不過,值得注意的是,平台方面的專家也提醒,AI驅動的審核並不是萬能解法。演算法擅長大規模篩出可疑內容,但涉及語境、諷刺、邊緣案例這類需要細膩判斷的情況,仍然離不開人工審核。

Reddit用AI打AI!一天攔23萬次垃圾內容

真正值得關注的,不只是那2300萬次攔截

說實話,2300萬次的攔截規模固然驚人,但真正值得思考的是,這件事透露出的訊號——內容平台和造假技術之間的較量,已經正式升級成一場「AI對AI」的軍備競賽。

看到這裡很多人會問,那接下來是不是就能高枕無憂?恐怕不會。生成式AI還在持續進化,造假和反造假這場拉鋸戰,短期內大概率看不到終點。


內容審核,正在進入一個新階段

Reddit這次的升級,說到底不是解決了垃圾內容問題,而是說明內容審核這件事,正被迫進入一個新階段:單靠規則引擎已經不夠用,平台必須用同一代技術去對抗同一代的濫用手法。

未來值得繼續觀察的是,這套「用AI打AI」的模式,會不會在更多社群平台複製,以及人工審核在這場升級戰裡,到底還能撐住多久的話語權。這兩個問題,將決定接下來內容審核產業的走向。


FAQ

Q1:Reddit為什麼特別強調用LLM對抗LLM生成的垃圾內容?

因為近期大量垃圾內容本身就是靠LLM批量生成的,型態更隱蔽、更逼真,傳統靠固定規則判斷的系統很難跟上。Reddit的思路是用同類技術去識別這些手法,提升偵測的精準度和速度。

Q2:這次升級之後,Reddit的垃圾內容問題是不是就解決了?

不能這麼說。平台方面也強調,AI審核擅長大規模篩選,但涉及語境判斷、諷刺語氣等邊緣情況,仍需要人工介入。目前比較準確的說法是,情況有明顯改善,而不是問題已經徹底消失。

Q3:這件事對其他社群平台有什麼參考意義?

Reddit的做法顯示,用同代AI技術對抗AI生成內容,可能是接下來內容審核的通用方向。這也呼應了YouTube、Meta、TikTok等平台近期陸續要求標註AI生成內容的趨勢,顯示整個產業正在往類似方向靠攏。

相关文章

兼职工作每周多少小时合适?多少小时算兼职?
这个周末如何赚钱?有什么快速赚钱的方法吗?
笔记本电脑赚钱的方法有哪些?笔记本电脑真的能赚钱吗?
智能翻译AI软件下载安装教程,手把手教你避开捆绑陷阱
交易加密货币如何赚钱?有哪些方法可行?
如何在线致富?网上赚钱的方法有哪些?