今年以來我的一個體驗:當我用中文向AI提問的時候,發現大AI給出的回答,大量直接取材於簡中圈的資源,在時事新聞這個領域,就是直接從中國大陸的網絡內容中去找答案,造成得到的回答非常「親共」,也就是說:在信息源頭上高度被污染。
這方面谷歌的gimini被污染得最為嚴重,有時候我感到它和中國的Deepseek,豆包差別也不大。經常給出的回答是:「根據我國的什麼什麼法規...」,感覺Google Gemini已經移民中國了。
畢竟互聯網上中文的內容,來自中國大陸的佔了90%以上。海外的幾大模型,為了追求用戶體驗的流暢度,增加了直接從中國大陸抓取數據的權重;而不是從全球範圍內抓取,再自動翻譯成英文,那要耗費更多算力,用戶等待時間也過長。
有一種未經證實的猜想是,中共那邊搞了些針對性的手腕,用自己的AI工具,向Gemini等對話模型誘導性地提問,訓練它們給出與中共官宣接近的回答。用AI訓練AI,去把國外的AI模型給洗腦了,給PUA了。😅這叫「模型對齊污染」,在理論上是完全可行的。
我日常要用到AI工具,做新聞輔助研究,從這個角度的體驗看,這個變化今年尤其明顯。以至於我在用Gemini之後,經常要回一句:「你的回答太接近中共官宣了,請更多取材獨立的消息來源,平衡作答」。然後Gemini說:「你說得很對,我會調整自己的回答方式...」然後才叭拉叭拉找出另一堆消息來源。
對於我們這些自媒體創作者來講,一個很現實的壓力就是,YouTube以AI來管理內容,對我們這類對中共持鮮明批判態度的博主,變得非常不友好。搞得AI被訓練得很仇視我們了。😅視頻動輒被限流、減少推薦。尤其是2026年以來,這種狀況正以每個月都在變得更糟糕的速度惡化。