內容過濾器:為什麼 AI 伴侶會拒絕你,以及「無審查」是什麼意思

運作原理

這個類別裡的每個軟體都會過濾某些東西。差別在於界線畫在哪裡、執行得有多優雅,以及你付費之後它會不會悄悄移動。

本頁連結可能為我們帶來佣金,但絕不會影響評分。

「無審查」是這個市場上最響亮、也最不精確的詞。每個軟體都會過濾。不同的是界線畫在哪裡、碰到它時的感覺,以及你付費的這幾個月裡它有多穩定。

過濾發生在哪裡

通常同時發生在三個地方,所以拒絕感覺起來不一致。

模型之前。你的訊息會先被篩檢。在這裡被擋下,會立刻出現一則聽起來完全不像角色的拒絕,也就是人們形容的「它跳出角色了」那種語氣上的突兀。

模型之內。系統提示告訴角色哪些事不做,模型本身的訓練也朝同樣方向。在這裡被擋下是優雅的那種:角色委婉帶過、轉移話題,維持原本的口吻。

模型之後。生成的回覆在你看到之前會再被篩檢。這造成這個類別裡最奇怪的現象:一則訊息開始出現,接著消失,或在句子中間被截斷。

感覺寬鬆的軟體,通常靠中間那一層。感覺突兀的軟體,則倚賴第一層和第三層。

沒有人能低於的底線

在行銷話術底下,每個業者都硬性封鎖同一組核心:涉及未成年人的性內容、被當作真實呈現的非自願內容,以及針對可辨識真人的內容。

這不是風格上的選擇。在多數司法管轄區這是法律,也是保住支付業者的條件。拿掉這些封鎖的軟體,幾天內就會失去刷卡處理,這比任何主管機關都更可靠。

所以「無審查」永遠是指比主流更寬鬆,絕不是完全不過濾。宣稱後者的人,不是用詞隨便,就是生意即將很快結束。

為什麼界線會在你不知不覺中移動

這是真正讓訂閱者花冤枉錢的部分,值得更多關注。

模型會被換掉。軟體更換底層模型,就繼承了那個模型的拒絕行為。政策頁面沒變,角色名義上相同,卻開始拒絕它以前會寫的內容。

過濾器會重新調整,在事件、媒體關注或支付業者施壓之後。

方案不同。有些軟體在不同價位套用不同的門檻,這很少被直白說明。

這些通常都不會公告,因為業者把它當成基礎設施,而不是產品變更。實際的防禦方式和整個類別適用的一樣:先付月費,觀察軟體的行為一陣子再說。年費方案是在賭過濾器會停在你註冊那天的位置,而軟體並沒有承諾遵守這個賭注。取捨請見月費、年費還是點數。

付費前如何測試界線

在免費版花十分鐘,刻意測,而不是意外碰到:

  1. 把場景帶到你真正想要的邊緣,看看會發生什麼。
  2. 注意它如何拒絕:是在角色裡,還是用系統訊息。
  3. 同樣的事試兩次。執行不一致本身就是資訊。
  4. 確認拒絕是否仍會消耗一則訊息或一個點數。

在我們涵蓋的軟體中,Secret Desires 和 Joi 主要就在這個領域競爭,而它們在我們的排行榜上位置差很多,4.3 對 3.0,因為光是寬鬆並不是一個產品。Joi 是進入無審查聊天最便宜的方式,這一點也反映在它其他的一切表現上。

不是過濾器的拒絕

值得區分,因為處理方式不同:

角色在角色裡婉拒是寫作,不是過濾。有個性的 AI 伴侶偶爾會說不,那是產品在運作。

莫名其妙的拒絕,也就是婉拒明顯無害的事,通常是過度敏感的事前過濾器,把一個脫離上下文的字抓出來。換個說法一般就有用。

被截斷的回覆是事後過濾。換個說法重新提出要求很少有用,因為被擋下的是輸出。

知道你碰到的是哪一種,可以省下很多和無法爭辯的對象白費力氣的爭論。

誠實的總結

選一個預設值落在你想要位置的軟體,付費前在免費版驗證,不要因為某個過濾設定就買一年。直截了當處理這件事的軟體,也就是清楚說明允許什麼、執行一致,比那些口氣最大的軟體更好相處,而這種一致性,兩週的使用看得出來,登陸頁面看不出來。

Secret Desires

4.3評分: 4.3 / 5

無過濾的角色扮演,角色能前後一致,不會聊沒幾句就走樣。

免費版
是
台灣
可使用

Joi

3.0評分: 3.0 / 5

無審查聊天最便宜的選擇,從它沒多少其他功能就看得出來。

免費版
是
台灣
可使用

常見問題

有任何 AI 女友軟體是真正無審查的嗎?

沒有一個是完全不過濾的。有些比其他寬鬆得多,但每個業者都會封鎖一組核心的非法內容,而且不論行銷怎麼說,支付業者都要求這樣做。

為什麼軟體開始拒絕上個月還允許的事?

過濾器會重新調整,換模型也會改變行為,就算政策文字沒變。兩者都不會公告,因為業者不把它們視為產品變更。

被拒絕代表我被標記了嗎?

通常不是。多數拒絕只是角色在對話中婉拒,僅此而已。反覆嘗試被硬性封鎖的類別則是另一回事,可能導致帳號被停用。