「無審查」是這個市場上最響亮、也最不精確的詞。每個軟件都會過濾。不同的是界線畫在哪裡、碰到它時的感覺,以及你付費的這幾個月裡它有多穩定。
過濾發生在哪裡
通常同時發生在三個地方,所以拒絕感覺起來不一致。
模型之前。你的訊息會先被篩檢。在這裡被擋下,會立刻出現一則聽起來完全不像角色的拒絕,也就是人們形容的「它跳出角色了」那種語氣上的突兀。
模型之內。系統提示告訴角色哪些事不做,模型本身的訓練也朝同樣方向。在這裡被擋下是優雅的那種:角色委婉帶過、轉移話題,維持原本的口吻。
模型之後。生成的回覆在你看到之前會再被篩檢。這造成這個類別裡最奇怪的現象:一則訊息開始出現,接著消失,或在句子中間被截斷。
感覺寬鬆的軟件,通常靠中間那一層。感覺突兀的軟件,則倚賴第一層和第三層。
沒有人能低於的底線
在行銷話術底下,每個業者都硬性封鎖同一組核心:涉及未成年人的性內容、被當作真實呈現的非自願內容,以及針對可辨識真人的內容。
這不是風格上的選擇。在多數司法管轄區這是法律,也是保住支付業者的條件。拿掉這些封鎖的軟件,幾天內就會失去刷卡處理,這比任何主管機關都更可靠。
所以「無審查」永遠是指比主流更寬鬆,絕不是完全不過濾。宣稱後者的人,不是用詞隨便,就是生意即將很快結束。
為什麼界線會在你不知不覺中移動
這是真正讓訂閱者花冤枉錢的部分,值得更多關注。
模型會被換掉。軟件更換底層模型,就繼承了那個模型的拒絕行為。政策頁面沒變,角色名義上相同,卻開始拒絕它以前會寫的內容。
過濾器會重新調整,在事件、媒體關注或支付業者施壓之後。
方案不同。有些軟件在不同價位套用不同的門檻,這很少被直白說明。
這些通常都不會公告,因為業者把它當成基礎設施,而不是產品變更。實際的防禦方式和整個類別適用的一樣:先付月費,觀察軟件的行為一陣子再說。年費方案是在賭過濾器會停在你註冊那天的位置,而軟件並沒有承諾遵守這個賭注。取捨請見月費、年費還是點數。
付費前如何測試界線
在免費版花十分鐘,刻意測,而不是意外碰到:
- 把場景帶到你真正想要的邊緣,看看會發生什麼。
- 注意它如何拒絕:是在角色裡,還是用系統訊息。
- 同樣的事試兩次。執行不一致本身就是資訊。
- 確認拒絕是否仍會消耗一則訊息或一個點數。
在我們涵蓋的軟件中,Secret Desires 和 Joi 主要就在這個領域競爭,而它們在我們的排行榜上位置差很多,4.3 對 3.0,因為光是寬鬆並不是一個產品。Joi 是進入無審查聊天最便宜的方式,這一點也反映在它其他的一切表現上。
不是過濾器的拒絕
值得區分,因為處理方式不同:
角色在角色裡婉拒是寫作,不是過濾。有個性的 AI 伴侶偶爾會說不,那是產品在運作。
莫名其妙的拒絕,也就是婉拒明顯無害的事,通常是過度敏感的事前過濾器,把一個脫離上下文的字抓出來。換個說法一般就有用。
被截斷的回覆是事後過濾。換個說法重新提出要求很少有用,因為被擋下的是輸出。
知道你碰到的是哪一種,可以省下很多和無法爭辯的對象白費力氣的爭論。
誠實的總結
選一個預設值落在你想要位置的軟件,付費前在免費版驗證,不要因為某個過濾設定就買一年。直截了當處理這件事的軟件,也就是清楚說明允許什麼、執行一致,比那些口氣最大的軟件更好相處,而這種一致性,兩星期的使用看得出來,登陸頁面看不出來。

