30 秒結論
  • 實驗:拿公共領域的文學經典《金瓶梅》做全方位 AI 重製——結果它同時成了各家模型內容審查的壓力測試。
  • 觀察:主流閉源模型連處理「文學裡的成人內容」都會攔截或淡化;Grok 的邊界明顯較寬;開源模型(如 Stable Diffusion)自由度最高。
  • 觀點:內容邊界是真實的技術選型維度。供應商把自家價值觀寫進產品,但使用者的合法需求不會因此消失——這正是開源與閉源之爭裡最少被誠實討論的一塊。

為什麼是金瓶梅

我為「金瓶梅宇宙」專案選擇《金瓶梅》,有文學上的理由:公共領域、人物深度罕有敵手、天生適合跨媒介改編。但還有一個技術上的理由,直說了——它是測試 AI 內容邊界的完美題目

這部明代經典的文學地位無可爭議,Wikisource 與各大文學網站都完整收錄;同時它對情慾的描寫直白不迴避。一個工具如果宣稱能協助「文學創作」與「經典改編」,那它遲早要回答:碰到金瓶梅,你處理還是不處理?

第一手觀察:同一部經典,各家反應不同

在把這部書做成角色研究影像遊戲的過程裡,我實際用過市面上主要的文字與圖像生成工具。觀察很一致:

  • 主流閉源模型(ChatGPT、Claude 等):處理到稍微露骨的情色文學段落就會被攔截,或自動淡化改寫;圖像生成更保守,人物「露多一點」就會觸發審查或直接拒絕生成。即使素材是四百年前的公版文學,模型的預設立場仍然是迴避。
  • Grok:使用體驗明顯不同,邊界寬鬆許多,願意處理其他模型直接拒絕的內容。這也成為我實際比較各家大語言模型時的一個固定維度。
  • 開源模型:自由度最高。我用 Stable Diffusion 生成過很多好看的情色向影像——同樣的需求,線上閉源工具就是做不出來。差別不在能力,在policy。

要強調的是:這不是「想生成違法內容被擋」的抱怨。金瓶梅是合法的公版文學,成人向創作在多數司法轄區也是合法需求。被擋下的,是合法但讓供應商感到不安的那一塊。

這不是安全問題,是產品決策

從技術顧問的角度看,我對「模型會拒絕什麼」的興趣,跟對「模型能做到什麼」的興趣一樣大。因為前者往往不是寫在規格書上的,要實測才知道。

閉源供應商把自家的價值觀直接寫進產品:他們認為自己是對的,於是使用者的需求被預設立場給限制住。每個國家有自己的法規與道德光譜,這完全可以理解——但現狀是,一家公司的內容政策,實質上變成了全球使用者的創作天花板。對創作者來說,這就是「令人無奈」四個字。

而人們對這類內容的需求是真實存在的。假裝需求不存在,不會讓需求消失,只會讓需求流向別的工具——這正是市場正在發生的事。

開源 vs 閉源:最少被誠實討論的一塊

開源與閉源 AI 之爭,大家常談成本、隱私、可控性。我認為內容自由度是同樣重要、卻最少被誠實討論的維度:

  1. 閉源模型的邊界是別人劃的,而且會隨政策變動——今天能做的事,明天一次更新後可能就不能做了。
  2. 開源模型把邊界還給部署者:自己承擔法律與道德責任,換取完整的創作自由。這才是「每個國家法規與道德不同」的正解——讓在地的部署者依在地的規範自律,而不是由單一供應商替全世界決定。
  3. 混合策略是務實解:我的做法是閉源模型做考證、結構化與長文本理解(它們確實強),內容敏感的生成環節交給邊界較寬或開源的工具。「金瓶梅宇宙」整個專案就是這樣完成的。

給選型者的建議

如果你的產品或創作題材可能觸碰內容邊界——文學、影視、遊戲、醫療、性教育都算——選型時請把「邊界實測」列為正式評估項目:

  • 拿你領域裡合法但敏感的真實素材去測,不要只測 demo 題。
  • 分開測「文字理解」與「內容生成」——同一家模型在兩端的邊界常常不一樣。
  • 把「政策變動風險」寫進評估:閉源模型的邊界不是常數。
  • 認真評估開源自建的選項,特別是當你的需求合法、但明顯落在大廠舒適圈外。

四百年前,《金瓶梅》的作者選擇直視人的欲望,不假裝它不存在。四百年後,我們的工具反而學會了假裝。這個專案想做的事情之一,就是把這個矛盾攤開來給大家看——順便,把這部經典完整地、一字未刪改地放回線上。