文章上線

為何 AI 生成的餐廳菜單看起來令人不安地相似且過度精緻

為何 AI 生成的餐廳菜單看起來令人不安地相似且過度精緻

目錄

你可能想知道

為何 AI 生成的菜單插圖常常看起來幾乎正確但又 Somehow 錯誤?

模型訓練作法與反覆編輯如何使食物影像變得過於平滑且趨於一致?

主要議題

當你第一次注意到這點時,通常會有一種輕微的不適應感。你打開一家咖啡館的菜單,看到一排貝果三明治或幾碗冰淇淋,被渲染得近乎完美:每個元素都精確對稱、表面異常光滑,比例又微微不對。你懷疑自己是不是太挑剔,但這種感覺仍然存在。這種感受不僅僅是主觀偏執——它反映了許多生成式 AI 系統的訓練方式以及它們如何複製一種狹窄的美學理想。

現代影像與語言生成系統——包括擴散模型和大型語言模型 (LLM)——透過攝取大量視覺與文字資料並萃取統計模式來學習。當被提示「為一間漢堡店製作菜單」時,這類模型並非從原理發明;它是根據訓練範例中看到的模式去預測一個適當的輸出。如果那些範例以某種商業或「悅目」的風格為主,模型就會回應並模仿那種風格。實務上,這會產生類似連鎖餐廳廣告的視覺:一致的燈光、整潔的構圖與超誘人的擺盤。

造成雷同與不安感的原因有幾項相互作用。首先,訓練語料本身會偏向輸出。如果大量可用的訓練影像反映特定時代、風格或商業攝影標準,模型的輸出會朝該風格收斂。正如一位從業者指出的,有些輸出看起來像某個連鎖或某年份的菜單——因為那些內容在資料集中佔了相當大的一部分。

第二,模型訓練時使用的優化目標常常偏好「悅目性」並避免冒犯或驚悚內容。這些目標鼓勵模型平滑掉異常與邊緣情況,產生經過消毒、討眾喜歡的結果。 這種平滑會移除讓真實食物看起來有質感與誘人的視覺不規則性與紋理複雜度——從而造成一種微妙但強烈的不對勁感。 真正的烘焙品會有小缺陷、融化的起司有隨機的拉絲,或蔬菜有不規則的形狀與斑點,而 AI 的輸出則常呈現理想化、均一的形狀,我們的感知便會把這些標記為不自然。

第三,反覆編輯會放大此效應。設計師與操作人員常對 AI 生成的菜單做小修——更新價格、替換品名或做些版面微調——然後再次生成或套用連續的編輯。每次編輯都可能將影像推向模型的平均預測,逐步抹除辨識性的細節。反覆編輯生成菜單的研究者與愛好者觀察到,影像在每次迭代後變得越來越圓潤、越來越光滑,也越來越不真實。累積效果會令人不適:一張乍看幾乎像真的影像,最終掉入「可怖谷」,在近似真實時反而引發比明顯風格化更強的厭惡感。

還有一個與資料衛生有關的重要現象,稱為模型崩潰。當生成模型的輸出大量被回填到訓練資料中,模型可能開始從自家的輸出而非多樣的人類創作範例中學習。雖然完全崩潰——有用變異性的徹底退化——是極端且較為少見的,但一種較溫和的形式稱為收斂會發生。收斂會降低多樣性並將輸出推向更狹窄的特徵集合,強化雷同問題而非解決它。

對這些影像的情緒反應並非純粹文化性的;實驗證據支持一種心理機制。研究顯示,近乎真實的食物影像會誘發「可怖谷」反應:當影像接近真實但未能捕捉關鍵微妙之處時,觀者會感到不適甚至厭惡。這種效應又被文化脈絡放大:AI 被廣泛討論為既有希望又有問題,使觀眾更可能檢視媒體以尋找操控跡象,並在發現時給予負面反應。

超越菜單範疇,影響更為深遠。視覺與聲音證據在法律、新聞與社會語境中歷來具有特殊權威。隨著生成模型改進且其產物大量出現,這種信任被動搖。偽造或細微改動的影像可以影響決策與認知,而 AI 優化後的同質化美學的普及也改變了人們對影像應有樣貌的期待。這些變化提出了關於真實性、來源以及採用 AI 工具為公開內容服務的企業應承擔的責任等問題。

有些實務回應可供採取。謹慎策劃訓練資料、避免將模型輸出過度回收進未來訓練、以及採用重視多樣性與紋理而非僅僅技術上「悅目性」的評估指標都能減輕同質化現象。人類監督——不只為了事實正確性,也為了美學忠實度——可以幫助保留那些顯示真實性的微小不規則。對餐廳與設計師而言,這可能意味著將實際菜品的攝影與 AI 協助的版面工作結合,而不是完全依賴合成影像。

總之,你面對許多 AI 生成菜單時感到的不安,源自當前模型的訓練與反覆使用方式:對偏向精緻商業影像的資料集所做的統計式模式匹配,移除紋理與不規則性的平滑化目標,以及會放大模型偏好美學的重複編輯。結果是一種被同質化的視覺語言,乍看悅目但常引發本能上的不對勁感。

關鍵見解表

面向 說明
訓練資料偏差 模型從大型資料集中學習主導模式;若以商業化、精緻的影像為主,輸出將反映該美學。
偏向悅目性的優化 優先非冒犯性、吸引人的結果的目標常會平滑紋理並移除不規則性,導致同質化。
反覆編輯效應 反覆的編輯與再生成會將影像推向模型的平均輸出,逐步降低真實感與獨特性。
模型收斂/崩潰 將模型輸出回填到訓練中會降低變異並強化跨世代的風格收斂。
心理反應 近乎真實但不完美的影像常常觸發「可怖谷」反應,造成觀者不適或厭惡。
更廣泛的影響 同質化的 AI 影像影響對視覺證據的信任,並改變廣告與媒體中對真實性的期待。

後續……

展望未來,有幾條技術與程序路徑值得關注。首先,更好的資料管理至關重要:保護訓練集的多樣性與來源,並防止過度回收 AI 生成的輸出,將有助於維持模型行為的多樣性。其次,針對能獎勵紋理、不對稱與自然缺陷——而不僅僅是廣泛吸引力——的目標函數的研究,可能產生更具真實感的影像。最後,來源追蹤、浮水印與內容驗證工具可以幫助觀眾與平台辨識合成素材並維護視覺媒體的信任。

這些方向不僅是技術性的。它們需要技術人員、設計師、心理學家與法律專家的跨領域合作,以在創新與文化及倫理考量之間取得平衡。對保留真實性的微妙強調——例如有意保存食物攝影中的某些不規則性——可能與演算法上的修正同樣重要。當我們將生成工具整合進日常工作流程時,應優先採取尊重人類感知並維持公共生活中影像可信度的方法。 探索來源系統、資料集多樣性方法與知覺度量是有前景的下一步。

最後編輯時間:2026/9/4

數字匠人

閒散過客