深色模式
EP2 大食堂全貌:你到底在跟誰說話?
你打開 ChatGPT 打了一句話,幾秒後螢幕上就跑出回覆——感覺像是你在跟 AI 一對一聊天。但其實從你按下送出到回覆出現,中間經過了好幾道步驟。搞清楚這些步驟各自在幹嘛,你才會明白為什麼同一個模型換個地方用,表現就像換了一個人。
影片即將上線
本段影片將在 6/20 直播結束後上架。以下是文字重點摘要,可以配合影片一起看。
先認識整間食堂的角色
在理解任何技術細節之前,先把整個系統的角色認清楚。我們用一間大食堂來比喻,整堂課都會反覆回來引用這張對照圖。

關鍵:服務生只負責整理點單,不參與做菜。
這一點很重要。你在任何一個 AI RP 平台上打的每一句話,都不是直接傳給模型的。平台的系統會先整理、加工、甚至刪減你的點單,然後才透過 API 送進廚房。你看到的那個平台介面是服務生,不是大廚。
這張對照圖是整堂課的核心,後面幾乎每一集都會回來引用他。先把這四個角色記熟,後面的觀念才接得上。
沒有「原生 Gemini」這回事
圈子裡常聽到有人說「我用的是原生 GPT」「原生 Gemini 比較笨」,但事實上沒有所謂的「原生」模型。
即使你什麼都沒設定,直接打開 ChatGPT 或 Gemini 的官網開始聊天,平台本身就已經在背後塞了一整套系統提詞 — 告訴模型今天的日期、他應該用什麼語氣說話、哪些話題要拒絕、回覆格式該怎麼排。你看不到這些指令,但他們從第一則訊息開始就在桶子裡了。
所以「原生 ChatGPT」和「GPTs」的差別,不是「沒有系統提詞」對上「有系統提詞」,而是「只有平台預設的系統提詞」對上「預設的+你或別人額外加上去的自訂指令」。差的只是讀取了哪些指令,不是有沒有包裝。
把這個觀念拉遠一點來看:GPTs、Gem、各種 RP 平台、SillyTavern — 他們都是不同的「服務生」,背後用的可能是同一位「大廚」。同一個模型在不同地方表現不同,差別全在於服務生怎麼整理你的點單再送進廚房。

精確的說法:所謂「某個平台的 AI 比較好聊」,其實是「某個平台整理點單的方式,讓這個模型在這種任務上表現比較好」——好聊的是服務生的手藝,不是大廚換了人。
換了同一個模型到酒館,你可以自己決定服務生怎麼整理點單,感覺就完全不同了。這也是後面幾集會反覆回到的主題:拿回對「點單怎麼送進廚房」的控制權。
食材丁:Token
大廚看不懂完整的詞句,必須先把文字切成小塊才能處理。這些小塊叫做 Token(食材丁)。

Token 是 LLM 世界的基本單位——輸入用他算、輸出用他算、費用也用他算。
Token 切法的特點:
- 英文 1 個單詞大約 ≈ 1 個 token,但複雜單字可能被切成好幾塊(例如 "playing" 可能切成 "play" + "ing")
- 中文 1 個字大約 ≈ 1 到 2 個 token
- 空白、標點符號也都算 Token
注意:因為中文一個字常常要吃掉 1 到 2 個 token,所以同樣的內容,中文通常會比英文消耗更多 token。寫角色卡、世界書時這點會直接反映在成本和容量上。
為什麼你需要了解 Token?
因為 Token 同時決定了兩件事:
1費用:付費 API 按 Token 計算,不是按字數。「輸入了多少 Token + 模型輸出了多少 Token」決定這次對話花了多少錢。
2容量:廚房的流理台(上下文視窗)有 Token 上限,塞不下就要開始捨棄舊資料(這是 EP3 的主題)。
官網、平台常常看不見這些數字,但他們一直都在運作。自架酒館+自用 API 之後,你會第一次親眼看到這些數字,那時候很多事情就豁然開朗了。
為什麼同一個模型在不同地方感覺不同?
現在你有了這張對照圖,可以解釋這件大家常困惑的事。同樣是「Gemini」「GPT」,為什麼換個平台手感差這麼多?拆開來看有三層原因:
1服務生(前端)不同:每個平台的系統提詞不同、對點單的加工方式不同。你在平台上打的話,服務生可能會偷偷加上或刪掉一些東西再傳進廚房。
2分配給你的算力不同:免費平台常在尖峰時段把你排到學徒那邊(較小的模型),或是限縮輸出長度、壓縮上下文。
3模型版本不同:例如「GPT-4o」不是一個固定的模型,有舊版新版,同名模型改版後行為可以差很多。
用酒館直接走 API,你看到的就是最接近「模型本體」的狀態:服務生是你自己調教的,你清楚他對點單做了什麼。
常見問題
Q:在不同平台都選同樣的模型(例如 Gemini 2.5 Pro),表現會一樣嗎?
不會。模型雖然同一個,但每個平台都會在背後套上自己的系統提詞和參數設定——這些你看不到的指令會影響語氣、限制、回覆風格,所以同一個模型在不同平台上聊起來可以像完全不同的人。這就是「沒有原生這回事」的意思:差異不在模型本身,而在他被餵了什麼指令。
Q:API 跟一般網站有什麼差別?
你可以把一般網站(ChatGPT 官網、Gemini 官網)想成「去餐廳吃飯」——菜單固定、裝潢固定、店家規矩你得照著走。API 則是「直接找大廚叫外燴」——同一位大廚,但菜單你自己開、調味你自己調、那道平台外掛的安全過濾器也不在這裡。自由度大很多,但食材費用要自己付、食安要自己顧。
📌 本集重點
- 你聊天的對象 = 模型 + 系統提詞(官方設定的跟你自己設定的):系統提詞+設定+裁切上下文,沒有「原生」這回事,你永遠不是直接跟大廚說話。
- 服務生(前端)決定什麼被送進廚房:同一位大廚換間餐廳口味就變,差別全在服務生怎麼整理你的點單。
- 文字會被轉化成 Token:這是容量與計價的基本單位,而且中文通常比英文更耗 token。
下一步
EP3 記憶之桶:上下文是什麼?為什麼 AI 會「失憶」?這是 AI RP 體驗最關鍵的一課。
