代理不等於模型
模型是把文字變成文字的引擎;代理則是圍繞它蓋起來的一整套東西——檢索、工具、記憶、界線與管道。模型只是代理裡面可以替換的零件。
這是最讓團隊付出代價的一個誤解,而它通常長這樣:「我們已經有 GPT 了,還需要這個幹嘛?」
道理跟分不清「編碼助理」和「它背後呼叫的 API」是一樣的。API 給你的是一個會把文字接下去的模型。助理則是那個會讀你的檔案、跑你的測試、記得你二十分鐘前問過什麼、而且會拒絕對你家目錄執行 rm -rf 的東西。兩者用的是同一個模型,但只有其中一個是你敢端到別人面前的產品。
一個裸模型到底是什麼
一個無狀態的函式。文字進去,文字出來。
你不把前一則訊息貼回去,它就不記得。你不把文件塞進去,它就讀不到。它呼叫不了你的預約系統,沒辦法下週二寄一則提醒,也分不出這位客戶跟那位客戶。它更不知道自己不知道什麼——所以你問它你們的解約費是多少,它會生出一個看起來就是正確答案的數字。
模型做得好的每一件事,都在單次呼叫裡完成,然後忘光。
外圍架構補上了什麼
所謂代理,就是圍著那次呼叫轉的整套機制:
- 檢索 — 在你的文件裡找出跟這個問題有關的段落,再放進那次呼叫
- 工具迴圈 — 讓模型提出要做的動作,實際執行,把結果餵回去,再跑下一圈
- 記憶 — 這位客戶上個月說過什麼,存在他自己的空間裡
- 界線 — 它必須待在裡面的範圍,以及該收手轉交的那個點
- 管道與排程 — 同一個代理同時在網頁、Telegram 和 WhatsApp 上,而且一週後還記得回頭催那份文件
- 隔離與稽核 — 讓 A 客戶的檔案不會冒到 B 客戶的對話裡,也讓你答得出「它當初為什麼那樣講」
以上沒有一項是模型的能力,全部都是外圍架構。
所以會被換掉的是模型
模型每幾個月就進步一次、變便宜一次,或者被發現在某個語言上特別強。底層這個平台同時跑多個推論後端並在它們之間分派工作;代理可以指定偏好的模型,需要看圖的請求就送到看得見圖的地方去。
模型換掉時不會跟著動的是:你的知識庫、你的 Skills、你的行動指南、你的靈魂、你的整合、你客戶累積下來的記憶。那些才是資產。模型只是資產裡的一個零件。
在這個平台上具體長什麼樣
模型是一個可設定的元件,不是綁死的原料。agent4.io 同時跑數個推論後端並在其間分派:一段對話會被指派到其中一個,整個工作階段都待在那裡;帶圖片的訊息則會被導到真的看得見圖的後端。每個代理都能指定偏好的模型;每個後端也會回報自己支援的脈絡視窗大小,不靠猜。
付費方案還可以再進一步,讓平台指向租戶自己的模型供應商。對於已經跟某家廠商簽了約、或者主管機關對「推論在哪裡發生」很有意見的企業來說,這才是「可替換」真正有意義的版本。
而這些都不會動到你的設定。底下的模型換掉,你的知識庫、Skills、工具、行動指南、靈魂,以及每位客戶累積的記憶,全都還在原地。
看廠商說詞的實用方法:問他「把底下的模型換掉之後,還剩下什麼」。答案是「沒有」,那你買的是一個包了層皮的模型;答案是「我們設定過的每一樣東西」,那你買的才是代理。