跳到正文
Agent.SpaceAgent 入門打開 Agent.Space
Agent 入門第 2 章02 / 08

模型和 Agent Harness:一次任務裡,誰負責什麼

約 5 分鐘閱讀

讀完這一章,你會看到模型、Harness 和工具時,知道各自負責哪一部分。

你準備讓 Agent 做邀請頁,介面卻先要你選 Agent,又要你選模型。剛剛還只是想約個散步,怎麼突然像在光華商場挑零件組電腦?

先別急。這兩個選擇,一個關係到「用什麼能力理解任務」,一個關係到「怎樣把任務執行下去」。我們把一張邀請頁的製作過程拆開來看,就好懂了。

模型負責理解和產生

模型 處理交給它的資訊,產生下一步的內容或行動建議。

你說「活動適合平常不運動的人」,模型可以據此調整文案,避免把邀請寫成戰帖。你說「時間要醒目」,模型也能產生對應的頁面程式碼。

GPT 和 Claude 的具體型號是模型名稱。不同模型的能力、速度和使用成本可能不一樣,適用的輸入也可能不同。

不過,模型提出「修改這個檔案」,還需要有軟體把這件事真正執行。檔案在哪裡、目前能用什麼工具、哪些動作要先問你,都得有人來組織。

Harness 把一次任務組織起來

Agent Harness 可以想成包在模型外面的一套執行軟體。這個英文詞比較冷門,先記住它做的事就夠了。

它把你的要求和相關檔案交給模型,把可用的工具說明清楚,處理工具執行和權限,再把結果送回來,讓任務繼續。對話變長時,怎麼整理上下文,也可能是它的工作。

想像你說:「把集合時間從三點改成四點。」模型得先看到相關內容,修改動作要落在正確的檔案上,改完的結果也得回傳過來。Harness 就是在組織這段過程。

因此,同一個模型,放在不同的 Harness 和環境裡,用起來的感覺也可能不同。看得到的資料、工具和執行方式變了,結果就可能跟著變;但這不代表任何 Harness 都能把所有模型變得一樣強。

工具是實際動手的那一環

工具 可以讀取檔案、寫入修改,或執行一項檢查。模型提出動作,Harness 依照相應的規則執行工具,工具再回傳結果。

拿邀請頁來說:讀取工具看到舊時間,編輯工具寫入新時間,檢查工具確認內容符不符合要求。這些動作得發生在某個有檔案、能執行程式的地方,也就是我們後面會講的 Workspace。

這樣拆開是為了方便理解;不同產品會把這些部分打包進不同的入口。你不需要自己把每一層組裝一遍,才能使用 Agent。

藍色的模型位在執行框架裡,框架連接讀取、編輯和檢查工具,一起放在工作空間中。
中間的模型負責理解,外層的 Harness 組織過程,周圍的工具完成動作。

把這幾個座位記住就好

名稱負責什麼在邀請頁裡做的事
模型理解資訊,產生內容與下一步建議理解「時間再醒目一點」,產生修改方案
Harness組織上下文、工具、權限和執行過程讓讀取、修改與檢查接連發生
工具完成具體操作讀取或修改網頁檔案
Workspace保存專案,提供工作環境放邀請頁,承載相關的對話和操作

Agent 則是這些能力圍繞著目標運轉起來時,你正在合作的那個執行者。它不是一個和模型完全無關的「更大的模型」。

選的時候,先解決眼前這件事

第一次做網頁,先選一個目前可用的 Agent,再從介面提供的相容模型中挑一個。不是每個 Harness 都支援所有模型,額度也要另外確認夠用。

如果結果不理想,先看具體問題:它沒讀到活動資料,補資料可能比換模型更有效;它拿不到需要的工具,就要檢查環境;它誤會了你的要求,可以先說得更具體一點。

關於 Harness 的技術細節,OpenAI 的官方說明介紹了工具執行、設定和持續對話是怎麼組織的。第一次讀到這裡,能分清上面四個座位就很夠用了。