把非確定性模型,變成可驗證、可上線的工作流的 engineering harness。
建立在開放標準之上(MCP、Agent Skills)。由確定性的計算檢查治理,而不只是靠提示。
Aivio Labs
我們是一間 AI agent 工程工作室。我們做的是那些讓模型產出可驗證到足以上線的 harness、skill 與管線。
我們以英文在全球運作。我們的一部分工作涉及通用模型不具備的領域知識 —— 那些知識從未以機器可用的形式進入訓練資料。
四波浪潮,以及我們從每一波做出了什麼
這個領域是一波一波前進的。每一波都以一篇研究成果或一份規格登場,也都花了一兩年才變成一門生意可以倚賴的東西。我們四波都走過。
Agent loops 與編排
把推理與行動交錯起來,再讓多個 agent 透過對話互相協調
跨 session、跨機器派工的編排 harness,其中一套會把一個需求依序帶過規劃、分派與驗收
Memory
用分層方式管理 context,讓 agent 的狀態能撐過單一次對話
一層蓋在我們自己語料上的檢索 —— 關鍵字、向量與假想文件三種搜尋打同一個索引 —— 因為通用檢索答不了我們實際在問的問題
Skills
一種可攜的資料夾格式,用來給 agent 程序性知識,後來開放為跨廠商標準
我們自建的 skill library 而非安裝別人的,從單一目錄跨三個 agent runtime 執行,以及蓋在其上的一條文件轉交付物管線
Harnesses
為模型周圍的東西命名 —— 引導它的 guides 與接住它的 sensors
我們在跑的每一個 harness 與 skill 的目錄,記錄出處與各自能帶的證據,以及把這個模式產品化的版本
每一波都留下一項 capability,而每一項 capability 都成為我們的一個 offering。Skills 那一波的成果成為 Role Packs。編排與 harness 的成果成為 Engineering Harnesses。而「把模型約束在一份權威來源上」—— memory 那一波打開、harness 那一波收攏的問題 —— 正是 Personal Tutor 存在要證明的事。
用證據,不用描述
每個公開的 harness 最多帶四樣東西:它產出的成品、你能不能自己跑、它怎麼被做出來的過程、以及對產出執行的檢查。缺哪一項就標示缺,不用文字補。
我們多數的工作在客戶保密之下進行,永遠不會公開。我們能出示的是架構:一條管線的邊界怎麼劃、它動作前驗證什麼、它預設拒絕做什麼。工程本身看得懂,不需要把內容攤開。
這是我們對自己的要求 —— 輸入、步驟、檢查、日期。
聯絡我們
產品在這裡陳列,但不在這裡販售 —— 目前一律從一次對話開始。
如果你在評估我們做不做得出某個具體的東西,把問題寄過來,不必先約時間。我們會告訴你這是不是我們做得了的事;如果不是,我們會告訴你我們認為誰做得了。
每一封來信都會有一個讀過它的人回覆。