News
Loading market feed...
News 快訊

AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

6 月 28 日,上海人工智能實驗室發布 AgentDoG 1.

DeltaMedia 編輯部 2 min 2026年6月28日
AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

6 月 28 日,上海人工智能實驗室發布 AgentDoG 1.5,這套框架只用 1000 個樣本就能對齊 0.8B 到 8B 參數的小模型,小模型不需額外訓練就能即時攔截 AI agent 的高風險行為。論文、模型與訓練資料同步全面開源,含 Hugging Face 模型庫與程式碼專案。這套方案理論上讓安全層作為獨立元件貼著 agent 跑,不必每次拉大模型推論,差異直接反映在部署成本與延遲上。

AgentDoG 1.5 靠一個資料引擎驅動:系統自動過濾並標注高風險行為樣本,再用這批資料對齊小模型,讓它辨識 agent 在複雜任務鏈中可能踩到的安全邊界。根據團隊官方說法,AgentDoG 1.5 在複雜 agent 安全測試上的表現超越 GPT-5.4;相較於靠大模型做安全監督的方案,Docker 容器部署成本降低幅度達 100 倍,規模較小的工程團隊也能把安全護欄部署進自有基礎架構。上述兩項數字均為團隊自行報告,目前尚無獨立第三方復現,工程上,這個缺口值得留意。

這個缺口換個角度問才更有意義:AgentDoG 1.5 想解決的問題到底有多普遍?當工程師把 AI agent 推上生產環境,「沒有人持續盯著的情況下能不能信任這個 agent」幾乎是所有人的第一道問題。AgentDoG 1.5 如果數字站得住,看起來給出了一條路:一個夠小、能貼著 agent 跑、成本低到能長期部署的安全層。已在跑多 agent 工作流、又沒辦法為每個 API 呼叫掛大模型監督的工程團隊,這個方向有直接參考價值;數字可不可靠,得等獨立評測跟上才能確認。

標籤

#agentdog 1.5 #上海人工智能實驗室 #ai agent 安全 #agent guardrail #開源安全模型

繼續閱讀