隨著企業加快部署 AI 代理,如何驗證這些系統是否安全、可控,正成為采購環節中的現實問題。由 Anthropic 的早期員工 Rune Kvist 與前 AI 安全研究機構 METR 的首席運營官 Rajiv Dattani 共同創立的 AIUC,正試圖將這一流程打造成標準化服務。
宣佈完成4000萬美元的A輪融資
AIUC 的全稱為 Artificial Intelligence Underwriting Company。該公司於週二宣佈完成4000萬美元的A輪融資,由 Ribbit Capital 領投,First Harmonic 參與投資。
在此之前,AIUC已完成1500万美元的種子輪融資,投資方包括Nat Friedman旗下的基金NFDG、Emergence、Terrain,以及Anthropic的聯合創始人Ben Mann等。至此,公司累計融資達到5500万美元。
AIUC 表示,当前客户包括 Cursor、Lovable、Harvey 和 ElevenLabs。
主打 AI 代理第三方審計
這家公司的核心產品,是為 AI 代理建立第三方審計和認證層。其思路接近網絡安全領域常見的合規驗證模式,即先設定統一標準,再通過外部測試判斷系統是否達到要求。
AIUC 参考廣泛使用的网络安全標準 SOC ,推出名為 AIUC-1 的標準,並配備測試服務。公司表示,許多銀行、醫院、政府機構和軍方並非因為模型能力不足而拒絕部署 AI ,而是因为現階段缺乏可驗證的安全保證。
為制定標準,AIUC組織了約250名安全與風險負責人參與討論。這些人本身也是企業采購AI代理時的決策者。公司據此整理出採購方最關心的問題,再將這些要求轉化為測試項目。
約5000項測試涵蓋越獄與洩露
在具體執行上,AIUC會讓AI代理通過約5000項測試,重點觀察其在越獄、幻覺和數據洩露等場景下的表現。測試完成後,系統會生成一份約100頁的報告,列出代理在哪些環節表現穩定,哪些環節仍存在風險。
值得注意的是,AIUC也使用AI代理來執行部分測試,并用AI分析測試數據,但最終審計結果仍由人工核驗。
這一模式與 METR 的部分工作有相似之處。 METR 過去主要以為前沿模型實驗室提供獨立測試為主,重點更偏向於性能評估,即代理能否穩定地完成任務。 OpenAI 在此前調查 Hugging Face 相關事件時,也曾使用 METR 參與獨立研究。
Anthropic 首席執行官 Dario Amodei 最近也呼籲放慢 AI 的開發節奏,並提到可以引入第三方評估機構,對安全表現進行觀察和驗證。 AIUC 的做法並非直接嵌入客戶現場,而是向企業提供一份獨立的外部評估,幫助其在采購 AI 代理前判斷可用範圍與風險點。











