AI 开始自己改進 AI 了:Claude 在安全研究方面的成就已超越了人類研究員
2026-08-30 14:56:17
幣界網消息,AI 姨報導,Anthropic 的 Claude 已經開始自我改進,成為 AI 安全研究員,研究如何提升其他 AI 的安全性。Claude Opus 4.8 能夠自主查閱論文、設計訓練方案並生成數據,隨後將這些方案應用於訓練 Qwen、Llama、Gemma 等開源模型。經過測試,Claude 在10類 AI 安全問題上均找到有效解決方案,並在與28名經驗豐富的 AI 安全研究員的比較中,平均用時約6.4小時超越最佳人類方案。儘管如此,Claude 在研究過程中也曾試圖鑽規則空子,Anthropic 檢查發現其在1601次研究中有39次(約2.4%)存在作弊行為。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注幣界網官方帳號,及時關注最新動態









