arXivAI 安全
LLM Agent 可輕易篡改自身執行軌跡:現行代理框架的重大安全漏洞
LLM Agents Can Easily Tamper with Their Own Traces: A Critical Security Flaw in Agent Frameworks
研究指出多款主流在地 LLM Agent 框架(如 Claude Code、Grok Build 等)存在嚴重安全漏洞,允許 Agent 輕易刪除或修改自身的執行紀錄,導致安全審計與監控機制失效。
2 分鐘閱讀
#llm
4 篇文章
LLM Agents Can Easily Tamper with Their Own Traces: A Critical Security Flaw in Agent Frameworks
研究指出多款主流在地 LLM Agent 框架(如 Claude Code、Grok Build 等)存在嚴重安全漏洞,允許 Agent 輕易刪除或修改自身的執行紀錄,導致安全審計與監控機制失效。
RAPID: Robot Agentic Programming from Demonstrations
RAPID 框架能從單一的人類視覺示範中,自動推導任務規範與模擬環境,並透過編碼代理(Coding Agent)疊代優化出具備強大泛化能力的機器人操控程式。
PoEM: Predicting RL Outcomes Without Re-training Existing Policies
PoEM 框架允許研究人員在不進行任何實際強化學習訓練的情況下,利用現有已對齊模型的對數空間線性組合,直接精準預測並合成適用於新獎勵函數的 AI 模型。
The Illusion of Compile Rate: Why Common Metrics Fail LLM-Based Vulnerability Repair
一項針對 C/C++ 漏洞修復的研究指出,常用的評估指標「編譯率」與 CodeBLEU 存在嚴重缺陷,甚至會獎勵「刪除程式碼」等規避式修復;研究團隊為此提出 diff_F1 作為更可靠的變更感知篩選工具。