排序: 最新 热门 引用
cs.AI 2605.09163

FORTIS: Benchmarking Over-Privilege in Agent Skills

FORTIS基准评估大模型在技能选择和执行中的过度权限行为,发现模型普遍超越最小必要权限,失败率高达62.5%。

Shawn Li, Chenxiao Yu, Han Wang 等

2026-05-10 7 引用 75