Rohan Paul

@rohanpaul_ai

恶意代理技能在安装时看起来很安全,但只有在实际任务中才会变得危险,因此本文认为代理需要运行时安全检查,而不仅仅是安装前扫描。 问题在于时机:糟糕的技能可能会等到代理能够访问有用的文件、工具、凭证或外部服务之后,才会将其超出用户实际要求的范围。 该论文提出了 SkillSonar,这是一种安全技能,可以在代理工作时检查敏感操作,并决定是否允许、缩小范围、重新计划或首先询问用户。 在 GLM-5 上,它将熟悉的攻击类型的攻击成功率从 48.2% 降低到 10.4%,将未见过的风险系列的攻击成功率从 60.6% 降低到 11.5%。 一个重要的结果是:仅仅安装安全技能的效果要弱得多。 必须明确告知代理人在采取行动之前先咨询该机构。 总体而言,该论文表示,在安装之前扫描技能,在执行过程中检查其操作,并仍然保留权限和沙箱等硬保护。 – arxiv。组织/abs/2609.01487 标题:“防御即技能:为技能增强型特工不断发展的运行时防护技能”
打开原帖#511482
  1. 产业

    Alexandr Wang:对于后面的开发人员: muse Spark 1.3 现已在 @google…
  2. 产业

    Runway:Seedance 2.5 的 Runway 新增功能和草稿模式
  3. 产业

    Perplexity:在 Perplexity Search API 中引入快速搜索