技能安全 LLM-DailyDigest 2026-08-16 2026-08-16 约 100 字 预计阅读 1 分钟 技能安全 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 分层防护 1 ClawSentry:自主 LLM 智能体的渐进式多层安全监控 08-24 恶意技能 1 MaliciousSkillBench:恶意智能体技能检测综合基准 08-21 技能安全 1 Practice Makes Unsafe:自改进 LLM 智能体的技能误演化 08-16 技能演化 1 JailbreakSkill:以可复用、持续进化技能扩展自动红队测试 08-18 技能生成 1 TRUSS:兼顾任务可靠与用户安全的智能体技能生成框架 08-19 状态注入 1 状态成为攻击面:具身智能体的状态语义注入 08-18 自我投毒 1 EVOMAL:自进化编程智能体的自投毒攻击 08-27 航空评测 1 AeroCopilotBench:交互式虚拟驾驶舱中的航空副驾驶智能体评测 08-18 评测复现 1 J-Space Skill 提升 DeepSeek V4 Pro 的评测争议 08-20