Red team evolutivo para agentes
Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.
source: RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution
Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.
Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.
source: RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution
Arquitetura rara para deixar agentes evoluírem sem perder auditoria e rastreabilidade.
source: Persona-Execution Separation: An Architecture Pattern for Evolving LLM Agents under Execution Audit
Mostra como o harness pode transformar contexto comum em autoridade efetiva para o agente.
source: When Context Gets Root: Privilege Escalation in LLM Harnesses
Propõe controlar vazamento e autoridade em agentes que carregam estado entre páginas, documentos e ferramentas.
source: SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control
Leilão token a token transforma geração em mídia comprável e cria uma nova superfície de manipulação.
source: Token-Level Advertising
Explora backdoors discretos que sobrevivem justamente por não parecerem eficazes nas métricas usuais.
source: Low-ASR Backdoors: Exploiting Attack Success Rate Reduction and Attacker-Defender Asymmetry
Toca o gargalo real de paralelizar raciocínio em modelos pós-treinados com RLVR.
source: Performance Foundations of Parallel & Distributed Reasoning Language Models
Sinal forte para agentes que acumulam procedimentos reutilizáveis a partir de uso real.
source: WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution
Útil para supply chain de modelos locais, especialmente pesos baixados de fontes abertas.
source: Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners
Testa se políticas escritas por usuários reduzem overreach em agentes que atuam sobre dados e serviços.
source: Do User-Authored Permission Policies Improve Protection Against AI Agent Overreach?
English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.