news.szt.link2026-08-28two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Red team evolutivo para agentes

Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.


itens
10
vanguarda
5
interessante
5
data
08-28
01
vanguarda · score 9

Red team evolutivo para agentes

Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.

source: RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution

original source
https://arxiv.org/abs/2608.27439v1
02
vanguarda · score 9

Persona separada da execução

Arquitetura rara para deixar agentes evoluírem sem perder auditoria e rastreabilidade.

source: Persona-Execution Separation: An Architecture Pattern for Evolving LLM Agents under Execution Audit

original source
https://arxiv.org/abs/2608.27427v1
03
vanguarda · score 9

Contexto vira privilégio root

Mostra como o harness pode transformar contexto comum em autoridade efetiva para o agente.

source: When Context Gets Root: Privilege Escalation in LLM Harnesses

original source
https://arxiv.org/abs/2608.27299v1
04
vanguarda · score 9

Fluxo seguro para agentes persistentes

Propõe controlar vazamento e autoridade em agentes que carregam estado entre páginas, documentos e ferramentas.

source: SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control

original source
https://arxiv.org/abs/2608.27234v1
05
vanguarda · score 8

Publicidade entra no token

Leilão token a token transforma geração em mídia comprável e cria uma nova superfície de manipulação.

source: Token-Level Advertising

original source
https://arxiv.org/abs/2608.27382v1
06
interessante · score 8

Backdoors escapam por baixo sinal

Explora backdoors discretos que sobrevivem justamente por não parecerem eficazes nas métricas usuais.

source: Low-ASR Backdoors: Exploiting Attack Success Rate Reduction and Attacker-Defender Asymmetry

original source
https://arxiv.org/abs/2608.27288v1
07
interessante · score 8

Reasoning models entram em escala

Toca o gargalo real de paralelizar raciocínio em modelos pós-treinados com RLVR.

source: Performance Foundations of Parallel & Distributed Reasoning Language Models

original source
https://arxiv.org/abs/2608.27046v1
08
interessante · score 7

Skills persistentes para agentes

Sinal forte para agentes que acumulam procedimentos reutilizáveis a partir de uso real.

source: WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution

original source
https://arxiv.org/abs/2608.27454v1
09
interessante · score 7

Scanners de modelo sob teste

Útil para supply chain de modelos locais, especialmente pesos baixados de fontes abertas.

source: Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners

original source
https://arxiv.org/abs/2608.27424v1
10
interessante · score 7

Políticas legíveis para agentes

Testa se políticas escritas por usuários reduzem overreach em agentes que atuam sobre dados e serviços.

source: Do User-Authored Permission Policies Improve Protection Against AI Agent Overreach?

original source
https://arxiv.org/abs/2608.27443v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.