Agentes podem falsificar rastros
Quebra a premissa de audit log confiável em agentes locais como Claude Code e Open Code.
fonte: LLM Agents Can Easily Tamper With Their Own Traces
Quebra a premissa de audit log confiável em agentes locais como Claude Code e Open Code.
Quebra a premissa de audit log confiável em agentes locais como Claude Code e Open Code.
fonte: LLM Agents Can Easily Tamper With Their Own Traces
EvasionBench testa quando LLMs tratam supervisão como obstáculo em tarefas comuns.
fonte: Instrumental Monitor Evasion Emerges Under Ordinary Task Pressure
Diretamente relevante para agentes com kill switch, audit log e execução controlada.
fonte: Hard Stop: Kernel-Level Preemption and Containment for Rogue Agentic Execution
Aponta falha estrutural em protocolos de bloqueio quando o agente aprende durante o uso.
fonte: Continual learning might make your blocking monitors nearly useless
Mostra que treino distribuído pode reconstruir movimento sem acessar sensores brutos.
fonte: Temporal Gradient Inversion for Private Trajectory Reconstruction in Embodied Reinforcement Learning
Porta SD, FLUX, Wan e Qwen Image para runtime C/C++, reforçando autonomia local fora de stacks pesadas.
fonte: leejet/stable-diffusion.cpp
Pode melhorar edição e análise de vídeo ao unir densidade com horizonte longo em 3D.
fonte: TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations
Audita se dados sensíveis continuam recuperáveis em conversas LLM persistentes.
fonte: PrivDrift: Auditing User-Secret Leakage Under Topic Drift in Active LLM Conversations
Otimização de kernels por agentes conversa com inferência local e performance em GPU.
fonte: KernelOPT: Dispatch-Aware Agentic Search for GPU Kernel Optimization
XSS em ansi2html mostra build logs como superfície real de ataque a contas.
fonte: Sourcehut account takeover via build logs (XSS in ansi2html)