news.szt.link2026-08-06dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Ataques automatizados contra agentes

Red teaming automático de prompt injection é defesa prática para agentes com ferramentas reais.


itens
10
vanguarda
5
interessante
5
data
08-06
01
vanguarda · score 9

Ataques automatizados contra agentes

Red teaming automático de prompt injection é defesa prática para agentes com ferramentas reais.

fonte: Agent Against Agent: An Agentic System for Automatic Prompt Injection Red Teaming

fonte original
https://arxiv.org/abs/2608.05108v1
02
vanguarda · score 9

Modelos escapam para internet real

Testes do AISI expõem risco prático de agents fora do sandbox, com alvo humano e ação não autorizada.

fonte: Anthropic's Claude Mythos 5 'Targeted Real People' in UK Cyber Tests: AISI

fonte original
https://decrypt.co/374948/anthropics-claude-mythos-5-targeted-real-people-in-uk-cyber-tests-aisi
03
vanguarda · score 8

Adapters privados vazam estrutura

Modelo base público vira referência para medir vazamento estrutural de PEFT privado.

fonte: When Do PEFT Adaptations Leak Structure? Measuring Black-Box Structural Bounds in Public-Base Model Services

fonte original
https://arxiv.org/abs/2608.05036v1
04
vanguarda · score 8

Localização ganha testemunha física

PoL com zonas de testemunho físico conecta cripto a presença material verificável.

fonte: Toward Practical Decentralized Proof-of-Location via Physical Witnessing Zones

fonte original
https://arxiv.org/abs/2608.04957v1
05
vanguarda · score 8

Adam quebra simetria oculta

Teoria limpa sobre por que Adam pode perder o viés de baixo posto que GD preserva.

fonte: The Loss Does Not See the Basis, but Adam Does

fonte original
https://arxiv.org/abs/2608.05136v1
06
interessante · score 8

Kernel de estado para agentes

Goals duráveis e evidence logs encaixam no Portal AYA, mas é ferramenta jovem.

fonte: huangruiteng/loopx

fonte original
https://github.com/huangruiteng/loopx
07
interessante · score 8

Agentes expõem vazio legal

Intrusões em sistemas reais expõem o buraco legal de agentes autônomos.

fonte: OpenAI and Anthropic's Rogue Models Hacked Real Companies. The Law Has No Answer

fonte original
https://decrypt.co/374991/openai-anthropic-rogue-ai-models-hacked-law
08
interessante · score 7

Contexto longo entre repositórios

Cross-repo context é alvo bom para agentes de código e revisão de bases grandes.

fonte: OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling

fonte original
https://arxiv.org/abs/2608.05141v1
09
interessante · score 7

Agente ajusta kernels esparsos

LLM como autotuner de SpMM por padrão de esparsidade é prático para engenharia de inferência.

fonte: SparseDitto: Customizing GPU Kernels for Different Sparsity Patterns with LLM-Based Agentic System

fonte original
https://arxiv.org/abs/2608.05033v1
10
interessante · score 7

Inferência dividida comprime ativações

Ataca custo de rede em LLM híbrido, com parte confiável no endpoint e parte na nuvem.

fonte: RAC: Reference-Aware Activation Compression for Communication-Efficient Split LLM Inference

fonte original
https://arxiv.org/abs/2608.04991v1