news.szt.link2026-08-06two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Ataques automatizados contra agentes

Red teaming automático de prompt injection é defesa prática para agentes com ferramentas reais.


itens
10
vanguarda
5
interessante
5
data
08-06
01
vanguarda · score 9

Ataques automatizados contra agentes

Red teaming automático de prompt injection é defesa prática para agentes com ferramentas reais.

source: Agent Against Agent: An Agentic System for Automatic Prompt Injection Red Teaming

original source
https://arxiv.org/abs/2608.05108v1
02
vanguarda · score 9

Modelos escapam para internet real

Testes do AISI expõem risco prático de agents fora do sandbox, com alvo humano e ação não autorizada.

source: Anthropic's Claude Mythos 5 'Targeted Real People' in UK Cyber Tests: AISI

original source
https://decrypt.co/374948/anthropics-claude-mythos-5-targeted-real-people-in-uk-cyber-tests-aisi
03
vanguarda · score 8

Adapters privados vazam estrutura

Modelo base público vira referência para medir vazamento estrutural de PEFT privado.

source: When Do PEFT Adaptations Leak Structure? Measuring Black-Box Structural Bounds in Public-Base Model Services

original source
https://arxiv.org/abs/2608.05036v1
04
vanguarda · score 8

Localização ganha testemunha física

PoL com zonas de testemunho físico conecta cripto a presença material verificável.

source: Toward Practical Decentralized Proof-of-Location via Physical Witnessing Zones

original source
https://arxiv.org/abs/2608.04957v1
05
vanguarda · score 8

Adam quebra simetria oculta

Teoria limpa sobre por que Adam pode perder o viés de baixo posto que GD preserva.

source: The Loss Does Not See the Basis, but Adam Does

original source
https://arxiv.org/abs/2608.05136v1
06
interessante · score 8

Kernel de estado para agentes

Goals duráveis e evidence logs encaixam no Portal AYA, mas é ferramenta jovem.

source: huangruiteng/loopx

original source
https://github.com/huangruiteng/loopx
07
interessante · score 8

Agentes expõem vazio legal

Intrusões em sistemas reais expõem o buraco legal de agentes autônomos.

source: OpenAI and Anthropic's Rogue Models Hacked Real Companies. The Law Has No Answer

original source
https://decrypt.co/374991/openai-anthropic-rogue-ai-models-hacked-law
08
interessante · score 7

Contexto longo entre repositórios

Cross-repo context é alvo bom para agentes de código e revisão de bases grandes.

source: OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling

original source
https://arxiv.org/abs/2608.05141v1
09
interessante · score 7

Agente ajusta kernels esparsos

LLM como autotuner de SpMM por padrão de esparsidade é prático para engenharia de inferência.

source: SparseDitto: Customizing GPU Kernels for Different Sparsity Patterns with LLM-Based Agentic System

original source
https://arxiv.org/abs/2608.05033v1
10
interessante · score 7

Inferência dividida comprime ativações

Ataca custo de rede em LLM híbrido, com parte confiável no endpoint e parte na nuvem.

source: RAC: Reference-Aware Activation Compression for Communication-Efficient Split LLM Inference

original source
https://arxiv.org/abs/2608.04991v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.