news.szt.link2026-09-29two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Auditoria imutável para agentes de código

Captura intenção, raciocínio e ação em sessões de agentes; encaixe direto em guardrails reais.


itens
10
vanguarda
5
interessante
5
data
09-29
01
vanguarda · score 9

Auditoria imutável para agentes de código

Captura intenção, raciocínio e ação em sessões de agentes; encaixe direto em guardrails reais.

source: Tracekit: Tamper-Evident Intent-Reasoning-Action Auditing for Autonomous Coding Agents

original source
https://arxiv.org/abs/2609.35659v1
02
vanguarda · score 9

Vírus atravessa memórias de agentes

Modela artefatos compartilhados como canal de contaminação entre LLMs stateful com ferramentas.

source: Share-Borne AI Virus: Memory-Hopping Attacks Across LLM Agents

original source
https://arxiv.org/abs/2609.35576v1
03
vanguarda · score 9

Harness aprendível para agentes

Adapta o programa que orquestra chamadas e ferramentas, não só pesos ou prompts.

source: Harness Learning Enables Generalizable Test-Time Adaptation

original source
https://arxiv.org/abs/2609.35738v1
04
vanguarda · score 9

HSM enganado sem chave

Ataque desloca o risco de roubo de chave para impersonação e autenticação.

source: A Clever RSA Attack Fooled a Hardware Vault—Here's What It Means for Crypto

original source
https://decrypt.co/379505/rsa-attack-without-stealing-key-what-it-means-crypto
05
vanguarda · score 9

Hardware segura agentes soltos

OpenShell e Sentry apontam contenção física para agentes, tema central de automação segura.

source: Nvidia Built a Kill Switch for AI Agents Because They Keep Getting Out

original source
https://decrypt.co/379468/nvidia-kill-switch-ai-agents
06
interessante · score 8

Prever gasto de tokens em agentes

Previsão de custo ajuda agentes com budget cap e shadow mode sem vender autonomia mágica.

source: TokenCast: Forecasting Token Consumption During LLM Agent Execution

original source
https://arxiv.org/abs/2609.35760v1
07
interessante · score 8

Contexto longo com KV streams

Ataca memória de agentes longos no nível KV, relevante para runtime local e RL agentic.

source: KV-streams for Efficient Compaction in Agentic Reinforcement Learning

original source
https://arxiv.org/abs/2609.35750v1
08
interessante · score 8

RL quebra defesas de destilação

Sinal forte em segurança de modelos porque proteção contra cópia pode falhar depois de RL.

source: Distillation Defenses Easily Break After Reinforcement Learning

original source
https://arxiv.org/abs/2609.35699v1
09
interessante · score 8

Prefill eficiente com cache reutilizado

Otimiza prefill LLM com prefix reuse; útil para serving, mas ainda é tuning especializado.

source: WavePP: High-Throughput Pipeline Parallel LLM Prefill under Prefix Reuse

original source
https://arxiv.org/abs/2609.35263v1
10
interessante · score 8

Novo Sonnet pede teste

Impacta diretamente Claude Code e workflows agentic, mas é release de plataforma conhecida.

source: Sonnet 5.5

original source
https://www.anthropic.com/claude-sonnet-5-5

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.