news.szt.link2026-09-04two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Hooks ocultos sequestram agentes

Configs de lifecycle hook podem executar comandos privilegiados fora da visão do LLM.


itens
10
vanguarda
5
interessante
5
data
09-04
01
vanguarda · score 10

Hooks ocultos sequestram agentes

Configs de lifecycle hook podem executar comandos privilegiados fora da visão do LLM.

source: A Blind Trust, the Bloody Thrust: When Attacker-Controlled Hook Updates Steer AI Agent Harnesses towards Malicious Behaviors

original source
https://arxiv.org/abs/2609.03884v1
02
vanguarda · score 9

Funções locais compiladas por treino

Transforma especificações em módulos neurais locais, cortando custo, latência e dependência de provedor.

source: Compile by Training: Turning Natural-Language Specifications into Local Neural Functions

original source
https://arxiv.org/abs/2609.04199v1
03
vanguarda · score 9

Silício pós-quântico exige nova validação

Caso em silício real mostra classe de defeitos ML-DSA que o gate padrão não detecta.

source: AI-Assisted Design of a Post-Quantum Cryptographic Accelerator: A Deployed-Silicon Case Study

original source
https://arxiv.org/abs/2609.04058v1
04
vanguarda · score 9

Trajetórias viram terminais treináveis

Transforma logs de agentes em ambientes reexecutáveis, atacando a escassez de tarefas verificáveis.

source: Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments

original source
https://arxiv.org/abs/2609.04148v1
05
vanguarda · score 9

Astra expõe mapa de risco

Fonte primária para medir capacidades, riscos e guardrails antes de qualquer adoção.

source: GPT-6 Astra

original source
https://openai.com/index/gpt-6-astra/
06
interessante · score 8

Servidor local para agentes

Integra agentes como Claude Code e OpenClaw a modelos locais, mas a categoria já existe em Ollama, vLLM e llama.cpp.

source: magnitudedev/magnitude

original source
https://github.com/magnitudedev/magnitude
07
interessante · score 8

Juízes LLM perdem estabilidade

Audita se o mesmo endpoint julga igual amanhã; essencial para benchmarks e guardrails com LLM.

source: Clean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box LLM Observers on Shared Endpoints

original source
https://arxiv.org/abs/2609.04198v1
08
interessante · score 8

Topologia fora do agente SOC

Separa LLM e raciocínio de grafo em SOC, boa pista de guardrails para agentes.

source: SENTINEL-RL: Offloading Topological Reasoning from LLM Agents in the Security Operations Center

original source
https://arxiv.org/abs/2609.04159v1
09
interessante · score 8

Nvidia cerca ecossistema aberto

A possível compra da Hugging Face elevaria o risco de lock-in em modelos, dados e distribuição.

source: Nvidia to acquire Hugging Face

original source
https://www.cnbc.com/2026/09/03/nvidia-agrees-to-buy-hugging-face-for-almost-13-billion-ai-expansion.html
10
interessante · score 7

Agentes corrigem só o sintoma

PatchBench mira avaliações que confundem parar o crash do PoC com corrigir a vulnerabilidade.

source: PatchBench: Evaluating AI Agents for Vulnerability Patching

original source
https://arxiv.org/abs/2609.04075v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.