news.szt.link2026-09-07two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Difusão encarnada no CRT

A antena vira controle físico do denoising, unindo IA generativa, som e mídia obsoleta.


itens
10
vanguarda
5
interessante
5
data
09-07
01
vanguarda · score 9

Difusão encarnada no CRT

A antena vira controle físico do denoising, unindo IA generativa, som e mídia obsoleta.

source: Diffusion TV: Experiencing Diffusion Models through Tangible, Embodied Interaction

original source
https://arxiv.org/abs/2609.05404v1
02
vanguarda · score 9

Contratos de contexto para agentes

Controles corretos isoladamente quebram quando o contexto cruza adaptadores.

source: CONTINUITY: Security-Context Contracts for Composable LLM Agent Controls

original source
https://arxiv.org/abs/2609.05269v1
03
vanguarda · score 9

Traços reais de carga GPU

Trace de 155 mil GPUs mede quanta carga de IA realmente pode aliviar a rede.

source: Beyond Scalar Flexibility: From Eligible AI Workloads to Dependable Load Relief

original source
https://arxiv.org/abs/2609.05406v1
04
vanguarda · score 9

Cache quebra repetibilidade

Mede como prefix caching e quantização mudam respostas iguais em serving LLM, com impacto direto em auditoria.

source: Same Request, Different Answer: Quantization Amplifies Cache-Induced Divergence in LLM Serving

original source
https://arxiv.org/abs/2609.04748v1
05
vanguarda · score 9

Memória de agentes não migra

Mostra que upgrades de modelo podem corromper recuperação e interpretação de memórias.

source: Does Your Agent's Memory Survive a Model Upgrade? A Controlled Study of Memory Portability

original source
https://arxiv.org/abs/2609.05339v1
06
interessante · score 8

Explicações de LLM sob prova

Testa se fatores citados por LLMs têm evidência comportamental para monitorar agentes.

source: Necessary or Sufficient? Evaluating LLM Explanations With Behavioural Evidence

original source
https://arxiv.org/abs/2609.05385v1
07
interessante · score 8

Decompiladores LLM escondem incerteza

Código recompilável pode apagar sinais que Ghidra e Hex-Rays deixariam visíveis.

source: When LLM Decompilers Recompile More and Preserve Less

original source
https://arxiv.org/abs/2609.05370v1
08
interessante · score 8

Patches viram detectores executáveis

Histórico de correções pode melhorar triagem de CVEs sem depender só de texto.

source: The History Is the Detector: Executing CVE Patch History, End-to-End

original source
https://arxiv.org/abs/2609.05335v1
09
interessante · score 7

Agentes testados em APIs públicas

Benchmark mede chamadas multi-etapa em APIs governamentais reais, útil para agents on-prem.

source: Multi-Step Tool-Calling over Korean Open Public APIs: A Benchmark and a Data-Synthesis Recipe

original source
https://arxiv.org/abs/2609.05395v1
10
interessante · score 7

Modelos decoram números moleculares

Auditoria separa predição de recuperação literal em benchmarks científicos.

source: Molecular Déjà Vu: Digit-Level Retrieval of Published Values in Frontier Language Models

original source
https://arxiv.org/abs/2609.05381v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.