news.szt.link2026-09-10dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Benchmark pelo sistema servido

Mede rota, precisão, contrato e harness, não só o nome comercial do modelo.


itens
10
vanguarda
5
interessante
5
data
09-10
01
vanguarda · score 9

Benchmark pelo sistema servido

Mede rota, precisão, contrato e harness, não só o nome comercial do modelo.

fonte: IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier

fonte original
https://arxiv.org/abs/2609.10494v1
02
vanguarda · score 9

Proveniência granular para agentes

Autentica trajetórias de coding agents e localiza adulteração, alinhado a audit log e governança.

fonte: TrajMark: Ownership Attribution and Segment-Level Tamper Localization for Coding-Agent Trajectories

fonte original
https://arxiv.org/abs/2609.10416v1
03
vanguarda · score 8.7

Compilador para difusão MoE

Ataca o gargalo de servir LMs difusivos em MoE, alinhando refinamento e runtime.

fonte: Epoch: Compiling Diffusion Blocks for Sparse MoE Serving

fonte original
https://arxiv.org/abs/2609.09748v1
04
vanguarda · score 8

Inferência LLM verificável e privada

Delegação de matrix-vector mira LLM remoto sem expor inputs nem confiar cegamente no provedor.

fonte: Maverick: Private and Verifiable LLM Inference Made Practical via Matrix-Vector Multiplication Delegation

fonte original
https://arxiv.org/abs/2609.10264v1
05
vanguarda · score 8

Rádio definido por software no browser

SDR no browser reduz fricção para protótipos RF, DePIN e instalações.

fonte: GNU Radio in the browser

fonte original
https://gnuradioworld.com/
06
interessante · score 8

Lógica formal caça falhas

Foca em semântica de negócio, onde falhas de lógica são difíceis de modelar.

fonte: Towards Tackling Application Logic Flaws through Autonomous Formal-Logic Modeling and Automated Reasoning

fonte original
https://arxiv.org/abs/2609.10537v1
07
interessante · score 7

Desktop local para agentes

Electron, Rust e plugins dão uma superfície testável para agent coding sem depender de SaaS.

fonte: vastsa/PI-Desktop

fonte original
https://github.com/vastsa/PI-Desktop
08
interessante · score 7

Agentes GUI cruzam dispositivos

Ataca estado compartilhado e composição dinâmica em workflows reais de múltiplas telas.

fonte: JarvisGUI: Towards Cross-Device GUI Agents with Dynamic Task Composition

fonte original
https://arxiv.org/abs/2609.10451v1
09
interessante · score 7

Memória persistente com ciclo

Propõe regras de persistência e substituição para fatos pessoais em agentes longos.

fonte: Fortunate Recall: Ontology-Driven Memory Lifecycle Management for Persistent Coherence in LLMs

fonte original
https://arxiv.org/abs/2609.10413v1
10
interessante · score 7

SSD computacional verificado formalmente

Formaliza FTLs em SSDs computacionais, uma camada rara de infra, mas distante do stack AYA.

fonte: CertiFlash: A Formal Verification Framework for Flash Translation Layers in Computational Solid State Drives

fonte original
https://arxiv.org/abs/2609.10347v1