news.szt.link2026-09-23two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Sequestro semântico no MCP

Ataque black-box mira seleção de ferramentas por metadados, direto para agents com MCP.


itens
10
vanguarda
5
interessante
5
data
09-23
01
vanguarda · score 9

Sequestro semântico no MCP

Ataque black-box mira seleção de ferramentas por metadados, direto para agents com MCP.

source: A2M: Trace-Optimized Agent Hijacking in the MCP Ecosystem

original source
https://arxiv.org/abs/2609.26761v1
02
vanguarda · score 9

CoT oculto vaza por ferramenta

Uma feature padrão de API vira canal para observar raciocínio escondido em modelos fechados.

source: Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models

original source
https://arxiv.org/abs/2609.26637v1
03
vanguarda · score 9

MPC ganha corpo no espaço

Leva computação privada de dados digitais para fatos físicos como lugar, tempo e movimento.

source: I Prove, Therefore I Am: Spatiotemporal Multi-Party Computation

original source
https://arxiv.org/abs/2609.26448v1
04
vanguarda · score 9

Stack local falseia agentes

Mostra que benchmarks de tool-use podem medir servidor e parser, não capacidade real do modelo.

source: Measuring the Serving Stack Instead of the Model: Hidden Confounds in Local Tool-Use Evaluation

original source
https://arxiv.org/abs/2609.26693v1
05
vanguarda · score 8

Difusão acelera OCR estruturado

Híbrido difusão+AR reduz latência em OCR ancorado na imagem.

source: Diffusion Drafts, AR Verifies: Accelerating Document OCR with Self-Speculative Decoding

original source
https://arxiv.org/abs/2609.26638v1
06
interessante · score 8

Compactação para agentes longos

Direto para Claude Code/pi-mono: reduz custo de sessões longas sem perder estado.

source: CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents

original source
https://arxiv.org/abs/2609.26779v1
07
interessante · score 8

Benchmark de inferência em produção

Benchmark raro para agents mexendo em runtime, APIs e serving de modelos em produção.

source: SWE-Serve: Benchmarking Agentic Engineering For Production Inference Serving

original source
https://arxiv.org/abs/2609.26777v1
08
interessante · score 8

Agentes que viram código

Sinal bom para reduzir contexto: feedback recorrente vira especialista executável.

source: Grow the Harness, Not the Context: From Strategy-Free Scaffolds to Reusable Specialist Agents

original source
https://arxiv.org/abs/2609.26760v1
09
interessante · score 8

Óptica sincroniza treino de LLM

Mostra como OCS pode reduzir gargalos de rede em treino de LLM ao ser agendado com compute.

source: Flux: Optimal Scheduling of Optical Circuit Switches for LLM Training

original source
https://arxiv.org/abs/2609.25949v1
10
interessante · score 8

Raciocínio local abaixo de três bits

Destilação on-policy tenta corrigir loops e perdas de raciocínio em modelos quantizados agressivamente.

source: Train Where the Quantized Model Goes: On-Policy Distillation for Low-Bit Reasoning

original source
https://arxiv.org/abs/2609.26708v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.