news.szt.link2026-09-23dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Sequestro semântico no MCP

Ataque black-box mira seleção de ferramentas por metadados, direto para agents com MCP.


itens
10
vanguarda
5
interessante
5
data
09-23
01
vanguarda · score 9

Sequestro semântico no MCP

Ataque black-box mira seleção de ferramentas por metadados, direto para agents com MCP.

fonte: A2M: Trace-Optimized Agent Hijacking in the MCP Ecosystem

fonte original
https://arxiv.org/abs/2609.26761v1
02
vanguarda · score 9

CoT oculto vaza por ferramenta

Uma feature padrão de API vira canal para observar raciocínio escondido em modelos fechados.

fonte: Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models

fonte original
https://arxiv.org/abs/2609.26637v1
03
vanguarda · score 9

MPC ganha corpo no espaço

Leva computação privada de dados digitais para fatos físicos como lugar, tempo e movimento.

fonte: I Prove, Therefore I Am: Spatiotemporal Multi-Party Computation

fonte original
https://arxiv.org/abs/2609.26448v1
04
vanguarda · score 9

Stack local falseia agentes

Mostra que benchmarks de tool-use podem medir servidor e parser, não capacidade real do modelo.

fonte: Measuring the Serving Stack Instead of the Model: Hidden Confounds in Local Tool-Use Evaluation

fonte original
https://arxiv.org/abs/2609.26693v1
05
vanguarda · score 8

Difusão acelera OCR estruturado

Híbrido difusão+AR reduz latência em OCR ancorado na imagem.

fonte: Diffusion Drafts, AR Verifies: Accelerating Document OCR with Self-Speculative Decoding

fonte original
https://arxiv.org/abs/2609.26638v1
06
interessante · score 8

Compactação para agentes longos

Direto para Claude Code/pi-mono: reduz custo de sessões longas sem perder estado.

fonte: CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents

fonte original
https://arxiv.org/abs/2609.26779v1
07
interessante · score 8

Benchmark de inferência em produção

Benchmark raro para agents mexendo em runtime, APIs e serving de modelos em produção.

fonte: SWE-Serve: Benchmarking Agentic Engineering For Production Inference Serving

fonte original
https://arxiv.org/abs/2609.26777v1
08
interessante · score 8

Agentes que viram código

Sinal bom para reduzir contexto: feedback recorrente vira especialista executável.

fonte: Grow the Harness, Not the Context: From Strategy-Free Scaffolds to Reusable Specialist Agents

fonte original
https://arxiv.org/abs/2609.26760v1
09
interessante · score 8

Óptica sincroniza treino de LLM

Mostra como OCS pode reduzir gargalos de rede em treino de LLM ao ser agendado com compute.

fonte: Flux: Optimal Scheduling of Optical Circuit Switches for LLM Training

fonte original
https://arxiv.org/abs/2609.25949v1
10
interessante · score 8

Raciocínio local abaixo de três bits

Destilação on-policy tenta corrigir loops e perdas de raciocínio em modelos quantizados agressivamente.

fonte: Train Where the Quantized Model Goes: On-Policy Distillation for Low-Bit Reasoning

fonte original
https://arxiv.org/abs/2609.26708v1