news.szt.link2026-08-05two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Persona portátil vira superfície

Benchmark mede vazamento, impersonação e defesas quando memórias pessoais viram skills executáveis.


itens
10
vanguarda
5
interessante
5
data
08-05
01
vanguarda · score 9

Persona portátil vira superfície

Benchmark mede vazamento, impersonação e defesas quando memórias pessoais viram skills executáveis.

source: When Agents Learn to Be You: Benchmarking Privacy Leakage, Impersonation Risk, and Defenses in Persona Skills

original source
https://arxiv.org/abs/2608.03700v1
02
vanguarda · score 9

Contrato verificável para agentes persistentes

Define semântica de retomada para efeitos já disparados, ponto crítico em agentes com rollback.

source: Resume Means Resume: A Machine-Checked Conformance Contract for Checkpoint, Interrupt, and Resume Semantics in Workflow Persistence Layers

original source
https://arxiv.org/abs/2608.03836v1
03
vanguarda · score 9

Supply chain atinge pacotes Node

Incidente ativo em Keyv e pacotes vizinhos tem risco direto para stacks Node/Next.

source: Keyv and friends compromised in active Shai-Hulud supply chain attack

original source
https://www.aikido.dev/blog/keyv-and-friends-compromised-in-npm-supply-chain-attack
04
vanguarda · score 8

Defesa runtime para agentes

Observabilidade e detecção para agentes conversa direto com guardrails e audit log.

source: uber/ADR

original source
https://github.com/uber/ADR
05
vanguarda · score 8

Atraso como ataque elétrico

Valida ataques de delay no canal CLS da medição inteligente alemã, com impacto cyberfísico real.

source: Delay Attacks on the German Smart Metering Infrastructure: A Security Analysis of CLS Channel Timing Constraints

original source
https://arxiv.org/abs/2608.03751v1
06
interessante · score 8

Inferência agentic por estágios

Ajuda a decidir quando separar etapas do serving de LLMs em workloads de agentes.

source: When Does Disaggregation Pay? Simulating Prefill--Decode--Attention--FFN Specialization for Agentic LLM Inference

original source
https://arxiv.org/abs/2608.03741v1
07
interessante · score 7

Crédito por turno em agentes

Trata turnos individuais em TIR, útil para avaliar e treinar agentes com ferramentas.

source: TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning

original source
https://arxiv.org/abs/2608.04007v1
08
interessante · score 7

Inferência escalada com método

Ajuda a separar deliberação, amostragem e votação antes de gastar compute.

source: Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility

original source
https://arxiv.org/abs/2608.04001v1
09
interessante · score 7

LLMs contra limites do compilador

Explora semântica recuperada de C/C++ para otimizações validadas.

source: Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?

original source
https://arxiv.org/abs/2608.03983v1
10
interessante · score 7

Limites formais dos LLMs

Prova separações incondicionais entre circuitos quânticos rasos e LLMs clássicos, mas é pouco operacional.

source: Separating quantum circuits from classical LLMs

original source
https://arxiv.org/abs/2608.03962v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.