news.szt.link2026-08-13dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Raciocínio oculto vazou chaves

Exploit em tokens de raciocínio expõe risco direto em logs públicos e pipelines agentic.


itens
10
vanguarda
5
interessante
5
data
08-13
01
vanguarda · score 10

Raciocínio oculto vazou chaves

Exploit em tokens de raciocínio expõe risco direto em logs públicos e pipelines agentic.

fonte: 'Inner Thoughts' of Every Major AI Model Exposed in Massive Exploit

fonte original
https://decrypt.co/375501/inner-thoughts-every-major-ai-model-exposed-exploit
02
vanguarda · score 9

Transferência acontece no runtime

Troca distillation por harnesses em tempo de teste, relevante para agents e inferência local.

fonte: AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses

fonte original
https://arxiv.org/abs/2608.12307v1
03
vanguarda · score 9

Habilidades induzem desvios caros

Ataque mantém a tarefa correta enquanto manipula skills de terceiros para ampliar custo e tempo.

fonte: Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents

fonte original
https://arxiv.org/abs/2608.12273v1
04
vanguarda · score 9

Ambientes hostis testam agentes

Escala cenários adversariais para agents com tools e prompt injection indireta em estados do ambiente.

fonte: ToolHazard: Scaling Adversarial Environments for Security Evaluation and Alignment of LLM-based Agents

fonte original
https://arxiv.org/abs/2608.11878v1
05
vanguarda · score 9

Controle de agentes fica na GPU

Ataca o custo invisível entre LLM, ferramenta e estado, exatamente onde runtimes agentic ficam lentos.

fonte: Ready Cohorts: Bounding GPU Opportunity and Avoiding Host Round Trips in LLM-Agent Control

fonte original
https://arxiv.org/abs/2608.12123v1
06
interessante · score 8

LTX-2 libera treino audiovisual

Pacote oficial traz inferência e LoRA para modelo áudio-vídeo, direto no pipeline local.

fonte: Lightricks/LTX-2

fonte original
https://github.com/Lightricks/LTX-2
07
interessante · score 8

Bug antigo no coração do SQLite

Investigação profunda de WAL em infraestrutura usada por sistemas locais.

fonte: Tracking down the 16-year-old WAL-reset SQLite bug

fonte original
https://tailscale.com/blog/sqlite-wal-reset-bug
08
interessante · score 7

Custo inferido melhora RL seguro

Aproxima safe RL de stop rules reais, mas é nicho técnico, não ruptura ampla.

fonte: Redistribution-based Cost Inference Improves Sparse Safe Offline RL

fonte original
https://arxiv.org/abs/2608.12306v1
09
interessante · score 7

Agentes testados sob políticas

Mede agentes cruzando APIs e documentos sob políticas, encaixando com guardrails e sistemas reais.

fonte: VAKRA: Evaluating Multi-Hop Reasoning Across APIs and Retrieval Under Tool-Use Policies

fonte original
https://arxiv.org/abs/2608.12282v1
10
interessante · score 7

VLM chinês reenquadra censura

Audita distorção estatal em sistemas multimodais, útil para escolher modelos sem ingenuidade.

fonte: How China-Origin Vision-Language Models Move from Refusal to Reframing in State Alignment

fonte original
https://arxiv.org/abs/2608.11816v1