news.szt.link2026-08-27two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

OOXML quebra evidência em LLMs

Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.


itens
10
vanguarda
5
interessante
5
data
08-27
01
vanguarda · score 9

OOXML quebra evidência em LLMs

Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.

source: Beyond the Editing Canvas: Evidence Divergence in OOXML-to-LLM Ingestion

original source
https://arxiv.org/abs/2608.25880v1
02
vanguarda · score 9

Resposta certa exige rastro válido

Critério para agents em dados: resposta correta não basta se a computação registrada é inválida.

source: Trace Integrity for LLM Data Agents: A Vision for Auditable Structured Reasoning in Real-World Systems

original source
https://arxiv.org/abs/2608.26036v1
03
vanguarda · score 9

Trace não prova aprovação humana

Mostra que traces de agentes podem apagar quem autorizou tool calls, ponto crítico para audit log real.

source: Your Agent's Trace Probably Cannot Tell You Who Approved a Tool Call

original source
https://www.lesswrong.com/posts/gXphcRGg6t65FqCy8/your-agent-s-trace-probably-cannot-tell-you-who-approved-a
04
vanguarda · score 8

Raciocínio visual vira substrato

Imagens e vídeos viram estado verificável de raciocínio, ponto raro para pipelines visuais locais.

source: VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning

original source
https://arxiv.org/abs/2608.26105v1
05
vanguarda · score 8

Raciocínio longo com menos memória

Técnica mira o custo real de traces longos em inferência e pode mudar runtime local.

source: Prefix Sliding for efficient test-time scaling

original source
https://arxiv.org/abs/2608.26070v1
06
interessante · score 8

Habilidades de segurança para agentes

Relevante para Claude Code/OpenClaw, mas prompt-space tende a ser defesa frágil.

source: SkillShield: Prompt-Space Security Skills for LLM Coding Agents

original source
https://arxiv.org/abs/2608.25817v1
07
interessante · score 7

Latentes interpretáveis em neutrinos

SAEs extraem conceitos físicos de um modelo de neutrinos; raro, mas nichado.

source: Finding and using interpretable latents in a neutrino foundation model with sparse autoencoders

original source
https://arxiv.org/abs/2608.26090v1
08
interessante · score 7

Planejamento real de agentes

Mapeia falhas em loops longos de dados, modelo e validação, útil para agentes sob audit log.

source: TraceML: An Empirical Analysis of Human-Agent Planning in Machine Learning Development

original source
https://arxiv.org/abs/2608.26086v1
09
interessante · score 7

Rowhammer volta ao controlador

Ataca defesa de hardware real no controlador de memória, com tradeoff operacional claro.

source: From Fleet to Lab: Revisiting the Security and Complexity of Industrial Rowhammer Mitigation

original source
https://arxiv.org/abs/2608.26072v1
10
interessante · score 7

Ataques transferíveis em busca de código

Mostra que texto não funcional pode corromper retrieval de código entre modelos.

source: Vulnerable Code Search: Transferable Attack for Code Language Models

original source
https://arxiv.org/abs/2608.26031v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.