news.szt.link2026-10-01two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Código abre atraso de alinhamento

Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.


itens
10
vanguarda
5
interessante
5
data
10-01
01
vanguarda · score 9

Código abre atraso de alinhamento

Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.

source: CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion

original source
https://arxiv.org/abs/2609.39902v1
02
vanguarda · score 9

MoE em GPUs de consumidor

Comunicação entre GPUs PCIe é gargalo central para MoE local em hardware próprio.

source: Efficient Expert-Parallel Communication on PCIe-Connected Consumer GPUs

original source
https://arxiv.org/abs/2609.40093v1
03
vanguarda · score 9

Atalho temporal derruba brain-to-text

Debunk técnico forte separa decodificação neural real de vazamento temporal.

source: Removing Timing Shortcuts Improves Non-Invasive Brain-to-Text

original source
https://arxiv.org/abs/2609.40359v1
04
vanguarda · score 9

Modelos abertos auditam caixas fechadas

Uma via prática para sondar modelos fechados usando substitutos abertos e interpretabilidade.

source: Model Hermeneutics: Monitoring Closed-Weight Models with Open-Weight Internals

original source
https://www.lesswrong.com/posts/CZLhfNGaDqtYxvGJD/model-hermeneutics-monitoring-closed-weight-models-with-open
05
vanguarda · score 9

Distilação adversarial vira campo real

Campanha coordenada para extrair reasoning mostra nova superfície de defesa em modelos.

source: Disrupting a coordinated model-distillation campaign

original source
https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign
06
interessante · score 7.6

Agentes GUI medidos por velocidade

Benchmark pragmático para CUAs, onde tempo de execução importa tanto quanto sucesso.

source: cua-speedrun: Standardized Benchmarking of the Speed of Computer-Use Agents

original source
https://arxiv.org/abs/2609.40284v1
07
interessante · score 7.2

Esquecimento vaza entre idiomas

Boa superfície de ataque multilíngue para avaliar claims de esquecimento em LLMs.

source: Linguistic Loopholes in LLM Unlearning: From a 174-Language Benchmark to Coverage-Aware Unlearning

original source
https://arxiv.org/abs/2609.40286v1
08
interessante · score 7

MCP pronto para plugar

Catálogo útil para conectar agentes a ferramentas reais; MCP já virou infraestrutura conhecida.

source: modelcontextprotocol/servers

original source
https://github.com/modelcontextprotocol/servers
09
interessante · score 7

Escala em MoE recorrente

Combina recorrência e sparsity para estimar eficiência de modelos MoE.

source: Scaling Laws for Looped Mixture of Experts

original source
https://arxiv.org/abs/2609.40316v1
10
interessante · score 7

LWE binário sob pressão

Reavalia ganho quântico e dificuldade clássica em BE-LWE, com possível impacto pós-quântico.

source: Exponential quantum speedup for $\mathbb{F}_3^n$-Subset-Sum? Or, rigorous classical algorithms for Binary-Error LWE

original source
https://arxiv.org/abs/2609.40321v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.