news.szt.link2026-10-01dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Código abre atraso de alinhamento

Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.


itens
10
vanguarda
5
interessante
5
data
10-01
01
vanguarda · score 9

Código abre atraso de alinhamento

Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.

fonte: CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion

fonte original
https://arxiv.org/abs/2609.39902v1
02
vanguarda · score 9

MoE em GPUs de consumidor

Comunicação entre GPUs PCIe é gargalo central para MoE local em hardware próprio.

fonte: Efficient Expert-Parallel Communication on PCIe-Connected Consumer GPUs

fonte original
https://arxiv.org/abs/2609.40093v1
03
vanguarda · score 9

Atalho temporal derruba brain-to-text

Debunk técnico forte separa decodificação neural real de vazamento temporal.

fonte: Removing Timing Shortcuts Improves Non-Invasive Brain-to-Text

fonte original
https://arxiv.org/abs/2609.40359v1
04
vanguarda · score 9

Modelos abertos auditam caixas fechadas

Uma via prática para sondar modelos fechados usando substitutos abertos e interpretabilidade.

fonte: Model Hermeneutics: Monitoring Closed-Weight Models with Open-Weight Internals

fonte original
https://www.lesswrong.com/posts/CZLhfNGaDqtYxvGJD/model-hermeneutics-monitoring-closed-weight-models-with-open
05
vanguarda · score 9

Distilação adversarial vira campo real

Campanha coordenada para extrair reasoning mostra nova superfície de defesa em modelos.

fonte: Disrupting a coordinated model-distillation campaign

fonte original
https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign
06
interessante · score 7.6

Agentes GUI medidos por velocidade

Benchmark pragmático para CUAs, onde tempo de execução importa tanto quanto sucesso.

fonte: cua-speedrun: Standardized Benchmarking of the Speed of Computer-Use Agents

fonte original
https://arxiv.org/abs/2609.40284v1
07
interessante · score 7.2

Esquecimento vaza entre idiomas

Boa superfície de ataque multilíngue para avaliar claims de esquecimento em LLMs.

fonte: Linguistic Loopholes in LLM Unlearning: From a 174-Language Benchmark to Coverage-Aware Unlearning

fonte original
https://arxiv.org/abs/2609.40286v1
08
interessante · score 7

MCP pronto para plugar

Catálogo útil para conectar agentes a ferramentas reais; MCP já virou infraestrutura conhecida.

fonte: modelcontextprotocol/servers

fonte original
https://github.com/modelcontextprotocol/servers
09
interessante · score 7

Escala em MoE recorrente

Combina recorrência e sparsity para estimar eficiência de modelos MoE.

fonte: Scaling Laws for Looped Mixture of Experts

fonte original
https://arxiv.org/abs/2609.40316v1
10
interessante · score 7

LWE binário sob pressão

Reavalia ganho quântico e dificuldade clássica em BE-LWE, com possível impacto pós-quântico.

fonte: Exponential quantum speedup for $\mathbb{F}_3^n$-Subset-Sum? Or, rigorous classical algorithms for Binary-Error LWE

fonte original
https://arxiv.org/abs/2609.40321v1