Código abre atraso de alinhamento
Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.
fonte: CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion
Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.
Jailbreak por code completion mira uma falha prática em LLMs usados como agentes.
fonte: CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion
Comunicação entre GPUs PCIe é gargalo central para MoE local em hardware próprio.
fonte: Efficient Expert-Parallel Communication on PCIe-Connected Consumer GPUs
Debunk técnico forte separa decodificação neural real de vazamento temporal.
fonte: Removing Timing Shortcuts Improves Non-Invasive Brain-to-Text
Uma via prática para sondar modelos fechados usando substitutos abertos e interpretabilidade.
fonte: Model Hermeneutics: Monitoring Closed-Weight Models with Open-Weight Internals
Campanha coordenada para extrair reasoning mostra nova superfície de defesa em modelos.
fonte: Disrupting a coordinated model-distillation campaign
Benchmark pragmático para CUAs, onde tempo de execução importa tanto quanto sucesso.
fonte: cua-speedrun: Standardized Benchmarking of the Speed of Computer-Use Agents
Boa superfície de ataque multilíngue para avaliar claims de esquecimento em LLMs.
fonte: Linguistic Loopholes in LLM Unlearning: From a 174-Language Benchmark to Coverage-Aware Unlearning
Catálogo útil para conectar agentes a ferramentas reais; MCP já virou infraestrutura conhecida.
fonte: modelcontextprotocol/servers
Combina recorrência e sparsity para estimar eficiência de modelos MoE.
fonte: Scaling Laws for Looped Mixture of Experts
Reavalia ganho quântico e dificuldade clássica em BE-LWE, com possível impacto pós-quântico.
fonte: Exponential quantum speedup for $\mathbb{F}_3^n$-Subset-Sum? Or, rigorous classical algorithms for Binary-Error LWE