GPUs falam direto com NICs
RDMA iniciado por GPU afeta NCCL/NVSHMEM/DeepEP e latência de MoE; material técnico raro.
fonte: GPU-Initiated Communication: Dissecting Down to the Bone
RDMA iniciado por GPU afeta NCCL/NVSHMEM/DeepEP e latência de MoE; material técnico raro.
RDMA iniciado por GPU afeta NCCL/NVSHMEM/DeepEP e latência de MoE; material técnico raro.
fonte: GPU-Initiated Communication: Dissecting Down to the Bone
Compactação aprendida pode tornar coding agents mais long-horizon, auditáveis e baratos.
fonte: AutoCompact: Learning When to Compact Context in Long-Horizon Coding Agents
Mede comandos executáveis de LLMs no Kali com recompensas verificáveis sem runtime.
fonte: KaliBench: A Fine-Grained Benchmark for Cybersecurity Tool Use on Kali Linux with Runtime-Free Verifiable Rewards
ZK para validar outputs sobre dados sigilosos conecta cripto, governança e auditoria de agentes.
fonte: Can AI Oversight Be Zero Knowledge?
Stratego é bom proxy para agentes que decidem sem estado completo.
fonte: With most information hidden, the game Stratego had stumped AI until now
Reduz inferência neural em avatares 3D Gaussian, útil para instalações e presença digital.
fonte: One Basis to Animate Them All: Gaussian Blendshape Distillation for Real-Time Avatars
Avalia recuperação de papers que inspiram pesquisa, alinhado à curadoria autônoma.
fonte: ScholarCatalyst: A Benchmark for Retrieving Papers That Inspire New Research
Gerenciar residência/offload de especialistas ajuda MoE em hardware limitado, útil para inferência local.
fonte: MoE-CORE: Coordinated Expert Offloading and Residency for Memory-Constrained MoE Inference
Ataca custo de inferência MoE em hardware desigual, útil para pensar rigs locais e datacenter.
fonte: RapidMoE: Exploiting Cross-Asymmetry via Adaptive Residual Offloading for Large-Scale MoE Inference
Expõe falsos positivos em tool use e oferece escada simples de testes para SLMs.
fonte: Keyword Harnesses Fail Open: A Cheap Diagnostic Ladder for Tool-Use Claims in Small Language Models