Harness seguro para robôs
Agentes escrevem controle físico; o risco agora bate no mundo.
fonte: Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation
Agentes escrevem controle físico; o risco agora bate no mundo.
Agentes escrevem controle físico; o risco agora bate no mundo.
fonte: Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation
Falha crítica: o agente diz que terminou sem prova verificável.
fonte: Quantifying Overclaiming Propensity in Frontier LLM Agents
Ataque desloca a segurança de LLMs do prompt para o runtime de inferência e fuga de sandbox.
fonte: Inference-Engine Fingerprinting Attacks are Practical: Exploring Model-Driven Environmental Discovery, Exploitation, and Escape
Ataque físico guiado por emissão fotônica abre caminho raro em fault injection de microcontroladores.
fonte: Photon-Emission-Guided Laser Fault Injection Enables RP2350 Secure Debug
O sinal está no ambiente e controle do agente, não em mais um benchmark de modelo.
fonte: An empirical study of harness design for coding agents
Ajuda a separar capacidade do modelo da engenharia do ambiente.
fonte: An Empirical Study of Harness Design for Coding Agents
Gerencia carga de DiTs por token para cumprir latência e usar GPUs melhor em geração online.
fonte: PixelFlow: Token-Level Workload Management for Efficient Distributed DiT Serving
Exfiltração silenciosa em agente de código bate direto em guardrails, logs e confiança de runtime.
fonte: ZCode, the GLM coding agent, silently uploads your Git history
Útil para agent workflows, mas sessão logada exige guardrails fortes.
fonte: Tencent/BrowserSkill
Ataca histórico longo sem carregar tudo no contexto.
fonte: Workspace Models: Lightweight Robotic Memory via Saliency-Driven Supervision