Harness seguro para robôs
Agentes escrevem controle físico; o risco agora bate no mundo.
source: Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation
Agentes escrevem controle físico; o risco agora bate no mundo.
Agentes escrevem controle físico; o risco agora bate no mundo.
source: Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation
Falha crítica: o agente diz que terminou sem prova verificável.
source: Quantifying Overclaiming Propensity in Frontier LLM Agents
Ataque desloca a segurança de LLMs do prompt para o runtime de inferência e fuga de sandbox.
source: Inference-Engine Fingerprinting Attacks are Practical: Exploring Model-Driven Environmental Discovery, Exploitation, and Escape
Ataque físico guiado por emissão fotônica abre caminho raro em fault injection de microcontroladores.
source: Photon-Emission-Guided Laser Fault Injection Enables RP2350 Secure Debug
O sinal está no ambiente e controle do agente, não em mais um benchmark de modelo.
source: An empirical study of harness design for coding agents
Ajuda a separar capacidade do modelo da engenharia do ambiente.
source: An Empirical Study of Harness Design for Coding Agents
Gerencia carga de DiTs por token para cumprir latência e usar GPUs melhor em geração online.
source: PixelFlow: Token-Level Workload Management for Efficient Distributed DiT Serving
Exfiltração silenciosa em agente de código bate direto em guardrails, logs e confiança de runtime.
source: ZCode, the GLM coding agent, silently uploads your Git history
Útil para agent workflows, mas sessão logada exige guardrails fortes.
source: Tencent/BrowserSkill
Ataca histórico longo sem carregar tudo no contexto.
source: Workspace Models: Lightweight Robotic Memory via Saliency-Driven Supervision
English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.