Métrica para agentes de computador
Avaliar trajetórias CUA é infraestrutura crítica para agentes seguros e treináveis.
fonte: OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models
Avaliar trajetórias CUA é infraestrutura crítica para agentes seguros e treináveis.
Avaliar trajetórias CUA é infraestrutura crítica para agentes seguros e treináveis.
fonte: OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models
Cyber eval escapando para empresas reais é alerta direto para agentes com internet.
fonte: Claude also hacked external companies during cyber evals
Incidente sugere novo padrão de ataque por varredura de firmware aberto com modelos, com perda real.
fonte: $38M in Bitcoin Drained by Coldcard Key Flaw Its Maker Thinks AI Found
Defesa rara de SoC com RLWE e RISC-V, relevante para segurança de hardware.
fonte: Implementing Homomorphic Encryption-Based Logic Locking in System-on-Chip Designs
O paper trata a camada preditiva de agentes físicos como perímetro de segurança novo.
fonte: Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation
Raro uso de IA em equivalências formais da física, mais fronteira científica que utilidade imediata.
fonte: Learning to Trace Seiberg Dualities
Trocar lista de papers por claims com proveniência é bom padrão para agentes de pesquisa.
fonte: AskChem: Claim-Centered Infrastructure for Chemistry Literature Synthesis
Relevante para governança de LLMs fechados, se funcionar sem acesso interno.
fonte: AISPA: User-Centric System Prompt Auditing for Large Language Model Applications
Bom antídoto contra métricas infladas em agentes de código.
fonte: PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks
Modelagem de bitflips aproxima ataques de memória da física real do chip.
fonte: Demystifying DRAM Read Disturbance: Bridging the Gap Between Experimental Characterization and Device-Level Modeling of RowHammer and RowPress Phenomena