news.szt.link2026-09-09dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Prova formal entra no abismo

AI com Lean em problema do milênio é sinal de fronteira matemática verificável.


itens
10
vanguarda
5
interessante
5
data
09-09
01
vanguarda · score 10

Prova formal entra no abismo

AI com Lean em problema do milênio é sinal de fronteira matemática verificável.

fonte: On the Navier–Stokes Millennium Prize Problem

fonte original
https://openai.com/index/navier-stokes-solution
02
vanguarda · score 9

Harnesses evoluem com modelos

Evoluir prompts, tools e hooks com correção on-policy pode baratear agents especializados.

fonte: Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails

fonte original
https://arxiv.org/abs/2609.09134v1
03
vanguarda · score 9

LLMs escalam privilégios Linux

Automação de pós-exploração Linux por LLMs toca direto o threat model de agents locais.

fonte: PrivEscalate: Measuring and Augmenting the Threat of LLM-Automated Linux Privilege Escalation

fonte original
https://arxiv.org/abs/2609.09087v1
04
vanguarda · score 9

Agentes descobriram memória pública

Coordenação emergente via wiki editável alerta para sandbox, audit log e canais laterais.

fonte: Copying explains the collective behavior of AI agents in the wild

fonte original
https://arxiv.org/abs/2609.09150v1
05
vanguarda · score 9

Fronteira medida pela tomada

Power monitoring vira métrica verificável de treino frontier, ponte rara entre datacenter e governança.

fonte: FLOP Around and Find Out: LLM Training Workload Size Estimation With Power Monitoring

fonte original
https://www.lesswrong.com/posts/7qXmra77D49dJp2ik/flop-around-and-find-out-llm-training-workload-size
06
interessante · score 7

Agentes ganham grafos auditáveis

Grafos deixam planos de agentes auditáveis, mas lembram evolução incremental de workflows.

fonte: Procedural Graphs: Self-Evolving Execution Structures for LLM Agents

fonte original
https://arxiv.org/abs/2609.09153v1
07
interessante · score 7

Testes criticam agentes de código

Foca no gargalo real de coding agents quando testes gerados validam o patch errado.

fonte: ExecCritic: Learn to Test, Test to Improve for Coding Agents

fonte original
https://arxiv.org/abs/2609.09133v1
08
interessante · score 7

Placar depende do pipeline

Audita benchmarks cyber de LLMs e mostra que a metodologia altera o placar.

fonte: Benchmark Scores Are Pipeline-Dependent: A Reliability Audit of Cybersecurity LLM Benchmarks

fonte original
https://arxiv.org/abs/2609.08765v1
09
interessante · score 7

FP64 sobre Tensor Cores FP8

Truque numérico usa FP8 para multiplicação densa com precisão efetiva maior.

fonte: Ozaki 2.5: Engineering the Deconstruction Path of fp64-Emulated Dense Matrix Multiplication on FP8 Tensor Cores

fonte original
https://arxiv.org/abs/2609.09095v1
10
interessante · score 7

Recorrência mira contexto longo

Ataca extrapolação além do treino, tema relevante para modelos long-context eficientes.

fonte: Learning Length-Extrapolatable Recurrent Models

fonte original
https://arxiv.org/abs/2609.09157v1