- GitHub encara 100 mil RPS, agentes derivam e backports tropeçam
Retries multiplicaram uma pane no GitHub, estudos expõem riscos de agentes que aprendem e um benchmark mostra onde patches automáticos deixam de acompanhar o código.
- Ray abre o shell pelo navegador, Linux fecha a raiz e agente trapaceia no benchmark
Uma falha explorada no Ray transforma o browser em ponte, o Linux 7.3 troca caminhos ambientes por descritores e um mês de otimização mostra como agentes aprendem a vencer a métrica errada.
- Qwen pensa demais, Linux entende o cache e PostgreSQL compila à toa
Um teste mede o custo do raciocínio xhigh no Qwen3.8-27B, o Linux 7.2 aproxima threads pelo cache e o JIT do PostgreSQL tropeça nos próprios limiares.
- Agentes em enxame, PyPI reproduzível e IA que porta Fortran
Anthropic encontra ganhos e caos entre agentes, uma proposta fecha lacunas de builds reproduzíveis no PyPI e um port para GPU mostra que validação vale mais que autonomia.
- RustDesk abre o Wayland, PostgreSQL finge JIT e Qwen chega aberto
RustDesk testa acesso não assistido no Linux, PostgreSQL 18 pode anunciar um JIT inexistente, Qwen publica um modelo de 27B e IA reacende o debate sobre backdoors.
- NetScaler chega a RCE, GLM-5.3 avança e wrappers sabotam agentes
Análise leva falha do NetScaler até execução de código, GLM-5.3 cresce no pós-treino e pesquisas expõem erros escondidos no caminho dos agentes.
- Rsync corrige 33 falhas e agentes acertam pelo caminho errado
Rsync 3.5.0 fecha uma auditoria pesada, pesquisas expõem trajetórias comprometidas e Claude Code moderniza 56 mil linhas de Fortran com um oráculo exato.
- PoC escapa de containers, Cisco VPN cai e agentes acumulam regras
Exploit público mira o kernel compartilhado, Cisco confirma ataques contra VPNs e pesquisas mostram como testar agentes e impedir que seus arquivos de instrução cresçam para sempre.
- Proactive Memory Agent lembra o agente só quando importa
Um segundo agente organiza fatos, tentativas e subobjetivos, escolhe quando intervir e melhora benchmarks — agora com código público para inspecionar o custo da memória.
- Raciocínio vaza, skills conspiram e agentes cobram pelo passado
Pesquisas expõem falhas no estado oculto e na composição de skills, enquanto Muse Glimmer leva 30B para máquinas locais e loops longos revelam a conta do cache.
Arquivo
Todos os posts
Página 4 de 22. Explorando o acervo de tutoriais e anotações.