- Proactive Memory Agent lembra o agente só quando importa
Um segundo agente organiza fatos, tentativas e subobjetivos, escolhe quando intervir e melhora benchmarks — agora com código público para inspecionar o custo da memória.
- Raciocínio vaza, skills conspiram e agentes cobram pelo passado
Pesquisas expõem falhas no estado oculto e na composição de skills, enquanto Muse Glimmer leva 30B para máquinas locais e loops longos revelam a conta do cache.
- Claude Code automatiza permissões e OpenClaw tira alguém da fila
O auto mode vira padrão com 7% de ações perigosas não detectadas no teste adversarial; uma API de academia falha na autorização, benchmarks tropeçam e Atuin ajuda na perícia Linux.
- DeepSeek local vai de 1/17 a 5/17 e põe o harness no banco dos réus
O mesmo modelo ganhou orçamento para agir e mudou de resultado; um cliente PostgreSQL recebe status tarde, DietPi ganha placas e Rails ensaia um fork LTS.
- Plugins portáteis para agentes e Metabase sob ataque ativo
Agent Plugins 1.0.0 tenta padronizar skills e MCP, enquanto uma injeção de SQL crítica no Metabase exige patch e resposta a incidente.
- Agentes da OpenAI usam Artifactory como memória e PlanetScale freia a concorrência
Execuções separadas acumularam uma cadeia de ataque até o Hugging Face, enquanto limitar trabalho simultâneo salvou o throughput do MySQL.
- Cloudflare cria navegador para agentes, patches de IA falham e chaves vão ao hardware
Kitesurf troca Chromium por Workers, só 26% dos patches estudados foram correções limpas e hardware limita o que agentes podem assinar.
- CSS engana webmail e agentes, FreeBSD expõe root e o compilador relê a memória
CSS altera o que pessoas e agentes enxergam no e-mail, o CTL HA confia demais na rede e uma otimização reabre corridas no código compilado.
- OpenAI Ads Manager já está disponível para anunciantes no Brasil
Empresas brasileiras podem criar anúncios no ChatGPT por CPM ou CPC, com leilão contextual, Pixel e API de conversões — ainda em beta e sem benchmarks gerais.
- SSH vira persistência em 22 segundos, LoginTrap pesca agentes e SuperScout verifica o contexto
Um honeypot mostra a velocidade da persistência, páginas induzem agentes a entregar credenciais e um scout barato melhora o trabalho antes do patch.
Arquivo
Todos os posts
Página 4 de 21. Explorando o acervo de tutoriais e anotações.