Agentes saem da demo e ganham camada de governança — Maersk/AI Agents at Global Scale, AgentGate, Cardwall

  • Relato de produção da Maersk: agentes em escala global esbarram em “tribal dungeons” — integração organizacional, não no loop do agente.
  • Infra de confiança emergindo: receipts assinados para ações SaaS (AgentGate), health-check de agent cards A2A (Cardwall).
  • Memória como produto e como infra: estruturada cross-tool com 26 integrações via MCP (Itsuki), local e compartilhada entre harnesses (Memnest) — e LLM memory acidentalmente virando análise estática de programas (pwning.systems).
  • Orquestração multi-AI: agentes em máquinas distintas trocando tarefas A2A sem servidor, E2E-encrypted (A2acast); AgentBridge separa raciocínio de execução via MCP (GitHub).
  • Roteamento de custo e controle de escopo: delegar tarefas a modelos baratos (Spewer), bloquear trabalho defensivo não solicitado (Stop That Shit) e linter determinístico de eficiência de prompt com custo em dólar por finding (Tokensift) — o harness vira plataforma, e token é orçamento, não detalhe.

Open-weights acelera e empurra inferência pra borda — Tencent Hy4, vLLM v0.28, GLM-5.3

  • Hy4 preview: 770B open-source focado em produtividade real (code, office, pesquisa); vLLM 0.28 com 584 commits otimizando Kimi-K3 — a stack open compete em desempenho, não só em preço. GLM-5.3 liberado open-weight no mesmo movimento.
  • Qwen3.8 27B roda 10 dias em Mac Studio como assistente de rotina com números reais (TerminalBytes) — e Metis (harness de agente) empurra DeepSeek para nível Opus em coding, 82% (GitHub): o scaffold vale tanto quanto o modelo.
  • MoE-Direct: experts streamados do NVMe sob demanda — modelos maiores que a RAM em desktop consumer, sem re-quantização (GitHub).
  • Especialização extrema: SLM só para tool-calling a $0.01/M tokens (Neurometric); rumor de Ox-Alpha = GLM 5.3 Flash no OpenRouter (análise).

Guerra de plataformas e a conta física da IA — OpenAI, SpaceX turbine factory, Salesforce AI pricing

  • OpenAI encerrou o contrato de modelos com Cursor após aquisição de US$ 60B pela SpaceX (The Information) — distribuição de frontier models virou alavanca geopolítica, não commodity.
  • O capital migra da camada de app para a infraestrutura: a16z levanta US$ 1,1B para fundo de hardware físico de IA (The Information); SpaceX verticaliza pás de turbina para driblar o gargalo de energia dos data centers — Musk confirmou (resposta).
  • Salesforce migra de subscription para cobrança por uso/outcome: o pricing de software AI está sendo reescrito na prática.
  • Ironia Apple: o sucesso de hardware para IA não foi iPhone, foi Mac mini/Studio — silício local com RAM generosa.

Evidência > hype: produtividade e a org AI-nativa — YouTube, QuantumBlack

  • 3 estudos sobre IA e velocidade de dev, 3 respostas divergentes — o efeito é heterogêneo e depende do contexto de trabalho.
  • Contraponto: Lean4 e verificação formal para engenheiros (AWS) — se coding agents geram milhares de PRs, prova matemática é o gate de qualidade (YouTube).
  • QuantumBlack defende estruturar empresas em skills escaláveis, não funções; Company OS com Hermes/OpenClaw mostra o padrão na prática (Aakash Gupta) — a pergunta migra de “qual modelo usar” para “que arquitetura organizacional consome agentes”.
  • Debian aprova “uso responsável” de IA generativa; Shipcheck audita localmente se app AI-built está pronto (LWN · GitHub).

Backlash com números duros — Creepy Crawlies, No AI Fridays, VibeGuard

  • Mantenedor kernel.org quantifica crawlers de IA como “radiação de fundo” permanente de carga — custo de infra que não gera tráfego humano.
  • Dívida cognitiva documentada em estudos motiva movimento “No AI Fridays”; em engenharia de cultura, cultura > AI.
  • Contraponto técnico: linters de segurança específicos para código gerado (VibeGuard) — aceitar velocidade exige gate próprio.

Privacidade e vigilância sob pressão — QubesOS QSB-118, UK msgs, CA Linux exemption

  • RCE em Dom0 no Qubes via canal lateral de erro do qvm-copy — até o OS mais duro tem superfície.
  • California isenta FOSS (GPL/MIT/BSD/Apache) da lei de verificação de idade: vitória pragmática do open-source. GrapheneOS reporta Pixel 11 sem MTE em hardware.

Síntese: o ciclo girou — plataformas brigam por distribuição enquanto open-weights democratiza o modelo e empurra inferência pra borda; o diferencial competitivo desloca-se para o scaffold (memória, orquestração, verificação) e para o redesenho organizacional que consome agentes. A camada física (energia, silício) e o backlash (crawlers, dívida cognitiva) definem os limites reais do que o software consegue entregar.


Conteúdo gerado a partir do Personal Brain — sistema de captura e análise com GraphRAG.