Os quatro vídeos desta rodada saíram de fontes diferentes e chegaram ao mesmo lugar. A velocidade de resposta muda o que um agente consegue fazer; o treinamento em ambiente controlado não garante que ele sobreviva a interfaces caóticas; e dados velhos limitam o que ele consegue saber. A próxima disputa da IA parece menos sobre respostas isoladas e mais sobre a infraestrutura que mantém o agente em movimento.
Velocidade muda o desenho dos agentes
AI News: ChatGPT Ultrafast, Grok 4.6, 3 New Open-Source Models, and more! · Matthew Berman · 13min09s
O vídeo trata da parceria entre OpenAI e Cerebras para acelerar o ChatGPT, com uma promessa de até 14 vezes mais velocidade no modo ultrarrápido. A consequência prática é mais interessante que o número: quando a espera diminui, fica mais viável dividir uma tarefa entre agentes que trabalham em paralelo. O gargalo pode deixar de ser apenas a capacidade do modelo e passar a ser a forma como o sistema coordena essas chamadas.
O vídeo também menciona marcas d’água invisíveis em textos gerados pela Anthropic para atender à regulação europeia. É uma mudança pequena na interface, mas abre uma discussão incômoda sobre rastreabilidade e privacidade. Ganhar velocidade não elimina as perguntas sobre como identificar e governar o que esses sistemas produzem.
O limite do treinamento no mundo real
From RL to IRL — Gaurav Mishra, Amazon AGI Lab · AI Engineer · 17min46s
Gaurav Mishra, pesquisador do Amazon AGI Lab, conta como agentes treinados com aprendizado por reforço quebram ao seguir instruções em cenários não padronizados, como interfaces que mudam de posição a cada carregamento. Em tarefas com múltiplas soluções corretas e saídas verificáveis, como programação, o método costuma funcionar bem. O problema está na função de recompensa, que tenta condensar a complexidade do mundo real em um escalar simples.
O ponto central da palestra é que os agentes não quebram apenas por falta de treinamento. O mundo não se encaixa no espaço de estados que o modelo foi otimizado para resolver. Velocidade e capacidade de modelo não ajudam quem recebe uma tela de login inesperada fora do roteiro.
Dados frescos viram infraestrutura
How Web Data Infrastructure Powers the Next Generation of AI · Patricija Žemaitytė, Oxylabs · 19min03s
The Rise of CaaS: Context-as-a-Service for Agentic AI — Omer Primor, Bright Data · AI Engineer · 22min20s
As duas palestras tratam do mesmo problema pela escala. Patricija Žemaitytė apresenta a coleta de dados públicos da web como camada necessária para modelos que trabalham com vídeo e outros formatos além de texto, com uma operação capaz de processar 5 petabytes de vídeos por mês. O difícil não é o tamanho, e sim manter metadados, transcrições, legendas e arquivos sincronizados quando a informação muda o tempo todo.
Omer Primor nomeia a tendência: a web não é um banco estático de dados, e sim um repositório dinâmico de contexto. O conceito de Context-as-a-Service propõe tornar essa atualização contínua acessível a agentes, em vez de depender de cópias antigas. Os números explicam a urgência: em redes sociais a relevância cai em horas; em notícias, finanças e varejo, em até 30 dias. Uma infraestrutura desse tipo precisa processar mais de 50 bilhões de páginas HTML e 20 petabytes de mídia por dia.
Um modelo pode ter sido bem treinado e ainda assim responder mal se não consegue consultar o que aconteceu depois. Quando a funcionalidade depende de dados atuais e cresce bastante, deixa de ser apenas parte do produto e passa a exigir coleta, organização e atualização contínuas.
Os quatro vídeos sugerem a mesma direção: agentes melhores não dependem só de modelos maiores. Precisam responder depressa, agir fora do ambiente controlado e encontrar informação atualizada quando a tarefa exigir. A corrida fica menos glamourosa vista desse ângulo, mas também mais concreta.
Talvez a próxima vantagem da IA esteja em controlar o intervalo entre o mundo mudar e o agente perceber.