Dois vídeos desta rodada do digest tratam de coisas aparentemente sem relação: uma parceria para acelerar o ChatGPT e uma palestra sobre coleta de dados da web. Vistos juntos, eles dizem a mesma coisa. O gargalo da IA saiu do modelo e foi para a infraestrutura ao redor dele: a velocidade da resposta de um lado, o dado fresco do outro.

Velocidade virou produto

A notícia principal do resumo de notícias de Matthew Berman é a parceria entre OpenAI e Cerebras, que deixa o ChatGPT até 14x mais rápido num modo ultrarrápido. O detalhe interessante vem depois do número: quando a resposta chega quase instantânea, quem limita a experiência passa a ser a máquina do usuário, não o modelo.

Berman também destaca que a velocidade muda a forma de orquestrar agentes: com respostas rápidas, rodar vários agentes em paralelo deixa de ser lento e caro. O vídeo menciona ainda o Grok 4.6 e três lançamentos de modelos abertos, mas a transcrição não entra em detalhes nessas partes.

Na parte regulatória, a Anthropic vai adicionar marcas d’água invisíveis nas saídas de texto para cumprir o AI Act europeu. Segundo o resumo, é um passo sem precedente entre os grandes provedores, e levanta questões de privacidade e rastreabilidade que ainda não têm resposta pronta.

AI News: ChatGPT Ultrafast, Grok 4.6, 3 New Open-Source Models, and more! · Matthew Berman · 13min09s

Treinar o modelo não basta mais

A palestra de Patricija Žemaitytė, da Oxylabs, no canal AI Engineer, começa onde a maioria das discussões sobre IA para: no dado. O argumento dela é que a coleta de dados da web pública virou alicerce da próxima geração de IA, principalmente para modelos multimodais, que dependem de informação fresca e em tempo real.

O caso central é um pipeline de coleta de vídeos de 5 petabytes por mês, construído pela equipe dela sob pressão extrema. Daí vem a tese mais interessante da palestra: a inovação real vem de prazo impossível e de demanda específica de cliente, não de roteiro limpo. E todo recurso de produto que escala acaba virando infraestrutura crítica, goste o time ou não.

How Web Data Infrastructure Powers the Next Generation of AI — Patricija Žemaitytė, Oxylabs · AI Engineer · 19min03s

Enquanto todo mundo discute qual modelo é o melhor, a diferença competitiva está migrando para as bordas do sistema: quem entrega a resposta mais rápido de um lado, quem controla o dado que chega ao modelo do outro.