← Registro de alterações
Diário2026-05-14

Feche o navegador – os agentes continuam trabalhando

Hoje em dia, os agentes passaram de “uma janela em que você conversa” para “colegas de trabalho que ficam muito tempo em segundo plano”: fechar a janela ou desligar a rede não os impede, e a reabertura continua de onde você parou; várias guias de conversa são executadas simultaneamente sem interferência; um painel local examina cada tarefa; vários backends de codificação compartilham um protocolo e podem ser trocados a qualquer momento; e o mecanismo ganhou um vocabulário unificado de ativos de identificador e GUID.

De "fecha a janela e ela para" a "continua em segundo plano"

Antes disso, a vida de um agente estava ligada ao navegador: fechava a aba e o processo em segundo plano que fazia o trabalho era encerrado com ela – uma longa tarefa pela metade que desaparecia em um instante. Esse é um obstáculo fundamental para “fazer com que a IA faça coisas por você ao longo do tempo”: quem lhe entregaria uma tarefa que dura dezenas de minutos e depois não ousaria fechar o laptop ou desligar a rede durante todo o período? O objetivo deste dia foi “desvincular” o agente do navegador, tornando-o um colega de trabalho independente e persistente ao qual você pode retornar a qualquer momento. É uma mudança mental: de “mantenho a janela aberta observando-o conversar” para “entrego o trabalho, faço outras coisas e volto ao resultado”.

Agentes sobrevivem a uma janela fechada e retomam

A essência para fazer esse trabalho é persistir cada tarefa executada em um registro no disco, com um índice. Dessa forma, o processo do agente não depende mais da conexão front-end para permanecer ativo — a desconexão do navegador apenas corta a linha de "observação"; a linha "funcional" continua sendo executada em segundo plano. Quando você reabre, o front-end se reconecta carregando um marcador de "onde vi pela última vez", preenche a saída que você perdeu enquanto estava ausente e, em seguida, retorna à transmissão ao vivo ainda em andamento. Nos testes daquele dia, uma resposta de mais de dez mil caracteres – que só foi gerada depois que você recarrega a página – foi renderizada na íntegra durante a atualização, sem faltar uma palavra. Por trás disso está um design de fluxo de eventos "recuperável": cada evento tem um número de sequência e, na reconexão, ele busca o seu último número em diante, sem perder nada e sem duplicar nada.

Guias de conversa simultâneas, sem crosstalk

Como os agentes agora podem funcionar por muito tempo em segundo plano, naturalmente você poderá abrir vários de uma vez. Hoje em dia, a interface suportava múltiplas abas de conversa: um sinal de adição na parte superior abre uma nova sessão, para que você possa ter um agente executando uma tarefa longa nesta aba enquanto conversa com outro agente sobre algo em outra, sem interromper o outro. A troca de guias não interrompe a execução em segundo plano; o estado e o fluxo de cada um permanecem claramente separados. Para a visão de “uma pessoa liderando uma equipe de IAs”, as guias simultâneas são o ponto de entrada mais intuitivo – transformando “avançar várias coisas ao mesmo tempo” de um conceito em algo que você faz casualmente e abrindo caminho para uma verdadeira colaboração multiagente posteriormente.

Um painel local: visão geral, execuções, sessões, uso

Com tarefas sendo executadas em segundo plano e várias abertas ao mesmo tempo, você precisa de um lugar para pesquisar o todo. Este dia adicionou um painel local no canto superior direito com quatro visualizações: visão geral do panorama geral, tarefas em execução para quem ainda está ativo, sessões para conversas anteriores e análise de uso para consumo. Aqui você pode cancelar ou excluir tarefas e assistir ao fluxo de saída de qualquer tarefa rolar caractere por caractere ao vivo. Seu valor é uma sensação de controle – quando você deixa várias tarefas longas em segundo plano, você precisa de um painel para saber a qualquer momento onde cada uma está, se algo deu errado e quanto custou. Incorporar essa “visão de operações” no produto significa que a plataforma não quer apenas que você “faça uma coisa com IA”, mas leva a sério a realidade de que “você gerenciará muitas coisas ao mesmo tempo”.

Vários backends de codificação, um protocolo, troca a qualquer momento

Mais de um “backend de codificação” pode conduzir um agente, e cada um difere ligeiramente no formato do evento, capacidade e estabilidade. Este dia integrou outro novo back-end e unificou todos eles em um protocolo de fluxo de eventos – qualquer que seja o provedor subjacente, o front-end vê os mesmos eventos ordenados, de modo que a interface e o fluxo são idênticos. O benefício mais prático: quando um está temporariamente indisponível ou com baixo desempenho, você pode mudar para outro com um clique, sem distorção na interface, nas operações ou na experiência. Tornar "qual modelo de back-end" uma escolha conectável transparente para as camadas acima protege os usuários de ficarem presos a um único provedor e permite que a plataforma integre com calma mais e mais back-ends sem reescrever a interface de cada um.

Mecanismo: um vocabulário unificado de identificadores e ativos GUID

O motor fez uma convergência importante em seu “vocabulário conceitual” de baixo nível neste dia. Os ativos receberam identificadores globalmente exclusivos (GUIDs) e um formato de disco endereçado por eles — o que significa que cada ativo tem uma identidade que não pode ser confundida, referenciável com precisão em projetos e cenas. O design do tipo "alça" foi esclarecido ao lado, caracterizando uma referência em duas dimensões para que as referências sejam seguras e claramente expressas. O mecanismo também mudou a "instanciação" de lote automático implícito para declaração explícita: você diz claramente ao mecanismo "este é um lote do mesmo objeto para reunir", tornando o comportamento mais controlável e previsível. Trata-se de engenharia invisível de baixo nível, mas decide se o mecanismo permanece claro e ordenado à medida que o conteúdo cresce e as cenas se tornam complexas - fornecer aos ativos um sistema de identidade confiável é a pré-condição para todas as posteriores "importações, reutilizações e composições".

Jogos armazenados por projeto + correção de atualização de recarga a quente

Este dia também ajustou a forma como o conteúdo do jogo é armazenado: de “publicação unificada” para “cada projeto mantém sua própria cópia”, com os dados do jogo armazenados no próprio diretório daquela instância. Isso é mais intuitivo — seu jogo pertence ao seu projeto, não publicado em algum pool compartilhado. Um problema de recarga a quente há muito tempo foi corrigido: anteriormente, sob certas configurações de proxy, a visualização não era realmente atualizada após a recarga do navegador porque o canal de recarga a quente estava conectado à porta errada; hoje o corrigiu para que "edite e veja" se mantenha constante em todos os caminhos de implantação. Tais ajustes parecem triviais, mas são a garantia subjacente de que “construir enquanto fala” permanece suave o tempo todo.

O que este dia significa

A maior mudança neste dia foi a identidade do agente: não é mais um parceiro de bate-papo que “existe apenas enquanto você assiste”, mas um colega de trabalho em segundo plano que trabalha por muito tempo de forma independente, é pesquisado e gerenciado e pode ser retornado a qualquer momento. Sobrevive a uma janela fechada, é executado simultaneamente, gerenciável por meio de um painel, back-ends trocáveis ​​- juntos, eles levam "a IA fazendo coisas para você" de um cenário de demonstração para uma forma real de trabalhar. Você pode entregar várias tarefas a diferentes agentes ao mesmo tempo, fechar o laptop e fazer outra coisa, depois voltar e aceitá-las uma por uma. É exatamente isso que a plataforma quer ser: não um brinquedo que você deve observar constantemente, mas uma equipe em quem você pode confiar e retornar para coletar. A verdadeira colaboração multiagente que está por vir é construída sobre a base “persistente + simultânea + observável” estabelecida hoje.

← Todas as atualizações diárias