Cierre el navegador: los agentes siguen trabajando
Este día, los agentes pasaron de "una ventana en la que chateas" a "compañeros de trabajo que permanecen mucho tiempo en segundo plano": cerrar la ventana o desconectar la red no los detiene, y la reapertura continúa donde lo dejaste; varias pestañas de conversación se ejecutan simultáneamente sin interferencias; un panel local examina cada tarea; varios servidores de codificación comparten un protocolo y se pueden intercambiar en cualquier momento; y el motor obtuvo un vocabulario unificado de activos de manejo y GUID.
Desde "cierra la ventana y se detiene" hasta "sigue en segundo plano"
Antes de esto, la vida de un agente estaba ligada al navegador: al cerrar la pestaña, el proceso en segundo plano que realizaba el trabajo finalizaba con ella: una larga tarea a medio hacer que desaparecía en un instante. Ese es un obstáculo fundamental para "hacer que la IA haga cosas por usted a lo largo del tiempo": ¿quién le encargaría una tarea que dura decenas de minutos y luego no se atrevería a cerrar la computadora portátil o desconectar la red durante todo el tiempo? La línea de este día fue "desvincular" al agente del navegador, convirtiéndolo en un compañero de trabajo en segundo plano independiente y persistente al que puede regresar en cualquier momento. Es un cambio mental: de "mantengo una ventana abierta para verlo charlar" a "entrego el trabajo, hago otras cosas y vuelvo al resultado".
Los agentes sobreviven a una ventana cerrada y reanudan
La esencia de hacer que esto funcione es conservar cada tarea ejecutada en un registro en el disco, con un índice. De esa manera, el proceso del agente ya no depende de la conexión frontal para mantenerse activo: la desconexión del navegador solo corta la línea de "observación"; la línea "de trabajo" sigue ejecutándose en segundo plano. Cuando vuelve a abrir, la interfaz se vuelve a conectar con un marcador de "dónde vi por última vez", completa la salida que se perdió mientras estaba fuera y luego se reincorpora a la transmisión en vivo que aún fluye. En las pruebas de ese día, una respuesta de más de diez mil caracteres (que terminó de generarse solo después de recargar la página) se mostró en su totalidad durante esa actualización, sin faltar una palabra. Detrás hay un diseño de flujo de eventos "reanudable": cada evento tiene un número de secuencia y, al volver a conectarse, recupera su último número en adelante, sin perder ni duplicar nada.
Pestañas de conversación simultáneas, sin interferencias
Dado que los agentes ahora pueden ejecutarse durante mucho tiempo en segundo plano, naturalmente debería poder abrir varios a la vez. Este día, la interfaz admitía múltiples pestañas de conversación: un signo más en la parte superior abre una nueva sesión, por lo que puede hacer que un agente ejecute una tarea larga en esta pestaña mientras conversa con otro agente sobre otra cosa en otra, sin interrumpir al otro. Cambiar de pestaña no interrumpe la ejecución en segundo plano; El estado y la corriente de cada uno permanecen claramente separados. Para la visión de "una persona liderando un equipo de IA", las pestañas simultáneas son el punto de entrada más intuitivo: convertir "avanzar varias cosas a la vez" de un concepto a algo que se hace de manera informal y allanar el camino para una colaboración real entre múltiples agentes más adelante.
Un panel local: descripción general, ejecuciones, sesiones, uso
Con tareas ejecutándose en segundo plano y varias abiertas a la vez, necesitas un lugar para inspeccionar el conjunto. Este día se agregó un panel local en la parte superior derecha con cuatro vistas: descripción general del panorama general, tareas en ejecución para quién aún continúa, sesiones para conversaciones pasadas y análisis de uso para el consumo. Aquí puede cancelar o eliminar tareas y ver el flujo de salida de cualquier tarea desplazarse carácter por carácter en vivo. Su valor es una sensación de control: cuando has dejado varias tareas largas en segundo plano, necesitas un panel para saber en todo momento dónde se encuentra cada una, si algo salió mal y cuánto costó. Incorporar esta "vista de operaciones" al producto significa que la plataforma no solo quiere que "hagas una cosa con IA", sino que toma en serio la realidad de que "gestionarás muchas cosas a la vez".
Varios backends de codificación, un protocolo, intercambiables en cualquier momento
Más de un "backend de codificación" puede controlar un agente, y cada uno difiere ligeramente en el formato del evento, la capacidad y la estabilidad. Este día integró otro nuevo backend y los unificó a todos bajo un protocolo de flujo de eventos: cualquiera que sea el proveedor subyacente, el front-end ve los mismos eventos ordenados, por lo que la interfaz y el flujo son idénticos. El beneficio más práctico: cuando uno no está disponible temporalmente o tiene un rendimiento deficiente, puede cambiar a otro con un solo clic sin distorsionar la interfaz, las operaciones o la experiencia. Hacer que "qué modelo de backend" sea una opción conectable transparente para las capas superiores protege a los usuarios de quedar bloqueados en un solo proveedor y permite que la plataforma integre tranquilamente más y más backends sin reescribir la interfaz para cada uno.
Motor: un vocabulario unificado de identificadores y activos GUID
El motor hizo hoy una convergencia importante en su "vocabulario conceptual" de bajo nivel. A los activos se les asignaron identificadores únicos globalmente (GUID) y un formato de disco direccionado por ellos, lo que significa que cada activo tiene una identidad que no se puede confundir y a la que se puede hacer referencia con precisión en todos los proyectos y escenas. El diseño del tipo "mango" se aclaró al lado, caracterizando una referencia en dos dimensiones para que las referencias sean seguras y claramente expresadas. El motor también cambió la "creación de instancias" de un procesamiento por lotes automático implícito a una declaración explícita: usted le dice al motor claramente "este es un lote del mismo objeto para dibujar juntos", lo que hace que el comportamiento sea más controlable y predecible. Se trata de ingeniería invisible de bajo nivel, pero deciden si el motor se mantiene claro y ordenado a medida que el contenido crece y las escenas se vuelven complejas; brindar a los activos un sistema de identidad confiable es la condición previa para todo lo posterior "importar, reutilizar y componer".
Juegos almacenados por proyecto + una solución de actualización de recarga en caliente
Este día también ajustó la forma en que se almacena el contenido del juego: desde "publicación unificada" hasta "cada proyecto guarda su propia copia", con los datos del juego viviendo en el propio directorio de esa instancia. Esto es más intuitivo: tu juego pertenece a tu proyecto, no está publicado en algún grupo compartido. Se solucionó un problema de recarga en caliente que persistía desde hacía mucho tiempo: anteriormente, bajo ciertas configuraciones de proxy, la vista previa no se actualizaba realmente después de una recarga del navegador porque el canal de recarga en caliente se conectaba al puerto incorrecto; este día lo solucionó para que "editar y verlo" se mantenga constante en todas las rutas de implementación. Estos ajustes parecen triviales, pero son la garantía subyacente de que "construir mientras se habla" se mantenga sedoso en todo momento.
que significa este dia
El mayor cambio de este día fue la identidad del agente: ya no es un compañero de chat que "existe sólo mientras miras", sino un compañero de trabajo en segundo plano que trabaja de forma independiente durante mucho tiempo, es encuestado y administrado, y al que se puede regresar en cualquier momento. Sobrevive a una ventana cerrada, se ejecuta simultáneamente, es manejable a través de un panel, backends intercambiables: en conjunto, esto impulsa "que la IA haga las cosas por usted" desde un escenario de demostración hacia una forma real de trabajar. Puedes entregar varias tareas a diferentes agentes a la vez, cerrar la computadora portátil y hacer otra cosa, luego regresar y aceptarlas una por una. Esto es exactamente lo que la plataforma quiere ser: no un juguete que debes mirar constantemente, sino un equipo en el que puedes confiar y del que puedes volver a cobrar. La verdadera colaboración entre múltiples agentes que se avecina se basa en la base "persistente + concurrente + observable" establecida hoy.