Guardar y publicar
Esta es la primera regla que hay que entender al usar LoopAgent, y la que más fácilmente se confunde: «Guardar» solo actualiza la versión de depuración (Debug); «Publicar» es lo que actualiza la versión en línea (Online).
La regla fundamental
- Hacer clic en Guardar en la página de ajustes (cambiar el modelo, editar la persona, vincular una base de conocimiento, añadir una herramienta…) → escribe solo en la versión de depuración → el chat de depuración de la derecha surte efecto de inmediato, así que puedes verificarlo enseguida.
- Pero todos los canales externos (Open API, página de compartir, Widget, complemento del sitio web, Telegram, Slack, LiveChat, LiveDesk…) se ejecutan sobre la instantánea de configuración congelada en la última «Publicación».
Sin hacer clic en «Publicar», producción conserva siempre la configuración antigua.
flowchart LR
S[Clic en Guardar] --> DBG[Versión Debug]
DBG --> DC[El chat Debug surte efecto de inmediato]
P[Clic en Publicar] --> PROD[Versión Online]
PROD --> CH[Los canales externos surten efecto]
Pregunta frecuente: «Cambié la configuración / la persona, ¿por qué no ha cambiado producción?» — porque solo guardaste y no publicaste. Para que un cambio surta efecto en producción, tienes que hacer clic de nuevo en Publicar / Release. Un chat de depuración que funciona ≠ producción que funciona.
Si un LoopAgent nunca se ha publicado, los canales externos simplemente darán error y no se ejecutarán en absoluto. Publica siempre una vez antes de conectar por primera vez una API o un canal.
Qué depende de la publicación y qué surte efecto de inmediato
No todo requiere «Publicar» para surtir efecto. Distinguirlos bien ahorra rodeos:
| Objeto | Cuándo surte efecto |
|---|---|
| Persona, límites del bucle, modelo, y los interruptores y vinculaciones de cada capacidad | Con la publicación (forman parte de la configuración del agente, entran en la instantánea de publicación) |
| Habilidades privadas del Agent | Con la publicación (misma lógica que la persona) |
| Habilidades de la organización / de la plataforma | De inmediato y de forma global (al guardar surte efecto para todos los agentes que la referencian) |
| Documentos de la base de conocimiento, datos de eventos clave, valores de atributos de usuario | De inmediato y de forma global (datos de tiempo de ejecución, no configuración) |
En una frase: los cambios de configuración requieren publicar; los cambios de datos / recursos a nivel de organización surten efecto de inmediato.
Chat de depuración
El chat de depuración de la derecha de la página de ajustes sirve para verificar la configuración:
- Lee la configuración de la versión de depuración, que surte efecto justo después de guardar, así que puedes ajustar repetidamente y ver el efecto al instante.
- El chat de depuración es una conversación real y se factura de la misma manera.
- En modo depuración / vista previa no arrastra memoria del historial entre rondas (cada sesión empieza con un contexto limpio), lo cual es normal.
Los mensajes seguidos se fusionan en una sola respuesta
Si envías más mensajes mientras el agente aún está generando, esos mensajes no se pierden. El sistema primero toma un bloqueo de sesión: el mensaje que gana se procesa de inmediato; los que pierden se ponen en cola o se marcan para absorción, y finalmente se fusionan en una sola respuesta. Así que «envié varios seguidos pero solo recibí una respuesta» es por diseño, no un mensaje perdido.
Los mensajes seguidos se gestionan en dos modos: QUEUE (cola) y APPEND (añadir).
QUEUE (cola, el predeterminado)
Los mensajes en cola se fusionan en el límite del mensaje: no se procesan como una nueva ronda hasta que la respuesta actual ha terminado por completo.
- El mensaje ① toma el bloqueo de sesión y se procesa de inmediato, produciendo la respuesta ① por sí solo.
- Los mensajes ② y ③ llegan mientras ① aún se está procesando, no consiguen el bloqueo y entran en la cola.
- Solo después de que ① termine y libere el bloqueo, el sistema ejecuta automáticamente otra ronda, fusionando ② y ③ de una vez en una sola respuesta.
El mensaje ② no tendrá una respuesta propia: este es el punto que más fácilmente se confunde con un «mensaje perdido».
APPEND (añadir)
Los mensajes añadidos no tienen que esperar a que termine la ronda; se absorben en la ronda en curso en la siguiente solicitud al modelo.
- El mensaje ② llega mientras ① aún se está ejecutando y —en lugar de ponerse en cola o esperar a que ① termine— simplemente se marca como «pendiente de absorción».
- Cuando el motor llega a su siguiente bucle y hace una solicitud al modelo, lleva consigo el contenido de ②.
La fusión ocurre en el límite del bucle, antes que en QUEUE: no se crea ningún mensaje nuevo ni aparece ninguna respuesta adicional; el cliente sigue viendo la misma respuesta ①, influida por el contenido «añadido». Esto se adapta a añadidos y correcciones en tiempo real a mitad de ejecución.
Ráfagas multimodales: si los mensajes seguidos entre rondas llevan contenido multimodal como imágenes, archivos o audio, ese contenido se envía al modelo junto con la fusión, siempre que el modelo seleccionado admita la entrada multimodal correspondiente y esa categoría esté habilitada en los ajustes de entrada.
El cuerpo de un único mensaje en cola / añadido está limitado a 8192 caracteres.
