Crear música, narración y efectos sonoros
Crea un borrador instrumental de 30 segundos. Este paso no genera ni cobra.
Abre Configurar acceso. Elige la cuenta fal.ai, permite el modelo de audio y referencias, define límites y habilita agentes con tarea solo si hace falta.
Lee los campos del modelo. Usa dirección para música, Text/Inputs para voz literal y el selector de medios por nombre para referencias autorizadas.
Guarda y Estima. Revisa entradas y reserva USD; después Genera explícitamente. Las unidades desconocidas requieren una estimación explícita; no repitas envíos inciertos.
Espera Completado. Reproduce/descarga el nodo de audio guardado en generated/audio y vincúlalo a una entrada de audio de otro flujo compatible.
Revise la privacidad antes de generar: privado es el valor predeterminado. Elija el enlace de una hora solo si cualquiera con la URL puede acceder al nuevo resultado. Esto no cambia la privacidad de las referencias ni recupera un resultado anterior.
Resultado: Flujos nativos de audio con fal.ai en Canvas y Workbench.
Audiofal.aiMCP
Leer PDF escaneados con OCR local
Importa una factura escaneada con importe y fecha de entrega. Pide al agente: Busca en Segundo cerebro el importe y plazo de esta factura, cita la página y señala incertidumbres del OCR. Compara el pasaje con Abrir original antes de aprobar un pago o plan de entrega. Sustituye el PDF, consulta de nuevo y verifica la nueva revisión.
Resultado: El OCR local permite buscar PDF escaneados a usuarios y agentes.
PDFOCRMCP
Segundo cerebro: conocimiento conectado
Crea un workspace de campaña. Importa el brief PDF y presupuesto XLSX, añade una nota Campaña con [[brief.pdf]] y #lanzamiento y pide: “Busca el presupuesto y plazo en Segundo cerebro, cita la hoja/página y crea un plan.” Cambia una celda y consulta de nuevo para ver la revisión. Tras una tarea rastreada, registra una corrección reutilizable con evidencia, revísala en Aprendizaje de agentes y confirma su consulta en una tarea relacionada.
Resultado: Convierte documentos y trabajo del proyecto en conocimiento reutilizable con fuentes.
PDFXLSXMCP
Elegir un proveedor de vídeo sin cambiar el flujo de imágenes
Abre Imágenes > Flujo de vídeo en Canvas o Workbench. Los borradores existentes siguen usando fal.ai. Crea referencias y storyboards con el flujo existente de la suscripción Codex; esta función no envía la generación de imágenes a otro proveedor.
Resultado: Usa fal.ai, BytePlus ModelArk o Higgsfield con cuentas, contratos y presupuestos separados.
VideoBytePlusHiggsfield
Montar y exportar una secuencia de vídeo
Abre Imágenes > Secuencia de vídeo en Canvas o Workbench. Añade nodos Vídeo del workspace (MP4, WebM o MKV). Instala el codificador una vez desde el nodo: el propietario confirma una descarga separada y versionada de FFmpeg verificada con SHA-256. No requiere Homebrew, clave API ni generación de pago.
Selecciona un clip en la lista vertical. Sube/baja, ajusta entrada/salida, nivel de audio y subtítulo, y Guarda. Quitar un clip solo lo elimina de la secuencia. El hash de origen queda fijado; un archivo modificado o ausente bloquea la exportación. Elige salida horizontal, vertical o cuadrada y 24/25/30 fps. El ajuste conserva todo el contenido con bandas negras, sin recortar ni estirar. Los subtítulos se graban dentro de márgenes seguros del 10%.
Reproducir secuencia muestra los recortes ordenados. Exportar MP4 crea un H.264/AAC en generated/videos/sequences y un nodo Vídeo conectado. Revisa imagen y sonido. La exportación conserva su revisión e indica si es anterior a las ediciones. Exportando no significa entregado; errores e interrupciones quedan visibles. Cancelar detiene el codificador sin cambiar originales. Los temporales propios se eliminan tras éxito/error/cancelación y los directorios abandonados antes de la próxima exportación.
Los agentes usan video_workflow_sequences u orkestrai video sequences con tarea asignada. Lee la revisión antes de apply/export; repite peticiones con timeout usando la misma UUID idempotencyKey. Solo el propietario instala el runtime. Límites: 30 clips, 10 minutos, dimensiones pares de 240 a 1920 por lado, una exportación a la vez, al menos 3 GB libres y salida acotada. Transfiere la secuencia con todos sus nodos de Vídeo originales. Las imágenes Codex ImageGen y la generación fal siguen separadas; esto monta vídeos entregados, no es otro modelo generativo. Usa Pantalla completa en la vista previa para revisar clips verticales y subtítulos a un tamaño legible y volver al mismo editor.
Resultado: Ordena, recorta y subtitula vídeos existentes sin cambiar sus archivos originales.
CreativeVideoSequence
Reutilizar flujos creativos y consultar la cola
Abre Imágenes > Flujos creativos en Canvas o Workbench, o Guardar flujo en el encabezado de un Storyboard. Guardar flujo captura la revisión guardada actual, el orden de escenas, dirección, diálogos, duración y encuadre. Dale un nombre y selecciona opcionalmente un flujo existente para crear una nueva versión inmutable. Los cambios sin guardar no se capturan. video_workflow_recipes también acepta un grupo con exactamente un storyboard: captura ese tablero, no notas, agentes ni automatizaciones independientes. No guarda archivos, historial de ejecuciones, sesiones, credenciales ni permisos de gasto.
En Biblioteca, elige una versión, introduce el brief/guion, la proporción de salida y, opcionalmente, el agente Codex de imágenes. Vincula cada entrada de producto/referencia a una imagen o video del workspace actual y cada personaje a una versión local aprobada. Las identidades coincidentes pueden preseleccionarse por familia, versión y hash exactos. Solo el propietario puede elegir deliberadamente otro personaje aprobado; los agentes deben conservar la identidad guardada. Importa primero el personaje desde su biblioteca si hace falta. El propietario puede reutilizar flujos de otro workspace; los agentes no pueden explorar ni leer otros workspaces.
Crear storyboard editable añade contenido nativo normal con nuevos IDs de escena y sin enlaces a ejecuciones anteriores. El guion sustituye el texto literal {{script}} una sola vez, sin evaluación recursiva; si la dirección no contiene ese marcador, se añade el brief. Un guion requerido vacío o una entrada ausente bloquea la creación. Abre el storyboard, revisa cada escena y prepara los borradores de imagen/video por separado. Las dimensiones de imagen pasan por el flujo Codex existente; la duración y proporción de video deben estar declaradas por el endpoint elegido o la preparación se detiene. La generación, validación de alpha, estimación, presupuesto y gates existentes siguen vigentes.
La Cola de generación actualiza los estados reales de imagen/video del workspace mientras está abierta. Muestra borradores, errores, posición del proveedor, reserva en USD y enlaces a resultados, sin porcentajes inventados. Abrir flujo permite usar sus controles normales de estimación, permisos, revisión y generación. Cancelar usa el ejecutor existente; Reintentar descarga solo recupera un resultado remoto ya creado. Los envíos pagados inciertos no se repiten automáticamente. Tener algunos resultados completos no significa que todo el storyboard terminó. Eliminar una versión guardada nunca elimina los storyboards creados ni sus archivos.
Resultado: Guarda guiones versionados con entradas nombradas y recrea storyboards editables sin copiar permisos de ejecución.
CreativeStoryboardQueue
Planificar escenas en un guion gráfico nativo
Abre Imágenes > Guion gráfico en Canvas o Workbench. Añade una escena y define título, dirección, diálogo, idioma y duración deseada. Selecciona la versión exacta del personaje aprobado y las imágenes/clips de referencia locales; elige un ejecutor Codex para generar imágenes. Guarda antes de cambiar de escena. Duplicar inicia un borrador sin reutilizar enlaces de ejecución. Arrastra las escenas para ordenar o usa Subir/bajar. Eliminar una escena conserva sus flujos y archivos entregados.
Preparar borrador de imagen crea un flujo Codex existente conectado, sin ejecutarlo. Se admiten hasta cinco referencias, incluidas todas las imágenes maestras de los personajes seleccionados; el exceso genera un error explícito, sin descartar referencias. Abre el borrador y usa sus controles normales de generación. Preparar borrador de video crea un flujo fal nativo sin cobrar. Elige un endpoint permitido, vincula todos los personajes y referencias obligatorios, revisa las capacidades reales de duración/audio y usa Guardar > Estimar > Generar. Una duración no admitida se rechaza, nunca se acorta silenciosamente. Preparar la misma escena sin cambios reutiliza su borrador. Para elegir otro, desvincula y vuelve a preparar.
Cambiar una escena marca sus borradores como desactualizados; los resultados permanecen intactos. Las ediciones manuales y video_workflow_storyboards usan el mismo documento con revisión. Las escrituras simultáneas fallan con conflicto; tus cambios locales permanecen visibles hasta descartarlos y recargar. Los guiones copiados conservan los IDs de referencias/personajes ausentes para reparación local explícita; nunca heredan permisos de cuentas. Revisa imagen y sonido reales antes de aprobar. Una referencia de voz aprobada no garantiza que todos los modelos puedan reproducirla.
Resultado: El equipo y el usuario editan el mismo plan de escenas, con borradores, resultados y dependencias ausentes visibles.
StoryboardCodexfal.ai
Compara y aprueba variantes creativas
Abre Comparar y revisar en la cabecera de un nodo Imagen o Video, o en un Storyboard. Mismo flujo limita las miniaturas a resultados relacionados; desactívalo para comparar otros archivos locales. Elige A y B en los selectores con búsqueda o pulsa una miniatura para B. Abrir resultado localiza el nodo original en Canvas.
Los pares de videos comparten reproducción, pausa y búsqueda hasta la menor duración común; alterna el sonido entre A y B. Un video individual usa controles nativos. Las imágenes se ajustan sin recortes. No se pueden aprobar archivos ausentes o que no se puedan reproducir. Compara rostro, vestuario, encuadre, idioma y voz real con las referencias aprobadas; una generación completada no garantiza consistencia.
Escribe comentarios y elige Aprobar, Solicitar cambios o Rechazar. El historial conserva cada decisión, autor, fecha, comentario y huella del archivo. La aprobación vincula los bytes exactos, la procedencia y las versiones congeladas de personajes disponibles. Un archivo modificado invalida la decisión; las revisiones concurrentes requieren recargar. Los agentes usan video_workflow_assets list/inspect/decide y solo pueden proponer una decisión, nunca aprobar su propio resultado. Estas acciones no llaman a fal ni a ImageGen ni consumen créditos.
Resultado: Compara imágenes y videos reales y registra la aprobación de su contenido exacto.
CanvasVideoReview
Crea una nueva dirección desde una imagen
Abre Acciones creativas en la cabecera de un nodo Imagen. Elige Variación, Quitar fondo, Cambiar región o Animar. El original nunca se sobrescribe. Cada acción congela los bytes exactos en generated/creative-actions y conecta una referencia y un flujo nativo nuevo. La procedencia incluye nodo original, hash y contexto de generación.
Variación y Cambiar región admiten dirección y 1–10 resultados. Elige un agente Codex o asígnalo en el flujo creado. Para Cambiar región, arrastra un rectángulo sobre la imagen real o ajusta X, Y, ancho y alto con controles accesibles por teclado. El servidor verifica las dimensiones originales. El rectángulo orienta el prompt; no es una máscara estricta ni garantiza conservar cada píxel exterior.
Preparar borrador no genera ni cobra. Abre el flujo de imagen y usa la suscripción Codex existente; quitar fondo exige transparencia RGBA real y conserva la validación y reparación existentes, sin edición local de píxeles. Animar crea un borrador de video: elige cualquier modelo permitido compatible, asigna la imagen congelada y todos los personajes requeridos, guarda, estima y ejecuta explícitamente. Una referencia congelada ausente o modificada bloquea su uso. Cancelar antes de preparar no crea nada; eliminar el borrador nunca borra el original. Los agentes usan video_workflow_assets command=prepare con expectedDigest verificado y edit.operation; ambas interfaces comparten la validación.
Resultado: Prepara cambios y animaciones conectados sin modificar el original.
ImageGenCanvasVideo
Reutiliza un kit de marca aprobado
Abre Imágenes > Kits de marca en Canvas o Workbench. En Este workspace, nombra el kit, elige colores y valores hexadecimales, añade imágenes de logotipo/producto/estilo y escribe el brief, el tono y las reglas de uso. Los recursos deben ser archivos PNG, JPEG o WebP locales; exporta primero los logotipos vectoriales mediante Design. Guarda el borrador antes de aprobar.
Resultado: Versiona paletas, logotipos, productos y reglas creativas y coloca los recursos exactos en cualquier workspace.
BrandCanvasCreative
Dirigir el encuadre y el movimiento de cámara
Abre una escena del Storyboard o un Flujo de vídeo y usa Dirección de cámara. Elige encuadre, ángulo, movimiento y ritmo. Los controles persisten en la escena y su borrador de vídeo; los borradores de imagen reciben encuadre y ángulo, sin movimiento de cámara.
Resultado: Guarda la dirección de cada escena sin perder referencias ni vínculos de voz.
videocreative
Convertir un brief en video
Crea un director Codex, un brief de escena y un flujo de imágenes. La herramienta image_gen.imagegen existente genera las referencias del personaje/storyboard; fal.ai no genera imágenes. Ejecuta el flujo Codex existente. Espera dos Imágenes validadas y revisa personaje y escena. Aprueba la identidad visual antes de solicitar un video de pago; las imágenes rechazadas no son referencias maestras. Crea un borrador de video de cinco segundos sin contactar fal ni gastar créditos. Los siguientes pasos vinculan el personaje y las referencias aprobadas antes de generar. Abre Configurar acceso, guarda la clave en la bóveda y abre Permisos del workspace. Habilita el workspace, el envío de referencias y Permitir que agentes con tareas generen videos al delegar. La autorización se aplica por workspace y cuenta a todos los nodos de vídeo permitidos, sea el agente Claude o Codex. Elige modelos y límites de reserva y pulsa Guardar. No se autorizan automáticamente nuevos modelos ni otros workspaces. Abre Biblioteca de personajes en el nodo de video. Guarda apariencia y rutas de imágenes aprobadas; elige un audio aprobado del workspace o un ID de voz existente con su cuenta y endpoints compatibles. Define idioma y estilo. Guarda, revisa y usa Aprobar y bloquear. Los cambios posteriores requieren Nueva versión; los agentes no pueden aprobar ni sobrescribir versiones bloqueadas. Abre el menú Imágenes, elige Personajes y arrastra un personaje aprobado a un área vacía del Canvas de destino o usa Añadir al Canvas. La biblioteca se comparte entre workspaces locales. Orkestrai copia todas las imágenes bloqueadas y la muestra de voz, conserva versión y hash, y crea una Nota de identidad e Imágenes de referencia agrupadas sin modificar el origen. Los IDs de voz conservan su cuenta original, pero nunca se copian credenciales ni permisos del workspace. Workbench ofrece la misma biblioteca y Añadir al Canvas. Los agentes pueden colocar personajes locales aprobados; importar desde otro workspace requiere al usuario. Selecciona un endpoint autorizado de referencia a video, como Seedance 2.5, vincula la versión bloqueada del personaje y asigna sus imágenes y voz a los campos del modelo. Incluye diálogos y dirección sonora, activa audio nativo y define duración. Guarda, estima, revisa datos y reserva, y genera. Las voces incompatibles o referencias modificadas se bloquean antes de cobrar. Espera Completado, reproduce el nodo Video y descarga el original. Revisa la salida en generated/videos. Reintentar descarga reutiliza el resultado remoto sin generar de nuevo. Los flujos de imágenes existentes con Codex no cambian. Compara rostro, proporciones, vestuario y voz con las referencias bloqueadas. Generado no significa consistencia aprobada; los clips separados no se editan automáticamente como película. Elige el personaje aprobado por nombre: la escena muestra imágenes maestras y muestra de voz y asigna todas las referencias a entradas convencionales declaradas por el modelo. No se descarta ninguna referencia para ajustarse. La asignación avanzada sigue disponible para contratos diferentes. Escribe @ en Dirección o usa Insertar referencia de personaje para insertar un nombre guardado como @{nombre}; permanece vinculado al ID exacto de la versión. Eliminar un personaje citado o usar un nombre desconocido bloquea la generación, sin cambiar el sujeto silenciosamente. Los agentes pueden solicitar la misma asignación conservadora con video_workflow_characters command=binding y la configuración actual.
Guarda el historial de aprobación, nombres de proveedores, atribución e información interna en Notas de producción; permanecen en el personaje y no se añaden al prompt. Apariencia y estilo vocal son instrucciones enviadas al modelo: incluye solo rasgos visibles, acento, timbre y ritmo, sin comentarios internos ni diálogo. Escribe las frases en la dirección de la escena. Revisa el prompt efectivo y escucha el clip; separar instrucciones no garantiza que el modelo las respete. Crea una nueva versión para corregir notas mal ubicadas en un personaje bloqueado.
Arrastra uno o varios archivos MP4, M4V, MOV, WebM o MKV (hasta 64 MB cada uno) a un área vacía del Canvas. Cada archivo se convierte en un nodo de Vídeo separado en el lugar del drop, con su nombre original y controles de reproducción; no es un documento de conocimiento. Orkestrai copia el original sin cambios a .orkestrai/media/videos en el proyecto. En un flujo de vídeo, añade una Entrada multimedia del workspace, elige un campo compatible con vídeo y selecciona el nodo por su nombre. Los agentes usan el mismo nodo/ruta. Importar no genera ni envía nada al proveedor; los controles de consentimiento, cuenta y presupuesto se aplican al ejecutar el flujo. El soporte de contenedores y códecs varía: si la reproducción local no está disponible, descarga el original; siguen vigentes los límites de referencias de cada proveedor.
Entrega de video editado: pide al agente que añada renders/final.mp4 al Canvas. Con una tarea asignada usa video_workflow_import con input.path y title/expectedSha256 opcionales, o orkestrai video import --task <taskId> --input '{"path":"renders/final.mp4","title":"Montaje final"}'. Archivos MP4/M4V/MOV/WebM/MKV existentes de hasta 256 MiB se convierten en nodos de Video sin copiar, transcodificar, subir a proveedores ni generar de nuevo. Reintentar reutiliza el nodo existente en el mismo piso. Los renders de montaje local no necesitan clave de proveedor ni autorización de generación pagada. Archivos fuera del proyecto configurado requieren un alias de repositorio aprobado por el usuario; se rechazan rutas absolutas, recorrido de directorios y enlaces simbólicos hacia fuera. Siguen vigentes los límites de tamaño/codec de referencias de proveedores. Eliminar el nodo conserva el archivo original y no autoriza reutilización automática. El agente debe comprobar el id devuelto antes de declarar la entrega. orkestrai list y video_workflow_list muestran la carpeta real del proyecto (workingDir en el host, wslWorkingDir en WSL). Briefings, prompts, assets, proyectos de montaje, renders y exportaciones finales van allí salvo que elijas explícitamente otro destino. Un cd en la terminal o arrastrar un archivo de otra carpeta no cambia el workspace. Si el proyecto difiere, resuelve la discrepancia antes de generar; no escribas silenciosamente en un antiguo workspace de pruebas.
Resultado: Generación opcional de vídeos con fal.ai en el Canvas y Workbench existentes.
fal.aiCanvasMP4
Respuestas automáticas a una conversación autorizada
Autoriza una conversación una vez y deja que su agente responda sin confirmaciones por mensaje ni clics elegidos por el modelo.
Resultado: La primera observación establece una referencia. Los nuevos mensajes recibidos y observados entran en una cola local persistente, incluso mientras el agente está ocupado. El intervalo corto configurado agrupa preguntas consecutivas. El evento incluye grantId, batchId, inReplyToDigest y TODOS los mensajes del lote. El agente lee en orden, separa temas y responde cada pregunta usando computer_reply con esos campos, targetId, taskId, idempotencyKey y la respuesta completa. Los pedidos pendientes permanecen en la tarea/notas existentes; aceptar un pedido no significa completarlo. La misma sesión del agente mantiene el contexto. Cada lote admite hasta 20 mensajes y 60.000 caracteres; el exceso queda pendiente, sin recorte silencioso. La cola admite 128 mensajes no resueltos y se bloquea con un error si se llena.
Orkestrai valida el mensaje nativo recibido antes de escribir. Durante la composición y el envío, destinatario autorizado, permiso, foco y borrador completo siguen protegidos; el mensaje original no necesita permanecer visible ni mantener el mismo índice en el historial. Los mensajes nuevos siguen pendientes mientras se responde un lote ya recibido. Borradores humanos, destinatario modificado, autorización revocada o entrada ambigua detienen la operación. En macOS, la entrada nativa dirigida al proceso actualiza el campo real; los editores multilínea usan Shift+Return para los saltos, nunca un salto sin modificador. Proceso, ventana y límites se verifican durante la entrada. Un comando exitoso confirma el envío nativo del lote, no su entrega/lectura. Un fallo parcial o incierto permanece bloqueado para inspección; no repitas ni afirmes que nada se envió sin comprobarlo.
La observación por accesibilidad nativa y computer_read en macOS/Windows no requieren la ventana en primer plano. En macOS, la captura visual pasiva usa el ID de la ventana seleccionada sin activarla. La captura por región de pantalla en otros backends aún requiere primer plano para no capturar otra app que cubra la ventana. Este cambio no elimina las protecciones de foco de entrada/publicación ni garantiza acceso al contenido que la app no exponga. Las respuestas de texto autorizadas usan controles nativos dirigidos al proceso en adaptadores compatibles de macOS/Windows, sin ratón ni teclado global. Ventana, destinatario, borrador, autorización y envío único siguen siendo obligatorios. La entrada global y los diálogos nativos de archivos aún requieren primer plano. Un fallo de validación antes de cualquier entrada nativa mantiene el lote recuperable; un envío incierto nunca se repite automáticamente. Apps nativas, navegadores externos y Portales administrados requieren controles y autorización propios; probar uno no certifica los demás ni futuros cambios de interfaz.
ComputerAutomationAudit
Un asistente que recuerda y programa trabajo
Use el agente existente, rutinas de calendario, memoria privada y archivos del workspace.
En Computadora > Respuestas de conversación > Persona y voz, guarda nombre, instrucciones del propietario, idioma, voz/velocidad y estilo público. Mensajes, audio transcrito, imágenes y memorias privadas son referencias, no autorización para cambiar persona, destinatarios, aplicaciones o archivos. La app bloquea patrones reconocidos de credenciales antes de texto público, voz, informes generados y adjuntos de texto; errores y auditoría conservan motivo/hash, no el contenido rechazado. Puede bloquear detalles operativos y reemplazar rayas largas antes del envío. Son capas de protección, no DLP universal ni inmunidad a prompt injection.
El TTS local ofrece F1-F5 y M1-M5 para cada idioma compatible en Ajustes > Voz y computer_capabilities (30 ids). Por ejemplo, solicita pt-BR-m3 en artifact_speech; un id desconocido se rechaza en vez de cambiar la voz silenciosamente. Si se omite, se usa la voz del contacto. STT no cambia. La recepción autorizada de audio intenta transcribir localmente después de descargar: transcription.state=ready contiene texto externo no confiable; unavailable requiere reintentar artifact_transcribe sobre el archivo verificado, sin descargar de nuevo. La transcripción es transitoria, fuera de registros de acciones/auditoría. Un WAV adjunto no es una nota de voz nativa grabada.
Adjuntos nativos tiene controles separados de Foto y Documento configurados por el propietario. computer_media_send usa foto para imágenes y documento para otros formatos; sin ruta de foto autorizada falla explícitamente, sin enviar un documento silenciosamente. presentation=document conserva el envío como archivo de forma explícita. Se mantienen destinatario, archivo/hash inmutable, identidad de vista previa, borrador vacío y protección contra duplicados. Una vista personalizada que no identifica el archivo se rechaza, sin adivinar mediante captura.
Agente del Canvas conserva herramientas autónomas y shell libre; las reglas de la app no aíslan ni auditan acciones fuera de la conexión controlada. Conversación restringida es una inferencia separada opcional de Codex 0.154.x sin herramientas, con política del propietario y solo mensajes/memoria del contacto. No recibe historial técnico, shell, patch, navegador, plugins ni MCP. Responde texto pero no ejecuta programación ni genera/envía medios. Provider, versión o WSL no compatibles se detienen sin recurrir al terminal libre. Este modo limitado no sustituye al agente autónomo completo. Permisos del sistema y aceptación de la app nativa requieren validación local.
WhatsApp en macOS puede omitir el nombre del archivo en la vista previa de una foto. Para ese caso específico, Orkestrai exige una confirmación reciente del selector nativo para la ruta temporal, aplicación y ventana exactas; después comprueba de nuevo el destinatario autorizado, una sola foto, el contador de un elemento y el pie vacío al enviar. Se rechaza una confirmación de otro archivo/ventana o una vista no verificada. Esto no relaja las comprobaciones de Documento ni convierte el envío solicitado en confirmación de entrega.
Una decisión de no responder también debe resolver su lote despachado de entrada. Tras leer todos los mensajes, el agente usa computer_inbox_acknowledge con batchId/inReplyToDigest exactos y el motivo already_answered o no_response_needed. La decisión queda auditada como skipped con sent=false, no como respuesta entregada. Las nuevas llegadas pendientes se conservan y pueden continuar inmediatamente; otro contacto/tarea, un envío incierto o un lote ya respondido no pueden liberarse de esta manera. Decir solamente en el terminal que no hace falta responder deja la cola pendiente.
En Computer > Respuestas en la conversación, habilita Foco temporal para enviar y Buscar y reabrir este contacto automáticamente para autorizar la navegación nativa en macOS. Si se selecciona otro chat, el monitor busca al destinatario exacto y verifica la cabecera antes de leer mensajes. La preparación del envío repite la comprobación si la selección cambió mientras el agente redactaba la respuesta. computer_open_conversation ofrece la misma operación limitada al agente asignado; no requiere búsqueda manual ni capturas repetidas. Navegar nunca escribe en el campo de mensajes ni envía, y tiene auditoría separada. Contactos duplicados ambiguos, controles no compatibles, permisos revocados y cabeceras no verificadas siguen bloqueados en vez de seleccionar otra persona. El monitor en segundo plano requiere el equipo despierto y la aplicación autorizada abierta.
Resultado: Las solicitudes largas siguen siendo trazables después del acuse de recibo. Habilite recordatorios y resultados para ese contacto exacto para permitir computer_send sin un nuevo mensaje recibido. Exige una tarea asignada o ejecución de automatización como origen, deduplica ese origen tras reinicios y usa las mismas verificaciones de foco, destinatario, borrador vacío, límite horario y riesgo. Cambiar permisos entre escribir y enviar detiene la publicación. Los mensajes recibidos nunca autorizan nuevos contactos, aplicaciones, archivos ni compras. Despachar una rutina o vaciar el campo de texto no prueba la entrega del informe.
ComputerAutomationMemory
Monitorear una app de escritorio con almacenamiento limitado
El modo automático prefiere texto de accesibilidad nativa sin capturas PNG. Usa computer_read y computer_interact con condiciones para controles conocidos; conserva destinatario, borrador completo y gate de publicación. El panel muestra la fuente real y el tiempo local. Las interfaces sin soporte usan la alternativa visual. La latencia del proveedor es adicional.
En macOS, abre Computadora > Respuestas de conversación y activa Foco temporal para enviar para el contacto exacto. Está desactivado por defecto y solo el usuario puede cambiarlo. computer_reply y computer_send pueden traer la ventana autorizada al frente durante la composición y el envío protegidos. La escritura, los clics recientes o modificadores pulsados aplazan la entrada. Se restauran la aplicación y la ventana anteriores, salvo que el usuario haya cambiado el foco; no se adivinan destinos cerrados o reemplazados. Un fallo de restauración se audita sin repetir el mensaje. La observación continúa en segundo plano. Esta autorización cubre el envío de texto, no los diálogos de archivos ni el control irrestricto del escritorio; siguen vigentes los permisos, las aprobaciones de publicación y la recuperación de envíos inciertos.
Resultado: El modo automático prefiere texto de accesibilidad nativa sin capturas PNG. Usa computer_read y computer_interact con condiciones para controles conocidos; conserva destinatario, borrador completo y gate de publicación. El panel muestra la fuente real y el tiempo local. Las interfaces sin soporte usan la alternativa visual. La latencia del proveedor es adicional.
La observación por accesibilidad nativa y computer_read en macOS/Windows no requieren la ventana en primer plano. En macOS, la captura visual pasiva usa el ID de la ventana seleccionada sin activarla. La captura por región de pantalla en otros backends aún requiere primer plano para no capturar otra app que cubra la ventana. Este cambio no elimina las protecciones de foco de entrada/publicación ni garantiza acceso al contenido que la app no exponga. Las respuestas de texto autorizadas usan controles nativos dirigidos al proceso en adaptadores compatibles de macOS/Windows, sin ratón ni teclado global. Ventana, destinatario, borrador, autorización y envío único siguen siendo obligatorios. La entrada global y los diálogos nativos de archivos aún requieren primer plano. Un fallo de validación antes de cualquier entrada nativa mantiene el lote recuperable; un envío incierto nunca se repite automáticamente. Apps nativas, navegadores externos y Portales administrados requieren controles y autorización propios; probar uno no certifica los demás ni futuros cambios de interfaz.
ComputerAutomationAudit
Empleado 24/7 (vigía de tareas)
Activa Ejecutar Orkestrai en segundo plano en Configuración → Autonomía y Core 24/7, configura la terminal vigilante como Persistente en Runtime del agente y define límites de concurrencia y uso del provider. Luego crea una rutina cada 1–5 minutos en el líder: "verifica el tablero (orkestrai task list); asigna lo que esté sin dueño; si falta agente, recluta". Cerrar la ventana mantiene el proceso supervisado y las ejecuciones duraderas en la bandeja; Salir de Orkestrai los detiene explícitamente.
Resultado: 24/7 significa que el Core activo espera eventos o programaciones futuras, no que el modelo piensa continuamente. Por ejemplo, programa una consulta de bandeja cada 15 minutos, prepara un informe y exige aprobación para enviarlo. Cada ejecución termina y el próximo disparador inicia otra. Mantén el equipo despierto, el Core activo, credenciales válidas y cuota disponible del provider; la suspensión y el apagado detienen la ejecución local. Cerrar la ventana es distinto de Salir de Orkestrai. Revisa el historial y las aprobaciones en lugar de asumir que un terminal persistente garantiza trabajo terminado.
Core 24/7Rutinastask assign
Ejecuta una tarea autenticada del navegador con el Canvas cerrado
Agrega y nombra un Portal, abre Navegador administrado, conserva un perfil del workspace y permite solo los hosts necesarios. Inicia sesión tú mismo en el Portal visible y crea una automatización programada de Navegador administrado. Los agentes usan referencias de portal_snapshot y acciones tipadas, nunca selectores o contraseñas; el Core conserva el perfil, confina archivos y registra cada efecto en Control Center con la ventana cerrada.
Resultado: 24/7 significa que el Core activo espera eventos o programaciones futuras, no que el modelo piensa continuamente. Por ejemplo, programa una consulta de bandeja cada 15 minutos, prepara un informe y exige aprobación para enviarlo. Cada ejecución termina y el próximo disparador inicia otra. Mantén el equipo despierto, el Core activo, credenciales válidas y cuota disponible del provider; la suspensión y el apagado detienen la ejecución local. Cerrar la ventana es distinto de Salir de Orkestrai. Revisa el historial y las aprobaciones en lugar de asumir que un terminal persistente garantiza trabajo terminado.
Portal administradohandoff de autenticaciónnavegador auditado
Autoriza un agente autónomo sin aprobar cada paso
Abre Automatizaciones → Seguridad, activa Autónomo con límites y concede solo raíces, capacidades, destinos y horario necesarios; conserva las acciones destructivas y externas detrás de gates explícitos. Agrega cuentas OAuth mediante su pantalla oficial de consentimiento o guarda una credencial de API en la Bóveda cifrada con vínculos exactos de conector, operación y destino. El agente podrá leer correos, preparar informes, generar PDFs en el workspace, operar un Portal autenticado y enviar notificaciones aprobadas por Slack, Telegram, WhatsApp o email sin ver el secreto bruto ni pedir permiso para el trabajo rutinario. Revisa gates pendientes y exporta la auditoría encadenada cuando quieras; la Parada de emergencia revoca ejecuciones futuras y aborta las actuales.
Resultado: 24/7 significa que el Core activo espera eventos o programaciones futuras, no que el modelo piensa continuamente. Por ejemplo, programa una consulta de bandeja cada 15 minutos, prepara un informe y exige aprobación para enviarlo. Cada ejecución termina y el próximo disparador inicia otra. Mantén el equipo despierto, el Core activo, credenciales válidas y cuota disponible del provider; la suspensión y el apagado detienen la ejecución local. Cerrar la ventana es distinto de Salir de Orkestrai. Revisa el historial y las aprobaciones en lugar de asumir que un terminal persistente garantiza trabajo terminado.
Política permanenteSecretRefgates de aprobación
Recibe un informe autónomo por email o chat
Abre Automatizaciones -> Integraciones y agrega solamente la cuenta necesaria. Concede operaciones de lectura para la fuente y una operación explícita de envío para el destino; luego vincula la cuenta a una política de autonomía limitada. Crea un agente Persistente o Bajo demanda y una Automatización programada que reúna los datos autorizados, escriba el informe o PDF dentro del workspace y llame integration_execute con una clave de idempotencia estable. Gmail y Telegram adjuntan archivos del workspace directamente; Slack envía mensajes a canales y WhatsApp envía mensajes o un enlace HTTPS aprobado al documento. El historial y la auditoría encadenada conservan actor, operación, destino, estado y metadatos seguros sin guardar credenciales ni el contenido completo del mensaje.
Resultado: 24/7 significa que el Core activo espera eventos o programaciones futuras, no que el modelo piensa continuamente. Por ejemplo, programa una consulta de bandeja cada 15 minutos, prepara un informe y exige aprobación para enviarlo. Cada ejecución termina y el próximo disparador inicia otra. Mantén el equipo despierto, el Core activo, credenciales válidas y cuota disponible del provider; la suspensión y el apagado detienen la ejecución local. Cerrar la ventana es distinto de Salir de Orkestrai. Revisa el historial y las aprobaciones en lugar de asumir que un terminal persistente garantiza trabajo terminado.
Centro de integracionesinformes programadosBóveda cifrada
Convierte una operación repetida en una herramienta reutilizable
Agrega Tool Workshop y crea un borrador con contrato tipado de entrada y salida, timeout, límite de salida y por lo menos una fixture. Usa una integración conectada para Gmail, Slack, Telegram, WhatsApp o GitHub; HTTP para una API aprobada y limitada; Transformación para organizar datos de forma determinista; o Comando del workspace para un ejecutable confinado con argumentos explícitos. Guarda credenciales en Seguridad como SecretRefs vinculadas a Tool Workshop, a tool:<slug> y al destino exacto. Ejecuta la prueba seca, revisa manifiesto y revisión y luego publícala personalmente. Los agentes con tareas activas asignadas pueden proponer revisiones posteriores y ejecutar la publicada, mientras las automatizaciones llaman la misma herramienta con idempotencia estable. Un borrador propuesto no reemplaza silenciosamente el comportamiento en producción, y el historial más Auditoría muestran quién llamó qué revisión sin retener secretos.
Resultado: 24/7 significa que el Core activo espera eventos o programaciones futuras, no que el modelo piensa continuamente. Por ejemplo, programa una consulta de bandeja cada 15 minutos, prepara un informe y exige aprobación para enviarlo. Cada ejecución termina y el próximo disparador inicia otra. Mantén el equipo despierto, el Core activo, credenciales válidas y cuota disponible del provider; la suspensión y el apagado detienen la ejecución local. Cerrar la ventana es distinto de Salir de Orkestrai. Revisa el historial y las aprobaciones en lugar de asumir que un terminal persistente garantiza trabajo terminado.
Tool Workshopherramientas versionadasSecretRef
Automatiza una aplicación instalada en el equipo
Pide al agente: "Abre Calculadora, calcula 73 por 19 y verifica el resultado en pantalla." Crea la nota, tarea asignada y nodo Computadora, reutiliza la app autorizada, captura evidencia de 1387 y registra el resultado. Tú concedes acceso del sistema y el límite de workspace/app, no cada clic habitual. Desde Remote envía el mismo pedido por Equipo o el chat del líder. Para consultar correo ya abierto en Chrome del escritorio, pide reutilizar esa ventana y cuenta. Enviar correo requiere el riesgo declarado external_publication y su gate configurado; los desafíos de acceso quedan con el usuario. El escritorio host debe estar disponible. Comprueba nota, tarea, captura y auditoría reales, no solo un mensaje de éxito.
Resultado: Confirma 1387 en la captura real de Calculadora, la nota y la tarea completada. El nodo actualiza la evidencia del agente. Auditoría registra operaciones de la puente; omite el texto escrito y las capturas nativas pueden mostrar contenido privado visible.
Nodo Equipoautomatización de escritorioapps permitidas
Campaña y lanzamiento
Entrega el briefing a un líder de campaña y conecta investigación de audiencia, estrategia, copy, diseño y aprobación en un solo canvas.
Resultado: Una campaña con responsables, entregables y revisiones visibles desde el concepto hasta la publicación.
MarketingCampañaAprobación
Sistema de marca y diseño
Organiza dirección creativa, referencias, imágenes, accesibilidad y revisión de consistencia como un equipo especializado.
Resultado: Decisiones visuales documentadas y artefactos conectados con quienes crean y revisan.
DiseñoMarcaImágenes
Crear un personaje, aplicar la marca y entregar un carrusel
El caso de uso guiado monta la cadena Personaje → Marca → Carrusel mientras avanzas: crea un Director Creativo Codex, briefs, un logo PNG de prueba y los tres workflows, ejecutando cada generación real sin montaje manual ni clave de API.
Resultado: Cada etapa avanza solo después de persistir y validar sus resultados; el resultado elegido se conecta automáticamente como referencia de la siguiente etapa, con archivos y procedencia visibles en el canvas.
Codex ImageGenPersonaje y marcaCarrusel guiado
Comparar tres direcciones completas de UI
Convierte un objetivo en documentos Diseño nativos y vinculados de Claridad, Expresiva y Eficiente, todos con el mismo contrato completo de entrega.
Resultado: Diseños responsivos, tokens tipados, componentes, prototipo, evidencia de calidad y código se comparan antes de la aprobación humana de la implementación.
Exploración de UIDiseño + códigoAprobación humana
Contenido y SEO
Coordina investigación, pauta, redacción, edición y distribución mediante etapas personalizadas del kanban.
Resultado: Un pipeline editorial completo, con contexto preservado y aprobación humana.
ContenidoSEOKanban
Comenzar sin conocer la terminal
Usa cualquier provider que ya tengas instalado; Orkestrai detecta la CLI, conserva la conversación y presenta todos los agentes en el mismo flujo visual.
Resultado: Vibe coders, diseñadores, marketers y equipos de producto trabajan por objetivos, no por comandos.
9 providersSin terminalMultidisciplinar
Una barra adaptada a tu rutina
Elige cualquier servicio compatible desde un menú Agentes compacto y fija hasta cuatro favoritos listos en el orden que prefieras.
Resultado: Los agentes que más usas quedan a un clic en todos los workspaces y reinicios sin ocultar los demás.
Menú AgentesFavoritosPersistente
Delegación que respeta las cuotas
Mantén el uso de Claude, Codex y Kimi en el canvas y configura origen, fallback, ventana de 5 horas/semanal/mensual y límite compartidos con el líder.
Resultado: El trabajo nuevo va a un provider saludable sin mover silenciosamente tareas que ya están en curso.
UsoFallbackLíder
Una interfaz que encaja con tu entorno
Elige tres temas oscuros o uno claro y luego duplica y edita tokens semánticos con vista previa inmediata.
Resultado: Un tema personal consistente que se puede exportar y reutilizar en otra instalación.
TemasTokensImportar/exportar
Reemplazar un agente sin reconstruir el equipo
Cambia el provider desde el encabezado y conserva nombre, rol, estado Maestro, piso, posición y conexiones.
Resultado: Mueve una responsabilidad de Claude a Codex, Kimi u otra CLI instalada sin recrear el equipo.
ProvidersRolesContinuidad
Equipo de desarrollo con líder
Entrega el briefing a un líder. Propone el equipo, recluta especialistas, conecta el contexto y distribuye el backlog.
Resultado: Una feature avanza de la planificación a la revisión sin copiar mensajes entre terminales.
LíderKanbanMultiagente
Features paralelas sin colisiones
Separa cada frente en un piso con su propia rama y worktree mientras ambos equipos permanecen activos.
Resultado: Trabajo simultáneo con vista previa de diff y conflictos antes del merge.
PisosGitParalelismo
QA visual de la aplicación
Nombra cada Portal según su flujo y conecta el navegador correcto con el revisor para navegar el dev server, leer el DOM, ejecutar verificaciones y capturar screenshots. Los enlaces que solicitan otra pestaña permanecen visibles como un segundo nodo Portal junto al origen.
Resultado: Problemas visuales reproducidos y documentados en el contexto de la tarea sin salir del Canvas para pestañas comunes.
PortalScreenshotQA
Convertir contratos API en un flujo ejecutable del equipo
Importa OpenAPI, Swagger, OpenCollection, Bruno o Postman; prepara solicitudes HTTP, GraphQL, WebSocket o gRPC; luego ejecuta y sincroniza manualmente o mediante un agente conectado.
Resultado: Contratos, solicitudes ejecutables, evidencia estructurada de respuestas, estado portable, tareas y equipo responsable permanecen visibles en un workspace.
Cliente de APIMultiprotocoloMCP
Pipeline con aprobación humana
Encadena implementación, revisión y un paso de aprobación que pausa el flujo hasta tu decisión.
Resultado: Automatización donde el criterio importante permanece bajo control humano.
FlujosAprobaciónHistorial
Revisión cruzada entre providers
Claude implementa, Codex revisa y el veredicto regresa por la conexión entre ambos.
Resultado: Cambios evaluados por modelos diferentes antes de la entrega.
ClaudeCodexReview
Del diseño al código validado
Importa Figma mediante el MCP oficial o trabaja directamente en el Design Studio nativo, mapea componentes reales, genera código del framework y compara el resultado con un Portal o dispositivo móvil.
Resultado: Fuente visual editable, implementación, evidencia de píxeles, feedback en Kanban y revisión Git permanecen conectados en una entrega trazable.
Design StudioGeneración de códigoDiff visual
Prototipa un flujo de producto con agentes
Conecta frames, overlays, desplazamiento, modos de variables y motion en el documento Diseño nativo y pide a un agente diseñador o líder que inspeccione y refine la misma revisión.
Resultado: Un prototipo de solo lectura comprobable, tokens de motion reutilizables, animación lista para implementar y una fuente trazable para personas y agentes.
PrototipoMotionAgentes
Revisa una propuesta visual antes de cambiar la fuente
Sigue a un diseñador en vivo, ancla feedback a la capa exacta y pide a un agente una propuesta versionada con diff estructural en vez de una edición inmediata.
Resultado: Comentarios, autoría, propuestas de agentes, perspectivas de Council, variantes en Pisos y la decisión humana final permanecen vinculados al mismo documento Diseño.
Presencia en vivoPropuestas visualesAprobación humana
Ejecuta un gate de calidad visual antes de implementar
Abre Calidad en el documento Diseño nativo o pide a un agente conectado que lo audite antes de generar código.
Resultado: Los problemas de nombres, recortes, superposición, contraste y accesibilidad señalan capas editables exactas, mientras el backup automático y el historial mantienen reversible la corrección.
Calidad de diseñoWCAGRecuperación
Observar un agente en tu navegador autenticado
Crea un Portal con nombre, abre el sitio e inicia sesión privada o pide al agente usar una cuenta de prueba autorizada. El equipo tiene acceso Leer e interactuar por defecto, sin seleccionar cada agente. Mantén desactivado el segundo plano. Para este ejemplo de automatización con protección adicional, activa opcionalmente Delimitado en Automatizaciones > Seguridad, autoriza el host y las categorías necesarias y conserva aprobación para envíos o acciones destructivas. El uso interactivo normal del Portal no requiere esta configuración. Asigna una tarea para leer la página, rellenar un campo no sensible y preparar un informe sin enviarlo. Observa los cambios en la misma página. Revisa el envío pendiente en Seguridad > Controles, apruébalo y reanuda la misma ejecución o espera a la automatización. Expande Auditoría y Taller > Ejecuciones para consultar los pasos completados. Pausa el Portal para probar la revocación. Habilita el segundo plano solo cuando lo desees y sigue el historial y la auditoría.
Resultado: Los agentes controlan la misma página nativa visible del Portal, con permisos por agente, modos lectura/interacción, segundo plano opt-in, pausa inmediata, capturas protegidas, rechazo de referencias antiguas y sin scripts arbitrarios. Agentes preautorizados publican herramientas delimitadas de navegador/integración/HTTP/transformación; la reanudación conserva checkpoints y revisión. La UI detalla auditoría, webhook local y parada de emergencia persistente.
24/7PortalTool Workshop
Centinela de tests y deploy
Una rutina ejecuta tests, abre tareas cuando algo falla y envía una notificación nativa.
Resultado: Los fallos llegan al equipo convertidos en trabajo accionable.
RutinasTestsNotificación
Operación por voz
Elige y prueba el micrófono y altavoz de la app, dicta en cualquier campo activo, envía con Enter en terminales cuando lo desees o dirige la transcripción al líder. La respuesta puede reproducirse localmente.
Resultado: Escritura y delegación rápidas en pt-BR, en-US o español latinoamericano con ruteo de audio predecible.
DictadoDispositivos de audioTTS local
Servidores de desarrollo bajo control
Asocia Portales con servicios locales y detén listeners olvidados desde el panel Puertos.
Resultado: Puertos liberados con alcance y confirmación, sin finalizar procesos arbitrarios.
PuertosPortalSeguridad
Un workspace enfocado para entregas complejas
Pasa del Canvas al Workbench, abre archivos, agentes, salida de terminal, vistas previas, revisiones y uso en paneles redimensionables y conserva todas las sesiones vivas.
Resultado: Una superficie de trabajo de escritorio sin perder la orquestación visual ni duplicar sesiones de agentes.
WorkbenchMonacoOcho paneles
Llevar una pregunta de código hasta el trabajo asignado
Encuentra un símbolo en el grafo nativo, explica sus relaciones, compara revisiones, descubre quién edita el mismo alcance y construye un contexto limitado antes de enviarlo al líder, agente, Council o Kanban.
Resultado: Código, evidencia, responsabilidad, decisión y entrega permanecen conectados sin pegar todo el repositorio en un prompt.
Grafo de códigoContexto limitadoResponsabilidad
Revisar una entrega con evidencias
Inspecciona cambios Git en diffs de Monaco, adjunta pruebas, riesgos, capturas y comentarios por línea y luego aprueba o solicita cambios al agente responsable.
Resultado: Cada decisión permanece vinculada a la tarea, evidencias, código e historial de entrega.
Centro de RevisiónDiffEvidencias
Comparar planes antes de movilizar al equipo
Solicita perspectivas estructuradas e independientes a varios providers, examina divergencias y confianza y selecciona el plan que debe avanzar.
Resultado: Las decisiones importantes reciben múltiples puntos de vista mientras la autoridad final sigue siendo humana.
CouncilProvidersDecisión
Probar una aplicación móvil con el equipo
Conecta un iOS Simulator, emulador Android o dispositivo físico aprobado para que un agente inspeccione, interactúe, capture pantallas y lea logs limitados.
Resultado: Los flujos móviles se reproducen y validan en el mismo workspace de la implementación.
iOSAndroidDispositivo
Seguir y hablar con el equipo desde el móvil o navegador
Abre una invitación en la PWA Remote instalable, aprueba la huella y el rol exactos, consulta el resumen de cada agente, habla con el líder u otros agentes y dicta mediante el STT local del host.
Resultado: La navegación adaptable mantiene accesibles tareas, actividad, huddles y revisiones, mientras Equipo muestra enfoque actual, trabajo semántico reciente y totales de coordinación. Los mensajes internos permanecen en el host y el terminal sin filtrar sigue como permiso separado y auditado del Administrador.
PWA RemoteResúmenes de agentesColaboración segura
Resolver una decisión de entrega con los agentes correctos
Abre el Workstream de una tarea, revisa su branch, evidencias, riesgos, memoria con fuentes y anotaciones, y luego inicia un Huddle solo con los especialistas necesarios.
Resultado: Cada turno dirigido, respuesta, decisión, tarea vinculada, revisión y señal de entrega queda recuperable y buscable en vez de desaparecer en un historial de terminal ajeno.
WorkstreamsHuddlesContexto duradero