Automatización web: conectar portales sin API

Power Automate Desktop conecta portales sin API a través del navegador: acciones, grabador y límites de la automatización web.

Muchos portales con los que los departamentos trabajan a diario, portales de proveedores, portales de la administración, sistemas de reserva de determinados proveedores de software, simplemente no ofrecen una interfaz abierta. Sin una API, normalmente solo queda el clic manual, rellenar y volver a escribir datos entre dos sistemas, a menudo varias veces al día y siempre siguiendo el mismo patrón. Power Automate Desktop cierra exactamente esta brecha con la automatización web: un trabajador digital maneja el navegador tal como lo harías tú mismo, lee datos, rellena formularios y hace clic en botones, todo sin que el sistema de destino tenga que ofrecer una API para ello.

Este artículo muestra cómo funciona técnicamente la automatización web en Power Automate Desktop (PAD), qué acciones están disponibles para formularios, clics y extracción de datos, cómo ayuda el grabador en esto, y dónde están los límites de este enfoque. Mantienes así el control sobre qué navegador utiliza el flujo y sobre la robustez de la automatización frente a cambios en el portal.

Por qué la automatización web cierra la brecha sin API

Según la documentación oficial, la automatización del navegador es un caso especial de la automatización de la interfaz de usuario, desarrollado específicamente para interactuar con elementos web, tal como se indica en el artículo Automatizar páginas web. En lugar de trabajar contra una interfaz REST o SOAP, PAD lee directamente la estructura HTML de la página y emula clics, entradas y listas de selección a través del Document Object Model. Para ti, esto significa que cualquier portal que se pueda manejar en un navegador se puede automatizar en principio, independientemente de si el proveedor alguna vez previó una API para ello. Se admiten cuatro navegadores estándar, Microsoft Edge, Internet Explorer, Google Chrome y Mozilla Firefox, además del navegador de automatización integrado, listo para usar de inmediato sin instalación adicional.

Iniciar el navegador: extensión o WebDriver

Antes de que se ejecute una automatización web, necesitas una instancia de navegador. Para ello están disponibles las acciones Iniciar nuevo Microsoft Edge, Iniciar nuevo Chrome e Iniciar nuevo Firefox, cada una con la opción de abrir una nueva instancia o adjuntarse a una ya en ejecución. Para Edge, Chrome y Firefox debes instalar antes la extensión correspondiente y activarla en el navegador, de lo contrario la automatización falla con un mensaje de error. Encontrarás los enlaces y pasos necesarios en Instalar las extensiones de navegador de Power Automate.

Desde hace algún tiempo, WebDriver también está disponible como método de interacción alternativo a la extensión de navegador, seleccionable a través del campo Método de interacción del navegador en la acción de inicio. Para ello, coloca los archivos ejecutables de WebDriver en `%LocalAppData%\Microsoft\Power Automate Desktop\WebDrivers`, según la versión de navegador instalada. Importante saber: WebDriver solo puede adjuntarse a instancias de navegador que el propio flujo haya iniciado, no a ventanas abiertas manualmente, y no funciona si una directiva de la organización obliga al navegador a un inicio de sesión forzado. Para Internet Explorer, además, WebDriver no está disponible en absoluto. En la mayoría de los proyectos, la extensión de navegador clásica sigue siendo, por ello, la opción predeterminada más robusta.

Rellenar formularios y hacer clic en botones

Para la interacción propiamente dicha con la página, PAD ofrece todo un grupo de acciones. Las más importantes en la práctica:

  • Rellenar campo de texto en la página web introduce valores en campos de entrada.
  • Establecer valor de lista desplegable en la página web selecciona una entrada de una lista de selección.
  • Pulsar botón en la página web y Hacer clic en enlace en la página web desencadenan clics, incluidas opciones para esperar o no la carga de la nueva página tras el clic y cómo gestionar un posible cuadro de diálogo emergente.

Por defecto, estas acciones no mueven el puntero del ratón de forma visible por la pantalla, sino que desencadenan la interacción mediante un evento de JavaScript. Esto tiene una ventaja práctica: el flujo se ejecuta de forma fiable incluso cuando el navegador está minimizado o la pestaña de destino no está actualmente activa en primer plano, por lo que puedes seguir trabajando en tu equipo mientras tanto. Si un portal no reacciona como se espera a estos eventos emulados, se puede activar adicionalmente una interacción física en acciones concretas como Hacer clic en enlace en la página web o Rellenar campo de texto en la página web. En ese caso, PAD mueve realmente el puntero del ratón, pero para ello el navegador debe estar en primer plano y la pestaña de destino debe tener el foco.

Extraer datos de páginas web

Además de rellenar formularios, la lectura de datos es el segundo gran caso de uso. Para valores individuales o propiedades de elementos, utilizas la acción Obtener detalles de un elemento en la página web; para volúmenes de datos estructurados más grandes, la acción Extraer datos de la página web. Esta acción admite cinco modos de extracción, valor único, valores seleccionados manualmente, lista, tabla y tabla HTML completa, y se puede manejar por completo a través del Asistente web en vivo: marcas los elementos deseados con un clic, y PAD detecta automáticamente si se trata de una lista o tabla en cuanto se han seleccionado al menos dos elementos comparables. Para casos especiales, los selectores CSS también se pueden escribir o ajustar manualmente, incluida una expresión regular opcional para la selección fina. Si los datos se distribuyen en varias páginas con la misma estructura, defines además un elemento de paginación para que la extracción avance automáticamente hasta que se hayan procesado todas las páginas o un número determinado de ellas.

Grabar flujos web sin código con el grabador

Quien no quiera ir uniendo cada acción una por una puede iniciar en su lugar el grabador mediante el botón de la barra de herramientas del diseñador de flujos. Tras hacer clic en Grabar, PAD registra la actividad del ratón y el teclado y genera automáticamente a partir de ella tanto acciones de automatización de la interfaz de usuario como del navegador, tal como se describe en Grabar flujos de escritorio. Puedes iniciar un navegador de tres formas: a través del menú de los tres puntos en la ventana del grabador y la opción Iniciar nuevo navegador web, grabando en un navegador ya abierto, o abriéndolo manualmente mediante un acceso directo del escritorio. Para listas desplegables, selectores de fecha y de color, el grabador muestra sus propios cuadros de diálogo de ayuda en los que introduces directamente los valores deseados, en lugar de seleccionarlos en directo en el portal. Importante para la práctica: el grabador ofrece una estructura básica, no un producto final terminado. Por norma general no graba condiciones ni bucles; a continuación deberías revisar los pasos generados en el diseñador de flujos, depurarlos y añadir gestión de errores.

Límites y trampas típicas

La automatización web es potente, pero no ilimitada. Algunos puntos con los que te encontrarás en la práctica:

  • Los cuadros de diálogo propios del sistema operativo, como Guardar como, Abrir o la carga de archivos, no forman parte de la página HTML y no se pueden controlar con las acciones de automatización web; para ello necesitas además acciones de automatización de la interfaz de usuario para el propio cuadro de diálogo de Windows.
  • Si un flujo se ejecuta en paralelo con varias instancias de navegador a través de WebDriver, esto puede provocar un comportamiento poco fiable, porque las interacciones físicas del navegador requieren una ventana con el foco.
  • Si el operador del portal cambia la estructura de la página, la definición de elemento de interfaz de usuario correspondiente debe adaptarse en el flujo; la automatización web requiere, por ello, más mantenimiento que una conexión API real y debe revisarse periódicamente.
  • El navegador de automatización integrado funciona sin configuración adicional, pero no admite ni pestañas ni la apertura de enlaces en nuevas ventanas.

Dónde exactamente merece la pena la automatización web para tu portal, y dónde tiene más sentido una alternativa más estable, como una API oculta o una exportación de datos, se evalúa mejor en función del caso concreto, por ejemplo en el marco de una consultoría de Power Automate.

Preguntas frecuentes

¿Necesito una extensión de navegador propia para cada portal?

No, instalas la extensión una vez por navegador y equipo, no por portal. Después, PAD puede automatizar cualquier página web en ese navegador, siempre que la extensión permanezca activada y ninguna directiva de la empresa la bloquee.

¿Qué ocurre si cambia el diseño del portal?

La definición de elemento de interfaz de usuario afectada en el flujo ya no encuentra entonces el elemento esperado, y la acción falla con un error como «No se ha encontrado ningún elemento con el selector CSS indicado». En ese caso, simplemente vuelves a capturar el elemento en el Asistente web en vivo y sustituyes la definición antigua.

¿Es WebDriver mejor que la extensión de navegador clásica?

No fundamentalmente. WebDriver ofrece posibilidades adicionales, pero tiene limitaciones documentadas en ejecuciones paralelas, al adjuntarse a ventanas abiertas manualmente y con inicios de sesión de organización forzados. Para la mayoría de los escenarios estándar, la extensión de navegador sigue siendo la opción más sencilla y estable.

¿Puedo también descargar archivos de un portal con la automatización web?

Sí, mediante la acción Clic en enlace de descarga en la página web, o haciendo clic en un enlace de descarga y dejando que PAD procese la ubicación de almacenamiento mediante acciones de sistema de archivos posteriores. Si en ese proceso aparece un cuadro de diálogo Guardar como propio de Windows, necesitas además acciones de automatización de la interfaz de usuario para él, ya que ese cuadro de diálogo no forma parte de la página web.

¿Merece la pena la automatización web si más adelante hay una API disponible?

Sí, ese es incluso el camino habitual. La automatización web salva el tiempo sin interfaz, a menudo durante años. En cuanto hay una API disponible, la sección de flujo afectada se puede sustituir sin que el resto de la lógica del proceso se vea afectado.

Sobre NordFlux

NordFlux UG (haftungsbeschränkt)

NordFlux crea empleados digitales para las organizaciones: automatizaciones y agentes KI que asumen el trabajo repetitivo. Usted mantiene el control.

Más sobre nosotros
Análisis inicial gratuito

¿Preguntas concretas sobre automatización o IA?

En un análisis inicial gratuito hablamos directamente de su caso. Sin compromiso.