Ejecutar soluciones de IA en Cloud Run

En esta guía se ofrece una descripción general sobre cómo usar Cloud Run para alojar aplicaciones, ejecutar inferencias y crear flujos de trabajo de IA.

Cloud Run para alojar aplicaciones de IA, agentes y endpoints de API escalables

Cloud Run ofrece una plataforma totalmente gestionada que escala tus aplicaciones y cargas de trabajo de IA.

Cuando alojas aplicaciones de IA en Cloud Run, normalmente tienes los siguientes componentes de arquitectura:

  • Servicio y orquestación: despliega el código o el contenedor de tu aplicación en Cloud Run.
  • Modelos de IA: usas modelos de IA de Google, modelos de código abierto o modelos personalizados con tu aplicación.
  • Integraciones: puedes conectarte a Cloud de Confiance servicios o servicios de terceros para la memoria, las bases de datos, el almacenamiento, la seguridad y más.
  • Herramientas: puedes conectarte a herramientas para realizar otras tareas y operaciones.

En el siguiente diagrama se muestra una descripción general de alto nivel del uso de Cloud Run como plataforma de alojamiento de aplicaciones de IA:

Los cuatro componentes de una aplicación de IA alojada en Cloud Run:
    1. Servicio y orquestación, 2. Modelos de IA, 3. Integraciones, 4. Herramientas.
Imagen 1. Componentes de una aplicación de IA alojada en Cloud Run.

Como se muestra en el diagrama:

  1. En la capa de servicio y orquestación, un servicio de Cloud Run actúa como endpoint de API escalable para la lógica principal de tu aplicación. Gestiona de forma eficiente varios usuarios simultáneos mediante el escalado automático, rápido y bajo demanda de las instancias.

    Para desplegar un contenedor en Cloud Run, debes empaquetar tu aplicación y sus dependencias en un contenedor.

  2. Tu aplicación de IA actúa como un endpoint de API escalable que gestiona las solicitudes entrantes y envía datos a un modelo de IA preentrenado para que los procese y, a continuación, devuelve los resultados.

    Si tienes un modelo personalizado que has entrenado tú mismo, también puedes usarlo con tu recurso de Cloud Run.

  3. Cloud de Confiance by S3NS ofrece una amplia variedad de soluciones para admitir la infraestructura de tu aplicación de IA.También puedes integrar soluciones de terceros.

  4. Las herramientas permiten que tus aplicaciones y modelos de IA interactúen con servicios, APIs o sitios web que se ejecutan de forma externa o en Cloud Run.

    Por ejemplo, si tu aplicación de IA es un agente de IA, tu agente puede enviar una solicitud a un servidor MCP para ejecutar una herramienta externa o usar herramientas que se ejecuten en tu contenedor, como la ejecución de código, el uso de ordenadores, la obtención de información, etc.

Siguientes pasos