En esta guía, se proporciona una descripción general del uso de Cloud Run para alojar apps, ejecutar inferencias y compilar flujos de trabajo de IA.
Cloud Run para alojar aplicaciones y agentes de IA, y extremos de API escalables
Cloud Run proporciona una plataforma completamente administrada que ajusta la escala de tus apps y cargas de trabajo basadas en IA.
Cuando alojas apps basadas en IA en Cloud Run, sueles tener los siguientes componentes de arquitectura:
- Publicación y organización: Implementas el código o el contenedor de tu aplicación en Cloud Run.
- Modelos de IA: Usas modelos de IA de Google, modelos de código abierto o modelos personalizados con tu app.
- Integraciones: Puedes conectarte a servicios de Cloud de Confiance o a servicios de terceros para obtener memoria, bases de datos, almacenamiento, seguridad y mucho más.
- Herramientas: Puedes conectarte a herramientas para otras tareas y operaciones.
En el siguiente diagrama, se muestra una descripción general de alto nivel del uso de Cloud Run como plataforma de hosting para apps basadas en IA:
Como se muestra en el diagrama:
Dentro de la capa de servicio y orquestación, un servicio de Cloud Run actúa como un extremo de API escalable para la lógica principal de tu aplicación. Administra de manera eficiente a varios usuarios simultáneos a través del ajuste de escala automático, rápido y a pedido de las instancias.
Para implementar tu contenedor en Cloud Run, debes empaquetar tu aplicación y su dependencia en un contenedor.
Tu app de IA actúa como un extremo de API escalable que controla las solicitudes entrantes y envía datos a un modelo de IA entrenado previamente para su procesamiento y, luego, devuelve los resultados.
Si tienes un modelo personalizado que entrenaste tú mismo, también puedes usarlo con tu recurso de Cloud Run.
Cloud de Confiance by S3NS ofrece una amplia variedad de soluciones para admitir la infraestructura de tu aplicación de IA.También puedes realizar integraciones con soluciones de terceros.
Las herramientas permiten que tus apps y modelos de IA interactúen con servicios, APIs o sitios web que se ejecutan de forma externa o en Cloud Run.
Por ejemplo, si tu app de IA es un agente de IA, es posible que envíe una solicitud a un servidor de MCP para ejecutar una herramienta externa o usar herramientas que se ejecutan en tu contenedor, como la ejecución de código, el uso de la computadora, la recuperación de información, etcétera.