Nesta página, você encontra uma lista selecionada de recursos para ajudar a criar e implantar soluções de IA no Cloud Run.
O Cloud Run é uma plataforma de aplicativos totalmente gerenciada para executar seu código, função ou contêiner na infraestrutura altamente escalonável do Google. Você pode usar o Cloud Run para executar várias soluções de IA, como endpoints de inferência de IA, APIs de modelos generativos, pipelines completos de geração aumentada por recuperação (RAG) e muito mais.
Use as categorias e os links abaixo para navegar por guias oficiais, guias de início rápido e conteúdo valioso da comunidade. Para documentação e recomendações do Cloud Run, consulte Conheça as soluções de IA no Cloud Run.
Observação sobre recursos da comunidade
O conteúdo rotulado como "Comunidade" são recursos selecionados da comunidade de desenvolvedores e não são desenvolvidos nem mantidos pelo Google. Considere estas precauções ao usar esses recursos:
- Auditoria de segurança:sempre revise cuidadosamente qualquer código, principalmente como ele lida com informações privadas, entrada do usuário e acesso à rede.
- Descontinuação e atualizações:o código da comunidade pode ficar desatualizado ou parar de funcionar com novos recursos do Cloud Run ou versões de IA sem aviso prévio. Verifique a data da última atualização e se ele ainda está sendo mantido ativamente.
- Eficiência de custo:embora essas configurações geralmente busquem um custo baixo, elas podem não seguir as práticas recomendadas do Google para economizar dinheiro em projetos ativos. Monitore seu faturamento de perto.
- Conformidade com a licença:entenda e siga a licença de código aberto de qualquer código ou biblioteca da comunidade que você adicionar ao aplicativo.
- Teste antes de implantar:verifique todas as configurações importantes e teste as soluções da comunidade em um ambiente de teste antes de usá-las em projetos ativos.
Filtrar por categoria ou palavra-chave
Use os filtros ou a caixa de pesquisa para encontrar conteúdo por categoria ou palavra-chave.
| Categorias | Título e descrição | Data de publicação |
|---|---|---|
|
ADK
BigQuery
Codelab
Gemma 4
MCP
|
Criar e implantar agentes de IA com o Gemma 4 e o servidor MCP do BigQuery no Cloud Run Saiba como criar e implantar agentes de IA com o Gemma 4 e o servidor MCP do BigQuery no Cloud Run. |
2026-08-17 |
|
Cloud Run
Codelab
Agente pessoal
|
Executar um agente pessoal em um serviço do Cloud Run (assistente de gerente de cafeteria) Aprenda a executar um agente pessoal em um serviço do Cloud Run. |
2026-08-17 |
|
ADK
Codelab
RAG
Streamlit
|
Implantar um agente de IA RAG no Streamlit usando o ADK do Google e o Cloud Run Crie um agente barista de café de geração aumentada por recuperação (RAG) usando o ADK do Google e implante-o no Cloud Run. |
2026-08-12 |
|
Blog
Sandboxes
Segurança
|
Executar com segurança código gerado por IA em sandboxes do Cloud Run Esta postagem apresenta as sandboxes do Cloud Run, que permitem que os desenvolvedores executem com segurança código não confiável gerado por IA em ambientes sem servidor conteinerizados. |
2026-07-09 |
|
ADK
Agentes
Codelab
|
Criar um agente de IA com o ADK do Google Crie seu primeiro agente de IA usando o ADK do Google e o Gemini e implante-o no Cloud Run. |
2026-07-09 |
|
ADK
Codelab
Planilhas
Teste
|
Teste local do agente do ADK do Google Sheets no Cloud Run Saiba como testar localmente um agente do ADK que grava no Google Sheets antes de implantar no Cloud Run. |
2026-07-09 |
|
Agentes
Codelab
Avaliação
|
Da verificação de ambiente à avaliação de agente baseada em dados Saiba como fazer a transição de "análises informais" para a avaliação baseada em dados de sistemas multiagentes usando a Vertex AI no Cloud Run. |
2026-07-09 |
|
AI Studio
Codelab
Firebase
Firestore
|
Lance seu app da Web de tarefas com IA Aprenda a criar um aplicativo de tarefas colaborativo no Google AI Studio com o banco de dados do Firestore e o Firebase Authentication, além de implantá-lo diretamente no Cloud Run. |
2026-06-25 |
|
Blog
Inicializações a frio
Implantação
|
Um guia para inicializações a frio de IA no Cloud Run Esta postagem do blog aborda o desafio das inicializações a frio para aplicativos de IA no Cloud Run e descreve otimizações nas configurações de configuração, arquitetura e tempo de execução para melhorar a latência ao escalonar para zero. |
2026-05-28 |
|
ADK
Agentes
Codelab
MCP
Segurança
|
Este codelab mostra como usar o Gateway de Agente para governar e proteger um agente do ADK em execução no Agent Runtime ao se conectar a ferramentas externas hospedadas como servidores MCP no Cloud Run. |
2026-05-28 |
|
Agentes
Comunidade
MCP
Segurança
|
Proteção de agentes de IA com a autorização do MCP Este artigo demonstra como configurar e aplicar a autorização do MCP para proteger sistemas agênticos que implantam ferramentas remotas do MCP no Cloud Run. |
2026-05-26 |
|
AI Studio
Blog
Cloud SQL
Firebase
Vibe coding
|
Este artigo apresenta as atualizações de vibe coding full stack no Google AI Studio, detalhando as integrações com o Firebase e o Cloud SQL, além de um fluxo de integração sem cartão de crédito para implantação de apps no Cloud Run. |
2026-05-21 |
|
ADK
Flutter
Go
Vídeo
|
Criar um app de agente de IA com o ADK do Go, o Cloud Run e o Flutter Este vídeo mostra como criar um aplicativo de agente de IA usando o Kit de Desenvolvimento de Agente (ADK) do Go, implantá-lo como um serviço de contêiner no Cloud Run e acessá-lo em um front-end Flutter multiplataforma. |
2026-05-21 |
|
AI Studio
Cloud SQL
Vídeo
|
Criar apps de stack completa com o Google AI Studio, o Cloud Run e o Cloud SQL Este vídeo orienta os usuários na criação de aplicativos de pilha completa no modo de criação do Google AI Studio e na implantação deles no Cloud Run com provisionamento automático de banco de dados. |
2026-05-21 |
|
AlloyDB
BigQuery
Codelab
MCP Toolbox
MongoDB
|
Crie um catálogo de e-commerce inteligente com persistência em vários bancos de dados Crie um catálogo de e-commerce inteligente usando o AlloyDB, o MongoDB, o Cloud Storage, o BigQuery e o MCP Toolbox no Cloud Run. Em seguida, implante um app de chat multiagente. |
2026-04-22 |
|
Agentes
Codelab
Gemini Enterprise
|
Próxima palestra principal do Next ‘26: Fabric of Unified Intelligence Implante um sistema multiagente no Cloud Run e orquestre-o usando o Gemini Enterprise com contexto compartilhado para demonstrar a estrutura da inteligência unificada. |
2026-04-22 |
|
ADK
Agentes
Codelab
MCP
|
Criar e implantar um agente de passaporte de animais de estimação no Cloud Run Este codelab orienta você na criação e implantação de um agente de passaporte para animais de estimação que usa ferramentas com servidores ADK e do Protocolo de Contexto de Modelo (MCP) do Google no Cloud Run. |
2026-04-22 |
|
ADK
Agentes
Codelab
Eventarc
|
Crie agentes de IA orientados a eventos com o Eventarc, o Cloud Run e o ADK Aprenda a criar e implantar agentes de IA assíncronos e orientados a eventos no Cloud Run usando o Eventarc e o Kit de Desenvolvimento de Agente (ADK). |
2026-04-22 |
|
Agentes
Codelab
MCP
Segurança
|
Implantar um agente com reconhecimento de governança corporativa com o MCP e o Cloud Run Na Parte 2 desta série, aprenda a implantar um servidor do Protocolo de Contexto de Modelo (MCP) no Cloud Run para atuar como um plano de controle de dados e conectá-lo a um agente do ADK compatível com governança. |
2026-04-16 |
|
ADK
Agentes
Codelab
Model Armor
Segurança
|
Criar um agente seguro com o Model Armor e o Identity Crie um agente de IA seguro e pronto para produção usando o Kit de Desenvolvimento de Agente (ADK) e implante-o no Google Cloud. Este guia aborda a implementação do Model Armor para filtragem de entrada/saída e da identidade do agente para controle de acesso. |
2026-04-16 |
|
ADK
Agentes
Codelab
MCP
|
Way Back Home - Level 1: Pinpoint Location Crie um sistema de IA multiagente usando o Kit de Desenvolvimento de Agente (ADK) que incorpora servidores MCP personalizados e a integração do OneMCP BigQuery. |
2026-04-16 |
|
AI Studio
Codelab
Implantação
Vibe coding
|
Vibe Code com o Gemini no Google AI Studio Este codelab mostra como usar o modo de criação no Google AI Studio para criar um protótipo rápido de um aplicativo React e implantá-lo no Cloud Run com um clique. |
2026-04-15 |
|
Codelab
Gemma 4
GPUs
LLMs
|
Executar a inferência do modelo Gemma 4 no Cloud Run com GPU RTX 6000 Pro e vLLM Este codelab mostra como implantar um modelo Gemma 4 em uma GPU NVIDIA RTX Pro 6000 do Cloud Run usando o vLLM para inferência sem servidor de alta capacidade. |
2026-04-13 |
|
ADK
Agentes
Comunidade
|
Como criei e implantei agentes de IA reais usando o ADK do Google no Cloud Run Crie um planejador de viagens multiagente usando o Kit de Desenvolvimento de Agente (ADK) do Google e implante-o no Google Cloud Run. |
2026-04-10 |
|
Agentes
Automation
Comunidade
SRE
Casos de uso
|
Do incidente ao pull request: como criar um agente de SRE com tecnologia de IA no GCP Crie um agente de SRE que automatiza a análise de causa raiz e as correções de software usando o Gemini, o Spring Boot e o Cloud Run. |
2026-04-10 |
|
Agentes
Codelab
Frameworks
LangChain
|
Implantar o agente do LangChain no Cloud Run Crie um agente de IA baseado em LangChain, empacote-o em um contêiner e implante-o no Google Cloud Run para veiculação. |
2026-03-27 |
|
Agentes
Comunidade
Elasticsearch
Gemini
Multimodal
|
Snap, Plan, Go: Building a Multimodal Travel Agent with Google Cloud, Elasticsearch, and Gemini (em inglês) Crie um agente de viagens multimodal que identifique pontos de referência em imagens e sugira rotas de viagem usando o Gemini no Cloud Run. |
2026-02-22 |
|
AI Studio
Codelab
Implantação
Vibe coding
|
Implantar do AI Studio no Cloud Run Neste codelab, você vai criar um aplicativo da Web simples usando a programação vibe no Google AI Studio e implantá-lo no Cloud Run. |
2026-02-18 |
|
Frameworks
Gemini
LangChain
|
Guia de início rápido: criar e implantar um app da Web em Python (LangChain) no Cloud Run Neste guia de início rápido, mostramos como criar e implantar um aplicativo LangChain usando o Cloud Run e o Gemini para responder a consultas sobre capitais de cidades. |
2026-02-03 |
|
Agentes
Frameworks
Gemini
|
Guia de início rápido: criar e implantar um app da Web em Python (smolagents) no Cloud Run Neste guia de início rápido, mostramos como criar e implantar um aplicativo smolagents usando o Cloud Run e o Gemini. |
2026-01-28 |
|
Agentes
Antigravity
Vídeo
|
Pare de programar, comece a arquitetar: Google Antigravity + Cloud Run Este vídeo apresenta o IDE agêntico do Google, o Antigravity. Use-o para criar e implantar um app de pilha completa no Cloud Run do zero. Assista a este vídeo para escrever uma ficha técnica da IA, forçar o uso do Node.js moderno (sem etapas de build!) e ver a depuração autônoma de uma incompatibilidade de porta durante a implantação, tocando em um arquivo de configuração. |
2025-12-08 |
|
Codelab
Ferramentas
|
Como implantar e executar o n8n no Google Cloud Run Este codelab mostra como implantar uma instância pronta para produção da ferramenta de automação de fluxo de trabalho n8n no Cloud Run, com um banco de dados do Cloud SQL para persistência e o Secret Manager para dados sensíveis. |
2025-11-20 |
|
Blog
Gemma 3
|
Pratique com o Gemma 3 no Google Cloud Esta postagem do blog anuncia dois codelabs que mostram aos desenvolvedores como implantar o Gemma 3 no Google Cloud usando o Cloud Run para uma abordagem sem servidor ou o Google Kubernetes Engine (GKE) para uma abordagem de plataforma. |
2025-11-17 |
|
Agentes
GPUs
Ollama
Vídeo
|
Este agente de IA é executado no Cloud Run + GPUs NVIDIA Este vídeo mostra como criar um aplicativo de agente de IA real em uma GPU NVIDIA sem servidor. Confira uma demonstração de um agente de saúde inteligente que usa modelos de código aberto, como o Gemma com o Ollama no Cloud Run, e o LangGraph para criar um fluxo de trabalho multiagente (RAG + ferramentas). |
2025-11-13 |
|
Codelab
GPUs
LLMs
|
Como executar a inferência de LLM em GPUs do Cloud Run com o vLLM e o SDK do Python da OpenAI Este codelab mostra como implantar o modelo ajustado por instruções Gemma 2 2b do Google no Cloud Run com GPUs, usando o vLLM como um mecanismo de inferência e o SDK do Python da OpenAI para realizar a conclusão de frases. |
2025-11-13 |
|
ADK
Agentes
Codelab
|
Implantar, gerenciar e observar o agente do ADK no Cloud Run Este codelab mostra como implantar, gerenciar e monitorar um agente avançado criado com o Kit de Desenvolvimento de Agente (ADK, na sigla em inglês) no Cloud Run. |
2025-11-12 |
|
Blog
Ferramentas
|
Automação fácil de fluxos de trabalho de IA: implante o n8n no Cloud Run Esta postagem do blog explica como implantar agentes usando a ferramenta de automação de fluxo de trabalho n8n no Cloud Run para criar fluxos de trabalho com tecnologia de IA e integrar a ferramentas como o Google Workspace. |
2025-11-07 |
|
MCP
Vídeo
|
Potencialize seus agentes de IA com ferramentas do MCP no Google Cloud Run Este vídeo apresenta o MCP (Protocolo de Contexto de Modelo) e como ele facilita a vida dos desenvolvedores de agentes de IA. Confira um tutorial sobre como criar um servidor MCP usando o FastMCP e implantar um agente ADK no Cloud Run. Saiba como o código processa a autenticação de serviço para serviço usando os tokens OIDC integrados do Cloud Run. |
2025-11-06 |
|
Model Armor
Segurança
Vídeo
|
Tentamos fazer jailbreak na nossa IA, e o Model Armor impediu Este vídeo mostra um exemplo de como usar o Model Armor do Google para bloquear ameaças com uma chamada de API. |
2025-10-30 |
|
ADK
Agentes
Codelab
MCP
|
Criar e implantar um agente do ADK que usa um servidor MCP no Cloud Run Este codelab orienta você na criação e implantação de um agente de IA que usa ferramentas com o Kit de Desenvolvimento de Agente (ADK, na sigla em inglês). O agente se conecta a um servidor MCP remoto para acessar as ferramentas dele e é implantado como um contêiner no Cloud Run. |
2025-10-27 |
|
Comparativo de mercado
Vertex AI
Vídeo
|
Não chute: como fazer um comparativo de mercado dos seus comandos de IA Este vídeo mostra como usar a Vertex AI para criar aplicativos de IA generativa confiáveis com as ferramentas do Google Cloud. Os desenvolvedores vão aprender a usar as ferramentas do Google Cloud para prototipagem rápida, receber números concretos com comparativos de mercado orientados a dados e, por fim, criar um pipeline de CI/CD automatizado para controle de qualidade real, evitando armadilhas comuns. |
2025-10-23 |
|
Modelos de IA
Jobs do Cloud Run
Codelab
Ajuste de modelos
|
Como ajustar um LLM usando jobs do Cloud Run Este codelab fornece um guia explicativo sobre como usar jobs do Cloud Run com GPUs para ajustar um modelo do Gemma 3 no conjunto de dados Text2Emoji e disponibilizar o modelo resultante em um serviço do Cloud Run com vLLM. |
2025-10-21 |
|
Inferência em lote
Jobs do Cloud Run
Codelab
|
Como executar inferência em lote em jobs do Cloud Run Este codelab demonstra como usar um job do Cloud Run com tecnologia de GPU para executar a inferência em lote em um modelo Llama 3.2-1b e gravar os resultados diretamente em um bucket do Cloud Storage. |
2025-10-21 |
|
ADK
Multiagente
Vídeo
|
Como criar um app multiagente com o ADK e o Gemini Este vídeo mostra como criar um app usando o ADK (Kit de Desenvolvimento de Agente) do Google para refinar e colaborar com conteúdo. Saiba como os multiagentes com estado funcionam melhor do que um único agente. |
2025-10-16 |
|
Comunidade
Segurança
|
Chame seu serviço do Cloud Run com segurança de qualquer lugar Este artigo fornece um exemplo de código Python que adquire um token de identidade para chamar com segurança um serviço autenticado do Cloud Run em qualquer ambiente. O exemplo usa o Application Default Credentials (ADC) para autenticar a chamada. |
2025-10-15 |
|
Gemini
Vídeo
|
Criar um app de IA que assiste vídeos usando o Gemini Este vídeo mostra como criar um app que assiste e entende vídeos do YouTube usando o Gemini 2.5 Pro. Use comandos inteligentes para personalizar a saída do app em postagens de blog, resumos, testes e muito mais. Este vídeo mostra como integrar o Gemini para gerar conteúdo de texto e imagens de cabeçalho com base em entradas de vídeo, discute considerações de custo e explica como processar vídeos mais longos com solicitações em lote. |
2025-10-06 |
|
ADK
Agentes
Codelab
GPUs
LLMs
MCP
|
Laboratório 3: do protótipo à Production: implante seu agente do ADK no Cloud Run com GPU Este codelab mostra como implantar um agente do Kit de Desenvolvimento de Agente (ADK, na sigla em inglês) pronto para produção com um back-end do Gemma acelerado por GPU no Cloud Run. O codelab aborda implantação, integração e testes de desempenho. |
2025-10-03 |
|
Agentes
Codelab
|
Este codelab demonstra como implantar um aplicativo de duas camadas no Cloud Run, consistindo em um front-end do Gradio e um back-end de agente do ADK, com foco na implementação de uma comunicação segura e autenticada de serviço para serviço. |
2025-09-29 |
|
Modelos de IA
Comunidade
RAG
|
IA sem servidor: EmbeddingGemma com o Cloud Run Este artigo oferece um guia detalhado sobre como conteinerizar e implantar o modelo EmbeddingGemma no Cloud Run com GPUs e, em seguida, usá-lo para criar um aplicativo RAG. |
2025-09-24 |
|
Comunidade
Segurança
|
Cadeia de confiança para IA: protegendo a arquitetura do MCP Toolbox no Cloud Run Este artigo desconstrói um aplicativo simples de reserva de hotel criado no Google Cloud. Ele demonstra um modelo de segurança robusto de confiança zero usando identidades de serviço e mostra como uma cadeia de confiança segura é estabelecida do usuário final até o banco de dados. |
2025-09-03 |
|
Modelos de IA
Comunidade
Conteinerização
Docker
Ollama
RAG
|
IA sem servidor: incorporações do Qwen3 com o Cloud Run Este artigo mostra como implantar o modelo de incorporação Qwen3 no Cloud Run com GPUs. O artigo também aborda a contêinerização com Docker e Ollama e fornece um exemplo de como usar em um aplicativo RAG. |
2025-08-20 |
|
Arquitetura
Comunidade
LLMs
|
Ainda empacotando modelos de IA em contêineres? Faça isso no Cloud Run Este artigo defende uma arquitetura mais eficiente e escalonável para disponibilizar modelos de linguagem grandes (LLMs) no Cloud Run. Para isso, ele desacopla os arquivos de modelo do contêiner do aplicativo e usa o Cloud Storage FUSE. |
2025-08-11 |
|
Modelos de IA
Comunidade
|
Como criar um gerador de podcasts com tecnologia de IA usando o Gemini e o Cloud Run Este artigo detalha como criar um gerador de podcasts sem servidor com tecnologia de IA que usa o Gemini para resumo de conteúdo e o Cloud Run. O exemplo orquestra o pipeline automatizado para gerar e entregar briefings de áudio diários de feeds RSS. |
2025-08-11 |
|
GenAI
Vídeo
|
Vamos criar um app de IA generativa no Cloud Run Este vídeo mostra a arquitetura e o código, usando a IA para ajudar em todas as etapas. |
2025-07-17 |
|
Blog
Extensões
Gemini
|
Esta postagem no blog anuncia uma colaboração entre o Google Cloud e o Docker que simplifica a implantação de aplicativos de IA complexos. Ela permite que os desenvolvedores usem o comando gcloud run compose up para implantar os arquivos compose.yaml diretamente no Cloud Run. |
2025-07-10 |
|
Agentes
Firebase
Vídeo
|
Crie agentes de IA com o Cloud Run e o Firebase Genkit Este vídeo mostra como criar agentes de IA com o Cloud Run e o Firebase Genkit, um criador de agentes de IA sem servidor. |
2025-07-10 |
|
Comunidade
MCP
|
Potencialize seus servidores MCP com o Google Cloud Run Este artigo explica a finalidade do Protocolo de Contexto de Modelo (MCP) e oferece um tutorial sobre como criar e implantar um servidor MCP no Cloud Run para expor recursos como ferramentas para aplicativos de IA. |
2025-07-09 |
|
AI Studio
Firebase
Gemini
LLMs
Vídeo
|
IA do Google Cloud: é apenas uma API Este vídeo mostra como criar rapidamente um aplicativo de suporte técnico usando o AI Studio, o Cloud Functions e o Firebase Hosting. Aprenda a usar modelos de linguagem grandes (LLMs) e confira um exemplo prático de integração de IA a um aplicativo Web tradicional. |
2025-06-19 |
|
Blog
MCP
|
Crie e implante um servidor MCP remoto no Google Cloud Run em menos de 10 minutos Esta postagem do blog oferece um guia detalhado para criar e implantar um servidor remoto e seguro do Protocolo de Contexto de Modelo (MCP) no Google Cloud Run em menos de 10 minutos usando o FastMCP e testá-lo em um cliente local. |
2025-06-07 |
|
Comunidade
Modelos de ML
Monitoring
|
Implantação e monitoramento de modelos de ML com o Cloud Run: leve, escalonável e econômico Este artigo explica como implantar, monitorar e escalonar automaticamente um modelo de machine learning no Cloud Run usando uma pilha de monitoramento leve com serviços do Google Cloud para acompanhar o desempenho e controlar os custos. |
2025-05-29 |
|
Modelos de IA
AI Studio
Comunidade
LLMs
|
Como implantar o Gemma diretamente do AI Studio no Cloud Run Este artigo oferece um tutorial detalhado sobre como usar um modelo Gemma do AI Studio, adaptar o código dele para produção e implantá-lo como um aplicativo da Web em contêineres no Cloud Run. |
2025-05-29 |
|
ADK
Agentes
Comunidade
MCP
|
A tríade da arquitetura de agentes: ADK, MCP e Cloud Run Neste artigo, mostramos como criar uma arquitetura de agente de IA configurando um fluxo de trabalho do Kit de Desenvolvimento de Agente (ADK) que se comunica com um servidor do Protocolo de Contexto de Modelo (MCP) hospedado no Cloud Run para gerenciar reservas de voos. |
2025-05-27 |
|
ADK
Agentes
Frameworks
LangGraph
Vertex AI
Vídeo
|
Como criar agentes de IA no Google Cloud Este vídeo mostra como criar e implantar agentes de IA usando o Cloud Run e a Vertex AI. Conheça conceitos importantes, como chamadas de função, agnosticismo de modelo e o uso de frameworks como o LangGraph e o Kit de Desenvolvimento de Agente (ADK). |
2025-05-21 |
|
Agentes
AI Studio
Blog
MCP
|
Esta postagem do blog apresenta maneiras de simplificar as implantações de IA com implantação com um clique do AI Studio no Cloud Run, implantação direta de modelos do Gemma 3 e um servidor MCP para implantações baseadas em agentes. |
2025-05-20 |
|
A2A
Agentes
Comunidade
Frameworks
Casos de uso
|
Como usar o protocolo Agent2Agent (A2A) com o caso de uso do concierge de compras no Cloud Run Este artigo explica o protocolo Agent2Agent (A2A) e demonstra o uso dele com um aplicativo de concierge de compras. O app do Cloud Run contém vários agentes de IA, criados com diferentes frameworks, que colaboram entre si para atender ao pedido de um usuário. |
2025-05-15 |
|
Modelos de IA
Automation
CI/CD
Comunidade
GitHub
|
Como automatizar a implantação de modelos de ML com as ações do GitHub e o Cloud Run Este artigo é um guia completo sobre como criar um pipeline de CI/CD com as Ações do GitHub para automatizar a criação e a implantação de modelos de machine learning como serviços em contêineres no Cloud Run. |
2025-05-08 |
|
Modelos de IA
GPUs
Ollama
Vídeo
|
Como hospedar o DeepSeek com GPUs do Cloud Run em três etapas Este vídeo mostra como simplificar a hospedagem do modelo de IA DeepSeek com GPUs do Cloud Run. Saiba como implantar e gerenciar modelos de linguagem grandes (LLMs) no Google Cloud com três comandos. Assista e descubra os recursos do Cloud Run e da ferramenta de linha de comando Ollama, que permitem aos desenvolvedores operar aplicativos de IA rapidamente com escalonamento e alocação de recursos sob demanda. |
2025-04-24 |
|
Agentes
Blog
Casos de uso
|
Este artigo mostra como o CodeRabbit, uma ferramenta de revisão de código de IA, usa o Cloud Run para criar uma plataforma escalonável e segura para executar código não confiável, reduzindo pela metade o tempo de revisão de código e os bugs. |
2025-04-22 |
|
Comunidade
LLMs
Segurança
|
Como criar soluções de IA soberana com o Google Cloud: Cloud Run Este artigo fornece um guia explicativo sobre como criar e implantar uma solução de IA soberana no Google Cloud usando os Controles de Soberania oferecidos por Parceiros. Os exemplos executam um modelo da Gemma no Cloud Run, garantindo a residência de dados e a conformidade com as regulamentações europeias. |
2025-04-03 |
|
Codelab
Gemini
|
Como implantar um app de chatbot do FastAPI no Cloud Run usando o Gemini Neste codelab, mostramos como implantar um app de chatbot do FastAPI no Cloud Run. |
2025-04-02 |
|
Funções do Cloud Run
Codelab
LLMs
|
Como hospedar um LLM em um sidecar para uma função do Cloud Run Este codelab mostra como hospedar um modelo gemma3:4b em um sidecar para uma função do Cloud Run. |
2025-03-27 |
|
Blog
Implantação
|
Como implantar a IA sem servidor com o Gemma 3 no Cloud Run Nesta postagem do blog, anunciamos o Gemma 3, uma família de modelos de IA abertos e leves, e explicamos como implantá-los no Cloud Run para aplicativos de IA sem servidor escalonáveis e econômicos. |
2025-03-12 |
|
Arquitetura
RAG
Vertex AI
|
Infraestrutura de RAG para IA generativa usando a Vertex AI e a busca vetorial Este documento apresenta uma arquitetura de referência para criar um aplicativo de IA generativa com geração aumentada por recuperação (RAG) no Google Cloud, usando a Pesquisa de vetor para correspondência de similaridade em grande escala e a Vertex AI para gerenciar embeddings e modelos. |
2025-03-07 |
|
Chamadas de função
Gemini
Vídeo
|
Como usar a chamada de função do Gemini com o Cloud Run Este vídeo mostra o poder da chamada de função do Gemini e ensina a integrar APIs externas aos seus aplicativos de IA. Crie um app de clima que aproveita o processamento de linguagem natural do Gemini para processar solicitações do usuário e buscar dados de clima de uma API externa, fornecendo um exemplo prático de chamada de função em ação. |
2025-01-23 |
|
Geração de imagens
Vertex AI
Vídeo
|
Texto para imagem com a Vertex AI do Google Cloud no Cloud Run Este vídeo mostra como criar um app de geração de imagens usando a Vertex AI no Google Cloud. Com o modelo de geração de imagens da Vertex AI, os desenvolvedores podem criar recursos visuais incríveis sem precisar de infraestrutura complexa ou gerenciamento de modelos. |
2025-01-16 |
|
Janela de comando grande
Ajuste de modelos
RAG
Vídeo
|
RAG x ajuste de modelo x janela de comando grande Este vídeo aborda os três principais métodos para integrar seus dados em aplicativos de IA: comandos com janelas de contexto longas, geração aumentada de recuperação (RAG) e ajuste de modelo. Neste episódio do Serverless Expeditions, saiba mais sobre os pontos fortes, as limitações e os casos de uso ideais de cada abordagem para tomar decisões informadas nos seus projetos de IA. |
2024-11-14 |
|
Engenharia de comando
Vídeo
|
Engenharia de comando para desenvolvedores Este vídeo mostra como usar a engenharia de comandos para melhorar a qualidade das respostas de IA. Assista o vídeo para saber como receber respostas mais precisas e relevantes da IA generativa com técnicas de linha de raciocínio, com poucos exemplos (few-shot) e vários exemplos. |
2024-10-31 |