O Google usa tecnologia de IA na tradução de conteúdos para seu idioma de preferência. As traduções com IA podem ter erros.
Executar inferência em lote usando GPUs em jobs do Cloud Run
Mantenha tudo organizado com as coleções
Salve e categorize o conteúdo com base nas suas preferências.
É possível executar a inferência em lote com o LLM Llama 3.2-1b da Meta e o vLLM em um job do Cloud Run e gravar os resultados diretamente no Cloud Storage usando as montagens de volume do Cloud Run.
Confira um codelab instrucional detalhado em Como executar a inferência em lote em jobs do Cloud Run.
Exceto em caso de indicação contrária, o conteúdo desta página é licenciado de acordo com a Licença de atribuição 4.0 do Creative Commons, e as amostras de código são licenciadas de acordo com a Licença Apache 2.0. Para mais detalhes, consulte as políticas do site do Google Developers. Java é uma marca registrada da Oracle e/ou afiliadas.
Última atualização 2026-08-02 UTC.
[null,null,["Última atualização 2026-08-02 UTC."],[],[]]