TAG

Tag: Inferência De IA

Cobertura relacionada ao tema Inferência De IA.

Gke pod snapshots: Google reduz em até 89% o tempo de carga de modelos de IA no Kubernetes
Cloud e Infraestrutura • 2 min de leitura

Gke pod snapshots: Google reduz em até 89% o tempo de carga de modelos de IA no Kubernetes

Recurso de checkpoint e restore do Google Kubernetes Engine chegou à disponibilidade geral em maio e promete cortar o tempo de inicialização de modelos grandes. Benchmark mostra modelo de 70 bilhões de parâmetros carregando em 37 segundos, mas o trabalho migra para o gerenciamento do ciclo de vida dos snapshots.

Dagmar Cirino
0
0