Recurso de checkpoint e restore do Google Kubernetes Engine chegou à disponibilidade geral em maio e promete cortar o tempo de inicialização de modelos grandes. Benchmark mostra modelo de 70 bilhões de parâmetros carregando em 37 segundos, mas o trabalho migra para o gerenciamento do ciclo de vida dos snapshots.
Uber apresentou o ServiceScale, controller que permite a vários orquestradores escalar as mesmas cargas de trabalho Kubernetes com segurança, eliminando mais de 1 milhão de núcleos de CPU em capacidade ociosa.
Em palestra na KubeCon & CloudNativeCon Europe, Marcy Paramonova e Stéphane Cusin mostraram como um banco construiu uma cultura de plataforma colaborativa com sessões abertas de suporte, GitOps e super user awards.
O Karmada, projeto de orquestração multi-cluster e multi-cloud para Kubernetes, alcançou o nível de graduação da CNCF em setembro de 2026, junto ao lançamento da versão 1.19.
Google abriu o código do AX, runtime declarativo licenciado Apache 2.0 que trata agentes de IA como atores stateful, com suspensão e retomada em frações de segundo.
A Modal reconstruiu sua infraestrutura de sandboxes do zero, criando 1 milhão de ambientes isolados em menos de um minuto ao abandonar a coordenação centralizada do Kubernetes em favor de uma frota de agendadores paralelos.
Em palestra no QCon London, Ross McFarlane e Kevin Holditch detalharam como a Form3 migrou de uma arquitetura presa à AWS para uma plataforma ativa-ativa-ativa em AWS, Google Cloud e Azure, usando Kubernetes, Go, NATS JetStream e CockroachDB, e por que nos Estados Unidos adotou standby ativo com RTO e RPO não zero.
Microsoft disponibilizou em código aberto o TauGrid, plataforma que unifica filas, agendamento e monitoramento de workloads de IA em clusters Kubernetes com GPU, com instalação única via Helm e CLI tau.