A Microsoft deu um passo significativo na infraestrutura para inteligência artificial corporativa ao anunciar o novo AI Gateway do Azure API Management, agora disponível em preview público.
- Nova camada dedicada do Azure API Management foca o gerenciamento em modelos de IA e servidores MCP.
- Substitui configurações complexas em XML por cartões visuais para controlar cotas de tokens e Content Safety.
- Suporta múltiplos provedores de forma integrada, incluindo Azure Foundry, AWS Bedrock e Google Vertex AI.
- Chaves de runtime atualmente possuem escopo global por gateway, exigindo cautela na estratégia de segurança durante o preview.
O que muda com a nova camada de AI gateway do azure?
O novo AI Gateway do Azure foi concebido como uma experiência independente, e não apenas como mais uma camada de políticas XML sobre os gateways clássicos ou de versão v2. A proposta central é que as empresas agora interagem com múltiplos provedores de IA simultaneamente, demandando ferramentas de governança que reflitam essa realidade híbrida e multimodelo.
Neste preview, o gateway é capaz de expor modelos hospedados no Azure AI Foundry (incluindo OpenAI, Anthropic e Mistral), bem como conexões diretas para o AWS Bedrock, Google Vertex AI e a própria OpenAI externa. Todos os provedores compatíveis com o padrão OpenAI compartilham o mesmo caminho de endpoint, com o gateway roteando as requisições com base na correspondência exata do campo do modelo solicitado.
# publicidade
- Configuração de políticas baseada em cartões visuais no portal, substituindo os tradicionais arquivos XML complexos.
- Controle nativo de limites de requisição, cotas de tokens, Content Safety e fallback de modelos.
- Provisionamento rápido em cerca de um minuto, sem a necessidade de planejar unidades de escala antecipadamente.
Integração com servidores mcp e ferramentas externas
Além do roteamento de modelos, o AI Gateway atua como um federador de backends para ferramentas corporativas através de três fontes principais: servidores remotos que utilizam o Model Context Protocol (MCP) via URL, especificações OpenAPI padronizadas ou conectores embutidos que cobrem mais de mil aplicações SaaS.
Cada operação do backend integrado torna-se uma ferramenta utilizável pelos agentes e modelos de IA. Os administradores podem determinar, por backend, o método de autenticação desejado, incluindo chaves de API, OAuth 2.0, identidades gerenciadas ou acesso público direto.
Perspectivas sobre governança e ciclo de vida dos agentes
A reação inicial de arquitetos e engenheiros de plataforma foi majoritariamente positiva quanto à consolidação de custos e segurança de tráfego, embora o modelo traga novas discussões de arquitetura. Especialistas como Paolo Perrone apontam que centralizar a governança de custos e limites de tokens no gateway evita soluções improvisadas e paliativas em nível de aplicação.
Por outro lado, arquitetos de sistemas corporativos levantam questionamentos sobre o limite da governança do gateway em relação ao ciclo de vida dos agentes de IA. Se uma execução de agente falhar ou não terminar de forma limpa, a decisão de preservar o estado para auditoria ou realizar o failover deve ocorrer no gateway ou na camada de orquestração superior? Essa fronteira arquitetural ainda permanece aberta na indústria.
A concorrência e as limitações do modelo de preview
Embora o movimento do Azure seja visto como necessário, analistas de dados apontam que concorrentes como Databricks e AWS já possuem ofertas robustas de governança. O Unity AI Gateway da Databricks, por exemplo, já estende o Unity Catalog para cobrir modelos, agentes, serviços MCP e habilidades em tempo de execução, com limites rígidos de gastos corporativos.
Além disso, uma decisão de design de segurança na solução do Azure merece atenção: as chaves de acesso de tempo de execução são aplicadas no escopo geral do gateway. Isso significa que uma chave vazada concede acesso a todos os modelos e ferramentas publicados naquele gateway específico, diferentemente das assinaturas do APIM tradicional que permitem um escopo mais granular por produto.
A Microsoft reforça que, durante o período de preview público, a disponibilidade ocorre em regime de melhor esforço (sem SLA), e os limites de taxa de transferência, preços futuros e recursos de telemetria podem sofrer alterações até o lançamento geral (GA).
| Característica | Nova Camada AI Gateway | Camadas APIM Tradicionais (v2/Premium) |
|---|---|---|
| Foco de Controle | Modelos de IA, servidores MCP e ferramentas | APIs REST, SOAP e microsserviços tradicionais |
| Configuração de Políticas | Interface visual simplificada por cartões | Políticas baseadas em XML e expressões personalizadas |
| Escopo das Chaves de Acesso | Escopo global por gateway | Escopo granular por assinaturas e produtos de API |
| Tempo de Provisionamento | Aproximadamente 1 minuto | Vários minutos dependendo do tier e escala de unidades |
Arraste para o lado para ver toda a tabela.