notícia corporativa inova/ai.inova.in

Aurora coloca modelos de IA em execução por API compatível com OpenAI

O Aurora passou a servir versões de modelos do catálogo em executores com GPU por uma API compatível com OpenAI, com chaves por organização e distinção entre estado solicitado e estado observado.

Arte de notícia corporativa para Aurora coloca modelos de IA em execução por API compatível com OpenAI

A Inova adicionou ao Aurora um módulo de Inferência que coloca versões de modelos do catálogo em execução em um executor com GPU. A mudança importa para gestores públicos de saúde, hospitais e equipes de TI porque cria o caminho entre registrar ou escolher um modelo e utilizá-lo em programas externos. A consequência comprovada é a disponibilidade de um gateway com API compatível com OpenAI para chamadas de geração de texto, embeddings e classificação.

O acesso ao gateway é feito por uma chave de API vinculada à organização. A credencial pode ser limitada a um modelo, a vários modelos ou a todos os modelos daquela organização. O sistema identifica a organização a partir da própria chave, sem depender de um identificador enviado separadamente pelo programa que faz a chamada.

No painel, o Aurora separa a intenção de colocar um modelo no ar do fato observado pelo executor. Assim, uma solicitação para ativar um endpoint não é apresentada automaticamente como execução pronta: o estado exibido depende do relato do processo responsável pela carga do modelo.

A plataforma também determina o tipo de uso a partir da arquitetura registrada no arquivo de configuração do artefato. A regra distingue modelos de geração, classificação e embedding sem inferir a capacidade pelo nome do modelo ou por um rótulo escrito no catálogo. Na prática, o gateway direciona cada modelo para a superfície correspondente e rejeita chamadas incompatíveis.

O módulo registra informações sobre cada invocação, como rota utilizada, código de resposta, latência e quantidade de tokens. O dossiê informa que prompts e respostas não são armazenados nesses registros, uma decisão relevante para operações que podem envolver texto sensível.

A ativação também considera a memória de vídeo disponível. Quando a reserva solicitada não cabe no executor, o sistema recusa a operação e informa a conta de capacidade. O desenho atual associa um processo de execução a cada endpoint e não inclui réplica, fila de espera ou roteamento por carga, segundo a documentação técnica da mudança.

A entrega foi registrada no commit 01a316b7fb62, de 16 de agosto de 2026. O dossiê não informa clientes, contratos, prazo de disponibilidade comercial ou escala de produção; portanto, a mudança descreve a capacidade incorporada ao Aurora, não uma oferta geral já anunciada.

Inova Comunicações

Central de chamados

Conte o que está acontecendo

Não inclua senhas, dados de pacientes ou outras informações sensíveis.