baseten

Visão geral da plataforma

Na prática, o que o baseten faz pelas equipes de IA?

Se você está se perguntando o que o baseten faz, a resposta curta é que Baseten fornece infraestrutura para implantar e disponibilizar modelos de IA. Ela ajuda as equipes a transformar um modelo em um serviço de inferência acessível por aplicativos, sem que precisem construir toda a camada de disponibilização por conta própria.

Ilustração da página inicial da Baseten

Definição em uma frase

Baseten é uma plataforma de infraestrutura de IA voltada a colocar modelos em funcionamento em aplicativos. Sua função principal é disponibilizar modelos: receber solicitações, executar um modelo e retornar resultados.

Leitura de 4 min

Como funciona

A disponibilização de modelos conecta um modelo existente ao software que precisa de suas previsões ou dos resultados que ele gera. A configuração exata depende do modelo e da aplicação.

  1. 1

    Prepare o modelo

    Uma equipe escolhe o modelo que quer executar e define os requisitos de entrada e saída. Um modelo de texto, por exemplo, precisa de um formato de solicitação diferente do de um modelo de imagem.

  2. 2

    Implante um endpoint de inferência

    O modelo é disponibilizado por meio de uma infraestrutura de inferência. Essa infraestrutura cuida do trabalho operacional de receber solicitações e executar o modelo implantado.

  3. 3

    Conecte a aplicação

    O código da aplicação envia entradas ao endpoint e usa o resultado retornado. A equipe ainda precisa testar a qualidade das respostas, lidar com erros e monitorar se os resultados atendem às suas necessidades.

O que ela pode e não pode fazer

A Baseten pode fornecer uma camada de disponibilização de modelos, mas disponibilizar um modelo não é o mesmo que escolhê-lo, avaliá-lo ou estabelecer regras para seu uso. Estes são os requisitos práticos de um projeto de inferência.

Necessário Opcional
  • Uma tarefa definida e um modelo adequado a ela — A infraestrutura não determina se um modelo fornece respostas úteis ou confiáveis.

  • Entradas e saídas esperadas que sua aplicação consiga processar — A aplicação precisa saber o que enviar e como usar ou rejeitar uma resposta.

  • Um plano para testar a qualidade, as falhas e o tratamento de dados — A implantação não substitui a avaliação nem a análise de informações sensíveis.

  • Funcionalidades personalizadas da aplicação relacionadas ao modeloopcional — Uma interface de usuário ou um fluxo de trabalho pode ser necessário, mas é separado da disponibilização do modelo para inferência.

Quem usa

A Baseten é mais relevante para equipes que desenvolvem software que faz chamadas a modelos de IA do que para pessoas que procuram um aplicativo pronto de chat ou edição de imagens.

Ilustração da infraestrutura de IA Trabalho na aplicação

Etapa 1

Desenvolvedores de aplicativos

Um desenvolvedor pode precisar de um serviço de backend que receba uma solicitação do aplicativo, acione um modelo e devolva o resultado ao usuário. A Baseten cuida da parte de disponibilização do modelo nesse processo. A interface, as mensagens de erro e a decisão de quando acionar o modelo continuam sendo responsabilidades da equipe do aplicativo.

  • Conecte o código do aplicativo à inferência do modelo
  • Defina o que acontece quando uma solicitação falha
Ilustração de um fluxo de trabalho de implantação de modelo Operações de modelos

Etapa 2

Equipes de aprendizado de máquina e de plataforma

Essas equipes podem ter um modelo que desejam disponibilizar para outros serviços. A Baseten oferece uma infraestrutura a ser considerada para implantação e inferência, enquanto elas continuam responsáveis por selecionar o modelo, verificar seu comportamento e decidir se ele atende aos requisitos da organização. Essa divisão é importante ao transformar um experimento promissor em um aplicativo confiável.

  • Disponibilize um modelo para outros serviços
  • Avalie os resultados em relação à tarefa pretendida

Explore a infraestrutura de IA

Entender o que a Baseten faz ajuda a distinguir a disponibilização do modelo do próprio modelo e do aplicativo construído em torno dele. Se você estiver explorando ferramentas de IA de forma mais ampla, o link abaixo abre a Synexa, um serviço separado; ele não é um console de implantação da Baseten.

Dê o próximo passo com ferramentas de IA

  • Identifique a tarefa que seu modelo precisa realizar
  • Verifique os recursos do serviço de destino antes de compartilhar dados
Explore ferramentas de IA

Perguntas frequentes

A Baseten fornece infraestrutura para implantar e disponibilizar modelos de IA. Na prática, ela ajuda as equipes a tornar um modelo acessível para solicitações de inferência feitas por seus aplicativos.

Disponibilizar um modelo e desenvolver um aplicativo são tarefas diferentes. A Baseten cuida da infraestrutura usada para executar um modelo, enquanto a equipe que desenvolve o aplicativo decide como os usuários interagem com ele e como seus resultados são tratados.

Não. A implantação possibilita a inferência, mas os resultados do modelo ainda precisam ser testados em relação à tarefa pretendida. As equipes devem avaliar a qualidade, os casos de falha e quaisquer requisitos de tratamento de dados.

Um aplicativo envia uma solicitação de inferência com dados de entrada adequados ao modelo implantado. O modelo produz uma saída que o aplicativo pode processar ou mostrar a um usuário; os dados de entrada e a saída específicos dependem do modelo.

Experimente um prompt
Experimente um prompt