← Voltar ao glossário

API de LLM

Serviço que dá acesso programático a modelos de linguagem: seu sistema envia um prompt via HTTP e recebe a resposta do modelo, pagando geralmente por token processado.

Uma API de LLM é a porta de entrada para usar modelos de linguagem dentro dos seus próprios sistemas. Em vez de conversar num chat, seu código faz uma requisição HTTP com o prompt (e parâmetros como modelo, temperatura e limite de tokens) e recebe de volta o texto gerado. Provedores como OpenAI, Anthropic, Google e Mistral expõem seus modelos assim, e a cobrança costuma ser por token de entrada e saída.

É o que permite construir produtos com IA sem treinar modelo nenhum: chatbots de atendimento, resumo automático de documentos, classificação de mensagens, geração de conteúdo. Também existem agregadores/roteadores (como OpenRouter e LiteLLM), que unificam vários provedores atrás de uma única interface, útil para comparar custo e qualidade ou ter redundância.

Quando usar: sempre que a IA precisa rodar dentro de um fluxo automatizado, e não numa janela de chat. Exemplo concreto: um SaaS de e-mail chama uma API de LLM para cada mensagem recebida, pedindo um resumo de uma linha e uma sugestão de resposta: o usuário só revisa e envia.

Logo de OpenAI API

API e Tokens de IA

OpenAI API

GPT-4o, o1 e DALL-E 3 via API com function calling, output estruturado e descontos em batch.

A partir de R$ 0,78/por token
VERIFICADO
GPT-4o & o1Function calling
Logo de liteLLM

Programação com IA

liteLLM

Gateway de IA open source que coloca toda a sua stack atrás de uma chave compatível com OpenAI: controle de gasto, roteamento de modelos e self-host, com 140+ provedores.

Não disponível
Logo de Groq

API e Tokens de IA

Groq

Inferência de LLM ultrarrápida (Llama 3.3, DeepSeek-R1) atingindo 500+ tokens/segundo via chips LPU.

Grátis
Plano Gratuito
/por token
VERIFICADO
Qwen 3.6 27BLlama 3.3 70B e Whisper Large V3

Categorias

Veja também