GPUs dedicadas em 5 regiões · sem fila compartilhada com terceiros

Inteligência artificial por API,
na nossa própria infraestrutura.

Texto, embeddings, transcrição, geração de imagem e visão computacional numa API só — compatível com o formato da OpenAI, então o seu código provavelmente já fala com ela. Sem repassar o seu dado para terceiros.

23rotas documentadas
~5,5 simagem 1024×1024
1.024dimensões por embedding
5placas no cluster

O que a plataforma faz

Cada grupo abaixo é servido por placas escolhidas para o trabalho: a geração de texto não disputa fila com a de imagem, e os embeddings rodam numa placa separada das duas.

Texto e conversa

5 rotas

Geracao de texto com modelo instruido, servida por Tesla T4 dedicadas. Compativel com o formato da OpenAI: se o seu codigo ja fala com a OpenAI, troque a URL base e a chave e pronto.

Embeddings e busca semantica

2 rotas

Vetores para busca por significado, deduplicacao e RAG, mais reordenacao de resultados. Servidos por uma placa separada da de texto — nao disputam fila com a geracao.

Audio e transcricao

2 rotas

Transcricao com Whisper large-v3, com marcacao de tempo e deteccao de idioma.

Geracao de imagem

1 rota

SDXL-Turbo numa Tesla T4 dedicada a midia. Catalogo 1024x1024 em ~4 s.

Visao computacional

2 rotas

Descrever imagem, responder perguntas sobre ela e extrair texto.

Arquivos

4 rotas

Envie uma vez, use em varias chamadas. Arquivos expiram sozinhos.

Acompanhamento de trabalho

5 rotas

Para chamadas assincronas: acompanhar, aguardar e cancelar.

Modelos e estado

2 rotas

O que o servidor sabe fazer e como ele esta agora.

Comece com uma chamada

Se o seu código já usa a OpenAI, troque a URL base e a chave.

curl https://abintel.digital/api/v1/ai/v1/chat/completions \
  -H "Authorization: Bearer ab_1a2b3c4d5e6f7890.SEU_SEGREDO" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-4o-mini","messages":[{"role":"user","content":"Ola"}]}'

Planos

O que um plano melhor compra, além de volume, é prioridade na fila — passar na frente quando as placas estão cheias.

Avaliação
Grátis

Para experimentar a plataforma.

  • 1.000 chamadas por mês
  • 10 por minuto
  • 1 simultâneas
  • prioridade 7 na fila (0 é a maior)
Solicitar
Profissional
sob consulta

Uso em produção com prioridade alta.

  • 100.000 chamadas por mês
  • 120 por minuto
  • 8 simultâneas
  • prioridade 3 na fila (0 é a maior)
Solicitar
Dedicado
sob consulta

Sem teto mensal, placa reservada.

  • sem teto chamadas por mês
  • sem teto por minuto
  • 16 simultâneas
  • prioridade 1 na fila (0 é a maior)
Solicitar

Solicitar acesso

Escreva para contato@abintel.digital dizendo o que você pretende construir e o volume estimado. Respondemos com a credencial e o plano adequado. Não há autoatendimento por cartão: cada conta é aberta por uma pessoa, e é assim que conseguimos garantir a fila de quem já está dentro.