Compatível com OpenAI · transcrição no ar

A API de inferência elementar.

Inferência de IA rápida e barata atrás de uma API limpa. Comece pela transcrição — compatível sem mudar código, a partir de ~R$ 0,80 por hora de áudio, 230× tempo real e a melhor acurácia em português do Brasil. LLM, TTS e tempo real em seguida.

Apoiado pelo Google for Startups Cloud Program
ligacao-suporte.mp3transcrevendo

12,4s de áudio · 54 ms de processamento · 230× tempo real
230×
mais rápido que o tempo real
~R$ 0,80
por hora de áudio
PT-BR
acurácia de ponta, +50 idiomas
<1s
de latência em áudios curtos
Por que Inferentium

Inferência refinada ao elemento.

Tudo que você precisa para colocar inteligência de áudio em produção — com preço de commodity e engenharia de produto.

Compatível com OpenAI

Endpoint /v1/audio/transcriptions plug-and-play. Troque só a base_url e mantenha seu SDK, seus prompts e seus pipelines.

230× o tempo real

Uma gravação de 90 minutos transcreve em cerca de 25 segundos na nossa frota de GPUs NVIDIA de última geração. Com batching e autoescala, a vazão se mantém sob carga.

Português do Brasil em primeiro lugar

Modelo ajustado para PT-BR: sotaques, gírias e nomes próprios brasileiros. E mais de 50 idiomas com detecção automática.

Créditos pré-pagos

Pague por segundo de áudio. Sem assinatura e sem mínimo. Recarregue no cartão e acompanhe o consumo de forma transparente.

Síncrono e assíncrono

Faça upload e espere a resposta, ou envie um job e receba um webhook assinado ao terminar. Feito para clipes e para arquivos de horas.

Uma API, vários modelos

Transcrição hoje; LLM, síntese de voz e streaming em tempo real nas mesmas chaves, créditos e cobrança.

Como funciona

No ar em três passos.

Sem infraestrutura para manter, sem modelo para hospedar, sem GPU para cuidar.

01

Crie uma chave

Cadastre-se e gere sua chave de API em segundos. Créditos grátis para começar — sem cartão.

02

Troque uma linha

Aponte o seu SDK atual para a nossa base URL. O resto do seu código continua igual.

03

Suba para produção

Transcreva um clipe em menos de um segundo ou horas de áudio em segundos. Pague só pelo que processar.

Comece agora

Uma base_url. A migração é isso.

Use o SDK que você já tem, ou chame o endpoint REST direto.

transcribe.py
from openai import OpenAI
client = OpenAI(
base_url="https://api.inferentium.ai/v1", # the only change
api_key="tapi_...",
)
tx = client.audio.transcriptions.create(
model="inferentium-stt",
file=open("call.mp3", "rb"),
)
print(tx.text)
Comparativo

Preço de commodity.

A mesma interface sem mudar código, por uma fração do custo.

InferentiumWhisper APIASR gerenciado típico
Preço por hora de áudio~R$ 0,80~R$ 1,90R$ 1,30 – R$ 7,60
Velocidade (fator tempo real)230×~10–20×1–15×
API compatível com OpenAISimNativaRaramente
CobrançaPré-pago, por segundoPor minuto, pós-pagoAssinatura / compromisso
Jobs assíncronos + webhooksIncluídoNãoVaria

Com base em preços públicos de 2026, convertidos para real a título de referência. A cobrança é feita em dólar. A vazão real varia com a duração do áudio e a concorrência.

Seu áudio não vira dado de treino

Usamos seu áudio apenas para gerar a sua transcrição. Nada é retido para treinar modelos.

Adequado à LGPD

Tratamento de dados pessoais conforme a LGPD, com contrato e acordo de tratamento de dados para empresas.

Dados no Brasil

Frota dedicada e residência de dados em região brasileira disponíveis nos planos enterprise.

Preços

Preço de commodity. Sem amarras.

Cobrado por segundo de áudio via créditos pré-pagos. Estimativa: 1.000 horas ≈ R$ 800. A cobrança é feita em dólar (~US$ 0,15/hora); valores em real são aproximados.

Pré-pago
R$ 0,80 / hora de áudio
  • API compatível com OpenAI
  • PT-BR de ponta e +50 idiomas
  • Modo síncrono e assíncrono
  • Créditos pré-pagos, sem mínimo
Começar grátis
Escala
Desconto por volume
  • Tudo do plano pré-pago
  • Preço por hora menor no volume
  • Limites e prioridade maiores
  • Análise de consumo e alertas
Começar agora
Enterprise
Sob consulta
  • Frota de GPU dedicada
  • Implantação em VPC ou on-premise
  • Residência de dados no Brasil
  • SLA e suporte
Falar com vendas
Dúvidas

Perguntas frequentes.

Coloque inteligência de áudio no ar hoje.

Pegue sua chave de API em segundos. Créditos grátis para começar. Troque uma linha e está no ar.

Pegar minha chave de API