Compatível com OpenAI
Endpoint /v1/audio/transcriptions plug-and-play. Troque só a base_url e mantenha seu SDK, seus prompts e seus pipelines.
Inferência de IA rápida e barata atrás de uma API limpa. Comece pela transcrição — compatível sem mudar código, a partir de ~R$ 0,80 por hora de áudio, 230× tempo real e a melhor acurácia em português do Brasil. LLM, TTS e tempo real em seguida.
Tudo que você precisa para colocar inteligência de áudio em produção — com preço de commodity e engenharia de produto.
Endpoint /v1/audio/transcriptions plug-and-play. Troque só a base_url e mantenha seu SDK, seus prompts e seus pipelines.
Uma gravação de 90 minutos transcreve em cerca de 25 segundos na nossa frota de GPUs NVIDIA de última geração. Com batching e autoescala, a vazão se mantém sob carga.
Modelo ajustado para PT-BR: sotaques, gírias e nomes próprios brasileiros. E mais de 50 idiomas com detecção automática.
Pague por segundo de áudio. Sem assinatura e sem mínimo. Recarregue no cartão e acompanhe o consumo de forma transparente.
Faça upload e espere a resposta, ou envie um job e receba um webhook assinado ao terminar. Feito para clipes e para arquivos de horas.
Transcrição hoje; LLM, síntese de voz e streaming em tempo real nas mesmas chaves, créditos e cobrança.
Sem infraestrutura para manter, sem modelo para hospedar, sem GPU para cuidar.
Cadastre-se e gere sua chave de API em segundos. Créditos grátis para começar — sem cartão.
Aponte o seu SDK atual para a nossa base URL. O resto do seu código continua igual.
Transcreva um clipe em menos de um segundo ou horas de áudio em segundos. Pague só pelo que processar.
Use o SDK que você já tem, ou chame o endpoint REST direto.
from openai import OpenAIclient = OpenAI( base_url="https://api.inferentium.ai/v1", # the only change api_key="tapi_...",)tx = client.audio.transcriptions.create( model="inferentium-stt", file=open("call.mp3", "rb"),)print(tx.text)A mesma interface sem mudar código, por uma fração do custo.
| Inferentium | Whisper API | ASR gerenciado típico | |
|---|---|---|---|
| Preço por hora de áudio | ~R$ 0,80 | ~R$ 1,90 | R$ 1,30 – R$ 7,60 |
| Velocidade (fator tempo real) | 230× | ~10–20× | 1–15× |
| API compatível com OpenAI | Sim | Nativa | Raramente |
| Cobrança | Pré-pago, por segundo | Por minuto, pós-pago | Assinatura / compromisso |
| Jobs assíncronos + webhooks | Incluído | Não | Varia |
Com base em preços públicos de 2026, convertidos para real a título de referência. A cobrança é feita em dólar. A vazão real varia com a duração do áudio e a concorrência.
Usamos seu áudio apenas para gerar a sua transcrição. Nada é retido para treinar modelos.
Tratamento de dados pessoais conforme a LGPD, com contrato e acordo de tratamento de dados para empresas.
Frota dedicada e residência de dados em região brasileira disponíveis nos planos enterprise.
Cobrado por segundo de áudio via créditos pré-pagos. Estimativa: 1.000 horas ≈ R$ 800. A cobrança é feita em dólar (~US$ 0,15/hora); valores em real são aproximados.
Pegue sua chave de API em segundos. Créditos grátis para começar. Troque uma linha e está no ar.
Pegar minha chave de API →