O gateway de IA empresarial para mais de 100 modelos
— transparente por concepção
Mais de 100 modelos por trás de uma única API — GPT, Claude e Gemini, a par de DeepSeek, Qwen, GLM e Kimi, do texto à geração de imagem e vídeo. Governado como equipa: papéis, orçamentos e registo de auditoria já incluídos.
Nossos compromissos empresariais em quatro números
* O SLA cobre a disponibilidade da plataforma Ofox. As falhas dos fornecedores de modelos a montante ficam excluídas.
Infraestrutura de IA de nível empresarial logo no primeiro pedido
Uma API, um painel, uma fatura — com o controlo, a fiabilidade e o tratamento de dados que uma implementação em produção exige. Os 0% de taxa de plataforma são apenas o ponto de partida.
0% de taxa — preços oficiais do fornecedor
Faturado à tarifa oficial do fornecedor do modelo — o preço na ficha é o preço que paga. À medida que o volume cresce, aplicam-se automaticamente créditos até 7%.
Uma chave de API para GPT, Claude, Gemini e mais de 100 modelos
Aceda a Claude, GPT, Gemini, DeepSeek, Qwen e mais de 100 modelos com uma única chave de API. Totalmente compatível com o SDK da OpenAI.
SLA de disponibilidade de 99,9% com failover multirregião *
Redundância multirregião com failover automático. Compromissos de disponibilidade por escrito.
Controlo de custos granular por chave e por utilizador
Defina orçamentos diários, semanais ou mensais por chave ou por utilizador, com limitação automática de pedidos. Os painéis de utilização em tempo real eliminam faturas inesperadas.
Sem armazenamento persistente de conteúdo
Os prompts e as respostas nunca são usados para treino. Guardam-se apenas registos operacionais de curta duração, além dos metadados do pedido e do consumo de tokens necessários à faturação.
Suporte técnico por escalões
Quanto maior o volume, mais rápidos os tempos de resposta. As contas do escalão superior têm um contacto técnico dedicado e tratamento prioritário de tickets.
Observabilidade de LLM (Langfuse, Datadog, Weave)
Em breveRegisto opcional de prompts e respostas, transmitido para Langfuse, Datadog e outras plataformas para depuração e análise — a mesma atribuição que vê no painel, exportada para a stack de observabilidade que já utiliza.
* O SLA cobre apenas a disponibilidade da plataforma Ofox; as falhas dos fornecedores de modelos a montante ficam excluídas.
Segurança e conformidade: encaminhar, não guardar
A função de um gateway é transportar os seus pedidos, não retê-los. O tráfego é cifrado com TLS, o conteúdo nunca é conservado nem usado para treino — e quando uma certificação ainda está em curso, dizemo-lo abaixo.
Como os seus dados são tratados
Cifrado com TLS em trânsito
Todo o tráfego de API é cifrado ponta a ponta entre os seus sistemas e os nossos.
Sem armazenamento persistente de prompts ou respostas
Os prompts e as respostas não são conservados — apenas registos operacionais de curta duração, além dos metadados do pedido e da contagem de tokens exigidos para faturar.
Os seus dados nunca são usados para treino
O seu conteúdo não é usado para treinar modelos, nossos ou de terceiros. Os fornecedores a montante ficam sujeitos às respetivas condições empresariais.
Certificações e acordos de dados
SOC 2 Type II
Auditoria a decorrer — prevista para o 3.º trimestre de 2026
ISO 27001
Prevista para o 3.º trimestre de 2026
GDPR
DPA com cláusulas contratuais-tipo; lista de subcontratantes mediante pedido
DPA
Mediante pedido, antes da assinatura do contrato
Não reivindicamos certificações que ainda não temos. Se algum referencial condicionar o seu calendário de avaliação, diga-nos e partilhamos a fase atual da auditoria.
Analítica de utilização para equipas de desenvolvimento
Custo, desempenho e consumo em tempo real — atribuídos a cada modelo, chave de API e membro. As revisões de despesa e o planeamento de capacidade assentam em dados, não na reconciliação de fim de mês.
Integração: mude o URL base e mantenha o seu SDK
O Ofox é compatível com os SDK da OpenAI, da Anthropic e do Gemini. Não há nada a reescrever nem cliente proprietário a adotar.
Compatível com os SDK da OpenAI, da Anthropic e do Gemini
from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1", # ← a única alteração
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)Funciona com Claude Code, Cursor, LangChain e mais
Todas as integraçõesComo decorre uma implementação empresarial
Passo 1 Registe-se e teste
Crie uma conta, adicione saldo e faça a sua própria avaliação — não é preciso uma chamada comercial para perceber se os modelos, a latência e os preços servem a sua carga de trabalho.
Passo 2 Faça um piloto com orçamentos definidos
Coloque uma única carga de trabalho em produção, já com orçamentos e limites definidos. Valide latência, qualidade e faturação com os seus próprios números.
Passo 3 Entre em produção com papéis e limites por chave
Distribua papéis e orçamentos por chave a toda a equipa. Quanto maior o volume, mais rápidos os tempos de resposta e um contacto técnico atribuído.
FAQ para empresas
Em que é que o Ofox difere das APIs oficiais dos fornecedores?
Mantém os preços oficiais — 0% de taxa de plataforma — e substitui várias integrações por uma só: uma chave, uma fatura e um painel para OpenAI, Anthropic, Google, DeepSeek, Qwen, GLM, Kimi e mais de 100 modelos, com papéis, orçamentos e registo de auditoria incluídos. Ir diretamente significa uma relação comercial, um SDK e uma fatura por fornecedor; o Ofox consolida tudo isso sem margem.
O que cobre o SLA de 99,9%?
A disponibilidade da plataforma Ofox — o gateway, o encaminhamento e a camada de API. As falhas com origem num fornecedor de modelos a montante ficam excluídas, uma vez que não controlamos a infraestrutura dele. Peça-nos as condições de créditos de serviço em vigor.
O que acontece quando um fornecedor de modelos a montante tem uma falha?
As falhas ao nível da plataforma são contornadas automaticamente entre as nossas regiões. Quando é o próprio fornecedor que está em baixo, devolvemos o erro de forma clara em vez de degradar o serviço em silêncio — e, como a API é agnóstica ao modelo, a maioria das equipas passa para um modelo equivalente mudando uma única cadeia de texto. Estas falhas estão excluídas do nosso SLA, e dizemo-lo à partida.
Quanto tempo demora a integração?
Minutos, para a maioria das equipas. A API é compatível com os SDK da OpenAI, da Anthropic e do Gemini: muda o URL base e a chave e mantém o código existente.
Guardam os nossos prompts e respostas?
Não. O conteúdo dos pedidos é processado em tempo real e não é conservado — apenas registos operacionais de curta duração, além dos metadados e da contagem de tokens necessários para faturar. Todo o tráfego é cifrado com TLS em trânsito.
Os nossos dados são usados para treinar modelos?
Nunca. Os seus prompts e respostas não são usados para treinar modelos, nossos ou de terceiros. Os fornecedores a montante ficam sujeitos às respetivas condições empresariais.
Têm certificação SOC 2?
Ainda não. A auditoria SOC 2 Type II está em curso, prevista para o 3.º trimestre de 2026, e a ISO 27001 segue o mesmo calendário. Não reivindicamos uma certificação antes de ser emitida — se a sua avaliação depender de alguma delas, contacte-nos e partilhamos por escrito a fase atual da auditoria.
Cumprem o RGPD?
Sim. Disponibilizamos um DPA com cláusulas contratuais-tipo, ciframos todo o tráfego em trânsito, não guardamos o conteúdo dos pedidos e podemos partilhar a lista de subcontratantes mediante pedido. Contacte-nos e enviamos a documentação para a sua avaliação.
Como funciona o preço?
Pagamento a uso à tarifa oficial do fornecedor do modelo, com 0% de taxa de plataforma — o preço apresentado na ficha do modelo é o preço cobrado. Sem mensalidade, sem mínimo de plataforma e sem percentagem no carregamento. O volume sustentado gera créditos automaticamente, até 7%.
Os pedidos falhados são cobrados?
Não. Os pedidos que falham devolvem um erro claro e não são cobrados — paga apenas os pedidos concluídos.
O saldo pré-pago expira?
Não. O saldo permanece disponível até o utilizar — não tem data de validade nem exige um mínimo mensal para se manter ativo.
Como limitamos o gasto de um membro da equipa?
Defina na consola um limite diário, semanal ou mensal por membro ou por chave de API. Ao atingir o limite, os pedidos são automaticamente restringidos e o acesso retoma no período seguinte — sem faturas inesperadas por causa de um script descontrolado.
Podemos restringir os modelos que a equipa pode invocar?
Sim. O acesso é gerido por papel e por chave, pelo que pode limitar a utilização a um conjunto de modelos aprovados e aplicar limites de gasto em simultâneo.
Suportam SSO?
Diga-nos qual é o seu fornecedor de identidade e confirmamos o que é suportado hoje e o que está no roteiro.
Todos os modelos de que a sua equipa precisa, com todo o controlo que a sua empresa exige.
Experimente primeiro um modelo no playground ou fale connosco sobre a implementação na sua equipa — modelos, regiões e requisitos de avaliação incluídos.