Cálculo de custos

O Studio calcula automaticamente o custo de cada execução de workflow a partir do uso de modelos de IA mais uma taxa base por execução.

Créditos

O Studio usa créditos como unidade de medida de todo o consumo. 1 crédito = $0.005.

Todos os limites de plano, medidores de consumo e limiares de cobrança aparecem em créditos por toda a interface do Studio. Os valores em dólar nesta documentação servem apenas como referência.

Como os custos são calculados

Toda execução de workflow tem dois componentes de custo:

Taxa base por execução: 1 crédito ($0.005) por execução

Uso de modelos de IA: custo variável conforme o consumo de tokens

modelCost = (inputTokens × inputPrice + outputTokens × outputPrice) / 1,000,000
totalCredits = baseRunCharge + modelCost × 200

Os preços dos modelos de IA são por milhão de tokens. Workflows sem blocks de IA pagam apenas a taxa base por execução.

Detalhamento por modelo nos Logs

Em workflows que usam blocks de IA, você pode ver informações detalhadas de custo nos Logs:

O detalhamento por modelo mostra:

  • Uso de tokens: contagem de tokens de entrada e de saída de cada modelo
  • Detalhamento de custos: custos individuais por modelo e por operação
  • Distribuição de modelos: quais modelos foram usados e quantas vezes
  • Custo total: custo agregado de toda a execução do workflow

Opções de preço

Modelos hospedados - o Studio fornece as chaves de API com um multiplicador de 1.1x sobre o preço, para blocks Agent:

OpenAI

ModeloPreço base (entrada/saída)Preço hospedado (entrada/saída)
GPT-5.1$1.25 / $10.00$1.38 / $11.00
GPT-5$1.25 / $10.00$1.38 / $11.00
GPT-5 Mini$0.25 / $2.00$0.28 / $2.20
GPT-5 Nano$0.05 / $0.40$0.06 / $0.44
GPT-4o$2.50 / $10.00$2.75 / $11.00
GPT-4.1$2.00 / $8.00$2.20 / $8.80
GPT-4.1 Mini$0.40 / $1.60$0.44 / $1.76
GPT-4.1 Nano$0.10 / $0.40$0.11 / $0.44
o1$15.00 / $60.00$16.50 / $66.00
o3$2.00 / $8.00$2.20 / $8.80
o4 Mini$1.10 / $4.40$1.21 / $4.84

Anthropic

ModeloPreço base (entrada/saída)Preço hospedado (entrada/saída)
Claude Opus 4.5$5.00 / $25.00$5.50 / $27.50
Claude Opus 4.1$15.00 / $75.00$16.50 / $82.50
Claude Sonnet 4.5$3.00 / $15.00$3.30 / $16.50
Claude Sonnet 4.0$3.00 / $15.00$3.30 / $16.50
Claude Haiku 4.5$1.00 / $5.00$1.10 / $5.50

Google

ModeloPreço base (entrada/saída)Preço hospedado (entrada/saída)
Gemini 3 Pro Preview$2.00 / $12.00$2.20 / $13.20
Gemini 2.5 Pro$1.25 / $10.00$1.38 / $11.00
Gemini 2.5 Flash$0.30 / $2.50$0.33 / $2.75

O multiplicador de 1.1x cobre os custos de infraestrutura e de gerenciamento de API.

Suas próprias chaves de API - use qualquer modelo pelo preço base:

ProvedorModelos de exemploEntrada / Saída
DeepseekV3, R1$0.75 / $1.00
xAIGrok 4 Latest, Grok 3$3.00 / $15.00
GroqLlama 4 Scout, Llama 3.3 70B$0.11 / $0.34
CerebrasLlama 4 Scout, Llama 3.3 70B$0.11 / $0.34
OllamaModelos locaisGrátis
VLLMModelos locaisGrátis

Pague direto aos provedores, sem acréscimo

Os preços mostrados refletem as tarifas de 10 de setembro de 2025. Consulte a documentação do provedor para os valores atuais.

Preços de ferramentas hospedadas

Quando workflows usam blocks de ferramenta com as chaves de API hospedadas do Studio, o custo é cobrado por operação. Use suas próprias chaves via BYOK para pagar direto aos provedores.

Firecrawl - scraping, crawling, busca e extração na web

OperaçãoCusto
Scrape$0.001 por crédito usado
Crawl$0.001 por crédito usado
Search$0.001 por crédito usado
Extract$0.001 por crédito usado
Map$0.001 por crédito usado

Exa - busca e pesquisa com IA

OperaçãoCusto
SearchDinâmico (retornado pela API)
Get ContentsDinâmico (retornado pela API)
Find Similar LinksDinâmico (retornado pela API)
AnswerDinâmico (retornado pela API)

Serper - API de busca do Google

OperaçãoCusto
Search (≤10 resultados)$0.001
Search (>10 resultados)$0.002

Perplexity - chat e busca na web com IA

OperaçãoCusto
Search$0.005 por requisição
ChatPor token (varia conforme o modelo)

Linkup - busca na web e recuperação de conteúdo

OperaçãoCusto
Busca padrão~$0.006
Busca profunda~$0.055

Parallel AI - busca na web, extração e pesquisa profunda

OperaçãoCusto
Search (≤10 resultados)$0.005
Search (>10 resultados)$0.005 + $0.001 por resultado adicional
Extract$0.001 por URL
Deep Research$0.005–$2.40 (varia conforme o nível do processador)

Jina AI - leitura e busca na web

OperaçãoCusto
Read URL$0.20 por 1M tokens
Search$0.20 por 1M tokens (mínimo de 10K tokens)

Google Cloud - APIs Translate, Maps, PageSpeed e Books

OperaçãoCusto
Translate / Detect$0.00002 por caractere
Maps (Geocode, Directions, Distance Matrix, Elevation, Timezone, Reverse Geocode, Geolocate, Validate Address)$0.005 por requisição
Maps (Snap to Roads)$0.01 por requisição
Maps (Place Details)$0.017 por requisição
Maps (Places Search)$0.032 por requisição
PageSpeedGrátis
Books (Search, Details)Grátis

Brandfetch - ativos de marca, logos, cores e dados de empresas

OperaçãoCusto
SearchGrátis
Get Brand$0.04 por requisição

Chaves próprias (BYOK)

Use suas próprias chaves de API nos provedores suportados, em vez das chaves hospedadas do Studio, e pague o preço base sem acréscimo.

Provedores suportados

ProvedorUso
OpenAIEmbeddings da Knowledge Base, block Agent
AnthropicBlock Agent
GoogleBlock Agent
MistralOCR da Knowledge Base, block Agent
FireworksBlock Agent
FirecrawlScraping, crawling, busca e extração na web
ExaBusca e pesquisa com IA
SerperAPI de busca do Google
LinkupBusca na web e recuperação de conteúdo
Parallel AIBusca na web, extração e pesquisa profunda
PerplexityChat e busca na web com IA
Jina AILeitura e busca na web
Google CloudAPIs Translate, Maps, PageSpeed e Books
BrandfetchAtivos de marca, logos, cores e dados de empresas

Configuração

  1. Abra Settings → BYOK no seu workspace
  2. Clique em Add Key para o seu provedor
  3. Informe sua chave de API e salve

As chaves BYOK são criptografadas em repouso. Apenas admins do workspace podem gerenciá-las.

Quando configurada, os workflows usam sua chave em vez das chaves hospedadas do Studio. Se você removê-la, os workflows voltam automaticamente às chaves hospedadas, com o multiplicador.

Entrada por voz

A entrada por voz usa o ElevenLabs Scribe v2 Realtime para transcrever fala em texto. Está disponível no Chat e no modo de voz do chat com deploy.

ContextoCusto por sessãoDuração máxima
Chat (workspace)~5 créditos ($0.024)3 minutos
Chat com deploy (modo de voz)~2 créditos ($0.008)1 minuto

Cada sessão de voz é cobrada no momento em que começa. No modo de voz do chat com deploy, cada turno da conversa (você fala → o agente responde → você fala de novo) é uma sessão separada. Conversas com vários turnos são cobradas por turno.

A entrada por voz exige que ELEVENLABS_API_KEY esteja configurada. Sem a chave, os controles de entrada por voz ficam ocultos.

Planos

O Studio tem dois níveis de plano pago - Pro e Max. Os dois podem ser usados individualmente ou com um time. Nos planos de time, os créditos são compartilhados entre todos os assentos da organização.

PlanoPreçoCréditos incluídosRecarga diária
Community$01,000 (única vez)-
Pro$25/mês6,000/mês+50/dia
Max$100/mês25,000/mês+200/dia
EnterprisePersonalizadoPersonalizado-

Para usar o Pro ou o Max com um time, selecione Get For Team nas configurações de assinatura e escolha o nível e o número de assentos. Os créditos são compartilhados na organização conforme a tarifa por assento (por exemplo, Max for Teams com 3 assentos = 75,000 créditos/mês compartilhados).

Membros internos da organização ocupam assentos e contribuem para a cota de créditos compartilhada do time. Membros externos do workspace não entram na sua organização, não aparecem na lista de membros dela e não contam no seu total de assentos.

Créditos de recarga diária

Os planos pagos incluem uma pequena cota diária de créditos que não conta no limite do plano. A cada dia, o consumo até o valor da recarga diária fica de fora do consumo faturável. Essa cota é renovada a cada 24 horas e não acumula - ou você usa, ou perde.

PlanoRecarga diária
Pro50 créditos/dia ($0.25)
Max200 créditos/dia ($1.00)

Nos planos de time, a recarga diária escala com os assentos (por exemplo, Max for Teams com 3 assentos = 600 créditos/dia).

Cobrança anual

Todos os planos pagos estão disponíveis com cobrança anual e 15% de desconto. Alterne entre cobrança mensal e anual em Settings → Subscription.

PlanoMensalAnual (por mês)Total anual
Pro$25/mês$21.25/mês$255/ano
Max$100/mês$85/mês$1,020/ano

Os planos de time seguem o mesmo preço por assento.

Cobrança on-demand

Por padrão, seu consumo é limitado aos créditos incluídos no plano. Para consumir além do que está incluído, você pode ativar a cobrança on-demand ou editar manualmente seu limite de consumo para qualquer valor acima do mínimo do plano.

  • Enable On-Demand: remove o limite de consumo por completo. Você paga o excedente no fim do período de cobrança.
  • Edit Usage Limit: define um limite específico acima do valor incluído no plano, para controlar quanto excedente você aceita.
  • Disable On-Demand: devolve seu limite de consumo ao valor incluído no plano (disponível apenas se o consumo atual ainda não tiver passado desse valor).

A cobrança on-demand nos planos de time é gerenciada pelos owners e administradores da organização. A permissão de admin do workspace, por si só, não dá autoridade sobre cobrança.

Limites dos planos

Workspaces

PlanoWorkspaces pessoaisWorkspaces compartilhados (organização)
Free1—
ProAté 3—
MaxAté 10—
Team / Enterprise—Ilimitados (Owners e Admins)

Os planos Team e Enterprise liberam workspaces compartilhados que pertencem à sua organização. Todo workspace criado sob um plano Team ou Enterprise é da organização: Owners e Admins podem criar workspaces compartilhados sem limite, enquanto Members da organização não podem criar workspaces. Quando alguém entra na organização como membro interno, os workspaces pessoais dele passam para a organização e o consumo dele é cobrado dela a partir de então. Membros internos contam no seu total de assentos — convites no Enterprise exigem um assento livre no momento do convite, enquanto os planos Team adicionam um assento automaticamente quando o convidado aceita. Membros externos do workspace ganham acesso a workspaces específicos sem entrar na sua organização nem ocupar um dos seus assentos; eles precisam já estar em um plano pago do Studio (a própria assinatura Pro ou Max, ou outra organização que os acomode), e quem já pertence a outra organização sempre entra dessa forma. Quando uma assinatura Team ou Enterprise é cancelada ou rebaixada, os workspaces compartilhados existentes continuam acessíveis aos membros atuais, mas novos convites ficam desativados até a organização voltar a ser atualizada.

Rate limits

PlanoSync (req/min)Async (req/min)
Free50200
Pro1501,000
Max3002,500
Enterprise6005,000

Os rate limits seguem o nível pago: Pro e Pro for Teams compartilham os limites do Pro; Max e Max for Teams compartilham os limites do Max.

Execuções concorrentes

PlanoExecuções concorrentes
Free10
Pro50
Max200
Enterprise1,000 por padrão (personalizável)

O limite de concorrência vale por conta de cobrança. Nos planos de organização, o limite é compartilhado por todos os workspaces, membros e chaves de API daquela organização. Os planos Teams seguem o próprio nível: Pro for Teams usa o limite do Pro e Max for Teams usa o limite do Max. Uma execução async admitida ocupa um slot enquanto está na fila e enquanto roda; execuções síncronas ocupam um slot enquanto rodam. Blocks de workflow dentro de workflow executam dentro da execução pai e não consomem outro slot de concorrência.

Armazenamento de arquivos

PlanoArmazenamento
Free5 GB
Pro50 GB
Max500 GB
Enterprise500 GB (personalizável)

O armazenamento segue o nível pago: Pro e Pro for Teams compartilham o limite do Pro; Max e Max for Teams compartilham o limite do Max. O armazenamento da organização é compartilhado entre os workspaces dela.

Limites de tempo de execução

PlanoSyncAsync
Free5 minutos90 minutos
Pro / Max / Team50 minutos90 minutos
Enterprise50 minutos90 minutos por padrão; configurável até 7 dias

Execuções sync terminam na hora e retornam o resultado direto. São disparadas pela API com async: false (padrão) ou pela interface. Execuções async (disparadas pela API com async: true, por webhooks, agendamentos, triggers de polling ou colunas de workflow em Tables) rodam em segundo plano. Uma requisição async direta pode encurtar a política da conta para aquela requisição, mas não pode estendê-la.

Se um workflow passar do limite de tempo, ele é encerrado e marcado como falha com erro de timeout. Projete workflows longos para usar execuções async ou divida-os em workflows menores.

Modelo de cobrança

O Studio usa um modelo de cobrança de assinatura base + excedente:

Como funciona

Plano Pro ($25/mês - 6,000 créditos):

  • A assinatura mensal inclui 6,000 créditos de consumo
  • Consumo abaixo de 6,000 créditos → sem cobranças adicionais
  • Consumo acima de 6,000 créditos (com on-demand ativado) → você paga o excedente no fim do mês
  • Exemplo: 7,000 créditos usados = $25 (assinatura) + $5 (excedente de 1,000 créditos extras a $0.005/crédito)

Planos de time:

  • O consumo é compartilhado entre os membros internos do time na organização
  • O consumo em um workspace da organização é cobrado da organização daquele workspace, incluindo o trabalho feito por colaboradores externos
  • O consumo de cada ator autenticado também conta para o limite dele como membro daquela organização
  • O excedente é calculado com base no consumo total do time em relação ao limite compartilhado
  • O owner da organização recebe uma única fatura

Planos Enterprise:

  • Preço mensal fixo, sem excedentes
  • Limites de consumo personalizados conforme o contrato

Cobrança por limiar

Quando o on-demand está ativado e o excedente não faturado chega a $100, o Studio cobra automaticamente todo o valor pendente.

Exemplo:

  • Dia 10: $120 de excedente → cobrança imediata de $120
  • Dia 15: mais $60 de consumo ($180 no total) → já faturado, nenhuma ação
  • Dia 20: outros $80 de consumo ($260 no total, $140 não faturados) → cobrança imediata de $140

Isso distribui excedentes grandes ao longo do mês, em vez de gerar uma fatura alta no fim do período.

Monitoramento do consumo

Acompanhe seu consumo e sua cobrança em Settings → Subscription:

  • Current Usage: consumo de créditos em tempo real no período de cobrança atual
  • Usage Limits: os limites do plano com uma barra de progresso
  • On-Demand Billing: ativa ou desativa a cobrança on-demand para permitir consumo acima dos créditos incluídos no plano
  • Plan Management: faça upgrade, downgrade ou alterne entre cobrança mensal e anual

Acompanhamento programático do consumo

Você pode consultar seu consumo e seus limites atuais de forma programática pela API:

Endpoint:

GET /api/users/me/usage-limits

Autenticação:

  • Inclua sua chave de API no header X-API-Key

Exemplo de requisição:

curl -X GET -H "X-API-Key: YOUR_API_KEY" -H "Content-Type: application/json" https://agent-studio.seeyu.ai/api/users/me/usage-limits

Exemplo de resposta:

{
  "success": true,
  "rateLimit": {
    "sync": {
      "isLimited": false,
      "requestsPerMinute": 150,
      "maxBurst": 300,
      "remaining": 300,
      "resetAt": "2025-09-08T22:51:55.999Z"
    },
    "async": {
      "isLimited": false,
      "requestsPerMinute": 1000,
      "maxBurst": 2000,
      "remaining": 2000,
      "resetAt": "2025-09-08T22:51:56.155Z"
    },
    "authType": "api"
  },
  "usage": {
    "currentPeriodCost": 12.34,
    "limit": 100,
    "plan": "pro_6000"
  }
}

Campos de rate limit:

  • requestsPerMinute: limite sustentado (os tokens são reabastecidos nessa taxa)
  • maxBurst: máximo de tokens que você pode acumular (capacidade de burst)
  • remaining: tokens disponíveis agora (pode chegar até maxBurst)

Campos da resposta:

  • currentPeriodCost reflete o consumo no período de cobrança atual (em dólares)
  • limit deriva dos limites individuais (Free/Pro/Max) ou dos limites compartilhados da organização (Team/Enterprise)
  • plan é o plano ativo de maior prioridade associado ao seu usuário

Compra de créditos adicionais

Quem está no plano Pro ou Team pode comprar créditos adicionais a qualquer momento em Settings → Subscription → Credit Balance:

  • Faixa: de $10 a $1,000 por compra
  • Conversão: 1 crédito = $0.005 (uma compra de $10 adiciona 2,000 créditos)
  • Disponibilidade: os créditos entram na conta assim que o pagamento é concluído
  • Validade: créditos comprados não expiram
  • Reembolso: as compras não são reembolsáveis
  • Planos de time: apenas owners e admins da organização podem comprar créditos. Os créditos comprados vão para o pool compartilhado do time.

Clientes Enterprise devem falar com o suporte para ajustes de crédito.

Estratégias para otimizar custos

  • Escolha do modelo: escolha o modelo conforme a complexidade da tarefa. Tarefas simples podem usar o GPT-4.1-nano, enquanto raciocínio complexo pode exigir o1 ou Claude Opus.
  • Engenharia de prompt: prompts bem estruturados e concisos reduzem o uso de tokens sem sacrificar a qualidade.
  • Modelos locais: use Ollama ou VLLM em tarefas não críticas para eliminar totalmente o custo de API.
  • Cache e reaproveitamento: guarde resultados usados com frequência em variáveis ou arquivos para evitar chamadas repetidas ao modelo.
  • Processamento em lote: processe vários itens em uma única requisição ao modelo, em vez de fazer chamadas individuais.

Próximos passos

Common Questions

Toda execução tem uma taxa base de 1 crédito ($0.005). Além disso, todo uso de modelo de IA é cobrado conforme o consumo de tokens. Workflows que não usam blocks de IA pagam apenas a taxa base por execução.
1 crédito equivale a $0.005. Todos os limites de plano, medidores de consumo e limiares de cobrança na interface do Studio aparecem em créditos.
Não. Os créditos de recarga diária são renovados a cada 24 horas e não acumulam. Se você não usá-los no dia, eles são perdidos.
Por padrão, seu consumo é limitado aos créditos incluídos no plano e as execuções param. Se você ativar a cobrança on-demand ou aumentar manualmente seu limite de consumo em Settings, pode continuar executando workflows e pagar o excedente no fim do período de cobrança.
Quando você usa as chaves de API hospedadas do Studio (em vez de trazer as suas), um multiplicador de 1.1x é aplicado sobre o preço base do modelo nos blocks Agent. Isso cobre os custos de infraestrutura e de gerenciamento de API. Você evita esse multiplicador usando suas próprias chaves de API pelo recurso BYOK.
Sim. Se você rodar modelos locais pelo Ollama ou pelo VLLM, essas chamadas não têm custo de API. Você continua pagando a taxa base de 1 crédito por execução.
Quando a cobrança on-demand está ativada e seu excedente não faturado chega a $100, o Studio cobra automaticamente todo o valor pendente. Isso distribui valores altos ao longo do mês, em vez de acumular uma fatura grande no fim do período.