O Studio calcula automaticamente o custo de cada execução de workflow a partir do uso de modelos de IA mais uma taxa base por execução.
Créditos
O Studio usa créditos como unidade de medida de todo o consumo. 1 crédito = $0.005.
Todos os limites de plano, medidores de consumo e limiares de cobrança aparecem em créditos por toda a interface do Studio. Os valores em dólar nesta documentação servem apenas como referência.
Como os custos são calculados
Toda execução de workflow tem dois componentes de custo:
Taxa base por execução: 1 crédito ($0.005) por execução
Uso de modelos de IA: custo variável conforme o consumo de tokens
modelCost = (inputTokens × inputPrice + outputTokens × outputPrice) / 1,000,000
totalCredits = baseRunCharge + modelCost × 200Os preços dos modelos de IA são por milhão de tokens. Workflows sem blocks de IA pagam apenas a taxa base por execução.
Detalhamento por modelo nos Logs
Em workflows que usam blocks de IA, você pode ver informações detalhadas de custo nos Logs:
O detalhamento por modelo mostra:
- Uso de tokens: contagem de tokens de entrada e de saída de cada modelo
- Detalhamento de custos: custos individuais por modelo e por operação
- Distribuição de modelos: quais modelos foram usados e quantas vezes
- Custo total: custo agregado de toda a execução do workflow
Opções de preço
Modelos hospedados - o Studio fornece as chaves de API com um multiplicador de 1.1x sobre o preço, para blocks Agent:
OpenAI
| Modelo | Preço base (entrada/saída) | Preço hospedado (entrada/saída) |
|---|---|---|
| GPT-5.1 | $1.25 / $10.00 | $1.38 / $11.00 |
| GPT-5 | $1.25 / $10.00 | $1.38 / $11.00 |
| GPT-5 Mini | $0.25 / $2.00 | $0.28 / $2.20 |
| GPT-5 Nano | $0.05 / $0.40 | $0.06 / $0.44 |
| GPT-4o | $2.50 / $10.00 | $2.75 / $11.00 |
| GPT-4.1 | $2.00 / $8.00 | $2.20 / $8.80 |
| GPT-4.1 Mini | $0.40 / $1.60 | $0.44 / $1.76 |
| GPT-4.1 Nano | $0.10 / $0.40 | $0.11 / $0.44 |
| o1 | $15.00 / $60.00 | $16.50 / $66.00 |
| o3 | $2.00 / $8.00 | $2.20 / $8.80 |
| o4 Mini | $1.10 / $4.40 | $1.21 / $4.84 |
Anthropic
| Modelo | Preço base (entrada/saída) | Preço hospedado (entrada/saída) |
|---|---|---|
| Claude Opus 4.5 | $5.00 / $25.00 | $5.50 / $27.50 |
| Claude Opus 4.1 | $15.00 / $75.00 | $16.50 / $82.50 |
| Claude Sonnet 4.5 | $3.00 / $15.00 | $3.30 / $16.50 |
| Claude Sonnet 4.0 | $3.00 / $15.00 | $3.30 / $16.50 |
| Claude Haiku 4.5 | $1.00 / $5.00 | $1.10 / $5.50 |
| Modelo | Preço base (entrada/saída) | Preço hospedado (entrada/saída) |
|---|---|---|
| Gemini 3 Pro Preview | $2.00 / $12.00 | $2.20 / $13.20 |
| Gemini 2.5 Pro | $1.25 / $10.00 | $1.38 / $11.00 |
| Gemini 2.5 Flash | $0.30 / $2.50 | $0.33 / $2.75 |
O multiplicador de 1.1x cobre os custos de infraestrutura e de gerenciamento de API.
Suas próprias chaves de API - use qualquer modelo pelo preço base:
| Provedor | Modelos de exemplo | Entrada / Saída |
|---|---|---|
| Deepseek | V3, R1 | $0.75 / $1.00 |
| xAI | Grok 4 Latest, Grok 3 | $3.00 / $15.00 |
| Groq | Llama 4 Scout, Llama 3.3 70B | $0.11 / $0.34 |
| Cerebras | Llama 4 Scout, Llama 3.3 70B | $0.11 / $0.34 |
| Ollama | Modelos locais | Grátis |
| VLLM | Modelos locais | Grátis |
Pague direto aos provedores, sem acréscimo
Os preços mostrados refletem as tarifas de 10 de setembro de 2025. Consulte a documentação do provedor para os valores atuais.
Preços de ferramentas hospedadas
Quando workflows usam blocks de ferramenta com as chaves de API hospedadas do Studio, o custo é cobrado por operação. Use suas próprias chaves via BYOK para pagar direto aos provedores.
Firecrawl - scraping, crawling, busca e extração na web
| Operação | Custo |
|---|---|
| Scrape | $0.001 por crédito usado |
| Crawl | $0.001 por crédito usado |
| Search | $0.001 por crédito usado |
| Extract | $0.001 por crédito usado |
| Map | $0.001 por crédito usado |
Exa - busca e pesquisa com IA
| Operação | Custo |
|---|---|
| Search | Dinâmico (retornado pela API) |
| Get Contents | Dinâmico (retornado pela API) |
| Find Similar Links | Dinâmico (retornado pela API) |
| Answer | Dinâmico (retornado pela API) |
Serper - API de busca do Google
| Operação | Custo |
|---|---|
| Search (≤10 resultados) | $0.001 |
| Search (>10 resultados) | $0.002 |
Perplexity - chat e busca na web com IA
| Operação | Custo |
|---|---|
| Search | $0.005 por requisição |
| Chat | Por token (varia conforme o modelo) |
Linkup - busca na web e recuperação de conteúdo
| Operação | Custo |
|---|---|
| Busca padrão | ~$0.006 |
| Busca profunda | ~$0.055 |
Parallel AI - busca na web, extração e pesquisa profunda
| Operação | Custo |
|---|---|
| Search (≤10 resultados) | $0.005 |
| Search (>10 resultados) | $0.005 + $0.001 por resultado adicional |
| Extract | $0.001 por URL |
| Deep Research | $0.005–$2.40 (varia conforme o nível do processador) |
Jina AI - leitura e busca na web
| Operação | Custo |
|---|---|
| Read URL | $0.20 por 1M tokens |
| Search | $0.20 por 1M tokens (mínimo de 10K tokens) |
Google Cloud - APIs Translate, Maps, PageSpeed e Books
| Operação | Custo |
|---|---|
| Translate / Detect | $0.00002 por caractere |
| Maps (Geocode, Directions, Distance Matrix, Elevation, Timezone, Reverse Geocode, Geolocate, Validate Address) | $0.005 por requisição |
| Maps (Snap to Roads) | $0.01 por requisição |
| Maps (Place Details) | $0.017 por requisição |
| Maps (Places Search) | $0.032 por requisição |
| PageSpeed | Grátis |
| Books (Search, Details) | Grátis |
Brandfetch - ativos de marca, logos, cores e dados de empresas
| Operação | Custo |
|---|---|
| Search | Grátis |
| Get Brand | $0.04 por requisição |
Chaves próprias (BYOK)
Use suas próprias chaves de API nos provedores suportados, em vez das chaves hospedadas do Studio, e pague o preço base sem acréscimo.
Provedores suportados
| Provedor | Uso |
|---|---|
| OpenAI | Embeddings da Knowledge Base, block Agent |
| Anthropic | Block Agent |
| Block Agent | |
| Mistral | OCR da Knowledge Base, block Agent |
| Fireworks | Block Agent |
| Firecrawl | Scraping, crawling, busca e extração na web |
| Exa | Busca e pesquisa com IA |
| Serper | API de busca do Google |
| Linkup | Busca na web e recuperação de conteúdo |
| Parallel AI | Busca na web, extração e pesquisa profunda |
| Perplexity | Chat e busca na web com IA |
| Jina AI | Leitura e busca na web |
| Google Cloud | APIs Translate, Maps, PageSpeed e Books |
| Brandfetch | Ativos de marca, logos, cores e dados de empresas |
Configuração
- Abra Settings → BYOK no seu workspace
- Clique em Add Key para o seu provedor
- Informe sua chave de API e salve
As chaves BYOK são criptografadas em repouso. Apenas admins do workspace podem gerenciá-las.
Quando configurada, os workflows usam sua chave em vez das chaves hospedadas do Studio. Se você removê-la, os workflows voltam automaticamente às chaves hospedadas, com o multiplicador.
Entrada por voz
A entrada por voz usa o ElevenLabs Scribe v2 Realtime para transcrever fala em texto. Está disponível no Chat e no modo de voz do chat com deploy.
| Contexto | Custo por sessão | Duração máxima |
|---|---|---|
| Chat (workspace) | ~5 créditos ($0.024) | 3 minutos |
| Chat com deploy (modo de voz) | ~2 créditos ($0.008) | 1 minuto |
Cada sessão de voz é cobrada no momento em que começa. No modo de voz do chat com deploy, cada turno da conversa (você fala → o agente responde → você fala de novo) é uma sessão separada. Conversas com vários turnos são cobradas por turno.
A entrada por voz exige que ELEVENLABS_API_KEY esteja configurada. Sem a chave, os controles de entrada por voz ficam ocultos.
Planos
O Studio tem dois níveis de plano pago - Pro e Max. Os dois podem ser usados individualmente ou com um time. Nos planos de time, os créditos são compartilhados entre todos os assentos da organização.
| Plano | Preço | Créditos incluídos | Recarga diária |
|---|---|---|---|
| Community | $0 | 1,000 (única vez) | - |
| Pro | $25/mês | 6,000/mês | +50/dia |
| Max | $100/mês | 25,000/mês | +200/dia |
| Enterprise | Personalizado | Personalizado | - |
Para usar o Pro ou o Max com um time, selecione Get For Team nas configurações de assinatura e escolha o nível e o número de assentos. Os créditos são compartilhados na organização conforme a tarifa por assento (por exemplo, Max for Teams com 3 assentos = 75,000 créditos/mês compartilhados).
Membros internos da organização ocupam assentos e contribuem para a cota de créditos compartilhada do time. Membros externos do workspace não entram na sua organização, não aparecem na lista de membros dela e não contam no seu total de assentos.
Créditos de recarga diária
Os planos pagos incluem uma pequena cota diária de créditos que não conta no limite do plano. A cada dia, o consumo até o valor da recarga diária fica de fora do consumo faturável. Essa cota é renovada a cada 24 horas e não acumula - ou você usa, ou perde.
| Plano | Recarga diária |
|---|---|
| Pro | 50 créditos/dia ($0.25) |
| Max | 200 créditos/dia ($1.00) |
Nos planos de time, a recarga diária escala com os assentos (por exemplo, Max for Teams com 3 assentos = 600 créditos/dia).
Cobrança anual
Todos os planos pagos estão disponíveis com cobrança anual e 15% de desconto. Alterne entre cobrança mensal e anual em Settings → Subscription.
| Plano | Mensal | Anual (por mês) | Total anual |
|---|---|---|---|
| Pro | $25/mês | $21.25/mês | $255/ano |
| Max | $100/mês | $85/mês | $1,020/ano |
Os planos de time seguem o mesmo preço por assento.
Cobrança on-demand
Por padrão, seu consumo é limitado aos créditos incluídos no plano. Para consumir além do que está incluído, você pode ativar a cobrança on-demand ou editar manualmente seu limite de consumo para qualquer valor acima do mínimo do plano.
- Enable On-Demand: remove o limite de consumo por completo. Você paga o excedente no fim do período de cobrança.
- Edit Usage Limit: define um limite específico acima do valor incluído no plano, para controlar quanto excedente você aceita.
- Disable On-Demand: devolve seu limite de consumo ao valor incluído no plano (disponível apenas se o consumo atual ainda não tiver passado desse valor).
A cobrança on-demand nos planos de time é gerenciada pelos owners e administradores da organização. A permissão de admin do workspace, por si só, não dá autoridade sobre cobrança.
Limites dos planos
Workspaces
| Plano | Workspaces pessoais | Workspaces compartilhados (organização) |
|---|---|---|
| Free | 1 | — |
| Pro | Até 3 | — |
| Max | Até 10 | — |
| Team / Enterprise | — | Ilimitados (Owners e Admins) |
Os planos Team e Enterprise liberam workspaces compartilhados que pertencem à sua organização. Todo workspace criado sob um plano Team ou Enterprise é da organização: Owners e Admins podem criar workspaces compartilhados sem limite, enquanto Members da organização não podem criar workspaces. Quando alguém entra na organização como membro interno, os workspaces pessoais dele passam para a organização e o consumo dele é cobrado dela a partir de então. Membros internos contam no seu total de assentos — convites no Enterprise exigem um assento livre no momento do convite, enquanto os planos Team adicionam um assento automaticamente quando o convidado aceita. Membros externos do workspace ganham acesso a workspaces específicos sem entrar na sua organização nem ocupar um dos seus assentos; eles precisam já estar em um plano pago do Studio (a própria assinatura Pro ou Max, ou outra organização que os acomode), e quem já pertence a outra organização sempre entra dessa forma. Quando uma assinatura Team ou Enterprise é cancelada ou rebaixada, os workspaces compartilhados existentes continuam acessíveis aos membros atuais, mas novos convites ficam desativados até a organização voltar a ser atualizada.
Rate limits
| Plano | Sync (req/min) | Async (req/min) |
|---|---|---|
| Free | 50 | 200 |
| Pro | 150 | 1,000 |
| Max | 300 | 2,500 |
| Enterprise | 600 | 5,000 |
Os rate limits seguem o nível pago: Pro e Pro for Teams compartilham os limites do Pro; Max e Max for Teams compartilham os limites do Max.
Execuções concorrentes
| Plano | Execuções concorrentes |
|---|---|
| Free | 10 |
| Pro | 50 |
| Max | 200 |
| Enterprise | 1,000 por padrão (personalizável) |
O limite de concorrência vale por conta de cobrança. Nos planos de organização, o limite é compartilhado por todos os workspaces, membros e chaves de API daquela organização. Os planos Teams seguem o próprio nível: Pro for Teams usa o limite do Pro e Max for Teams usa o limite do Max. Uma execução async admitida ocupa um slot enquanto está na fila e enquanto roda; execuções síncronas ocupam um slot enquanto rodam. Blocks de workflow dentro de workflow executam dentro da execução pai e não consomem outro slot de concorrência.
Armazenamento de arquivos
| Plano | Armazenamento |
|---|---|
| Free | 5 GB |
| Pro | 50 GB |
| Max | 500 GB |
| Enterprise | 500 GB (personalizável) |
O armazenamento segue o nível pago: Pro e Pro for Teams compartilham o limite do Pro; Max e Max for Teams compartilham o limite do Max. O armazenamento da organização é compartilhado entre os workspaces dela.
Limites de tempo de execução
| Plano | Sync | Async |
|---|---|---|
| Free | 5 minutos | 90 minutos |
| Pro / Max / Team | 50 minutos | 90 minutos |
| Enterprise | 50 minutos | 90 minutos por padrão; configurável até 7 dias |
Execuções sync terminam na hora e retornam o resultado direto. São disparadas pela API com async: false (padrão) ou pela interface.
Execuções async (disparadas pela API com async: true, por webhooks, agendamentos, triggers de polling ou colunas de workflow em Tables) rodam em segundo plano. Uma requisição async direta pode encurtar a política da conta para aquela requisição, mas não pode estendê-la.
Se um workflow passar do limite de tempo, ele é encerrado e marcado como falha com erro de timeout. Projete workflows longos para usar execuções async ou divida-os em workflows menores.
Modelo de cobrança
O Studio usa um modelo de cobrança de assinatura base + excedente:
Como funciona
Plano Pro ($25/mês - 6,000 créditos):
- A assinatura mensal inclui 6,000 créditos de consumo
- Consumo abaixo de 6,000 créditos → sem cobranças adicionais
- Consumo acima de 6,000 créditos (com on-demand ativado) → você paga o excedente no fim do mês
- Exemplo: 7,000 créditos usados = $25 (assinatura) + $5 (excedente de 1,000 créditos extras a $0.005/crédito)
Planos de time:
- O consumo é compartilhado entre os membros internos do time na organização
- O consumo em um workspace da organização é cobrado da organização daquele workspace, incluindo o trabalho feito por colaboradores externos
- O consumo de cada ator autenticado também conta para o limite dele como membro daquela organização
- O excedente é calculado com base no consumo total do time em relação ao limite compartilhado
- O owner da organização recebe uma única fatura
Planos Enterprise:
- Preço mensal fixo, sem excedentes
- Limites de consumo personalizados conforme o contrato
Cobrança por limiar
Quando o on-demand está ativado e o excedente não faturado chega a $100, o Studio cobra automaticamente todo o valor pendente.
Exemplo:
- Dia 10: $120 de excedente → cobrança imediata de $120
- Dia 15: mais $60 de consumo ($180 no total) → já faturado, nenhuma ação
- Dia 20: outros $80 de consumo ($260 no total, $140 não faturados) → cobrança imediata de $140
Isso distribui excedentes grandes ao longo do mês, em vez de gerar uma fatura alta no fim do período.
Monitoramento do consumo
Acompanhe seu consumo e sua cobrança em Settings → Subscription:
- Current Usage: consumo de créditos em tempo real no período de cobrança atual
- Usage Limits: os limites do plano com uma barra de progresso
- On-Demand Billing: ativa ou desativa a cobrança on-demand para permitir consumo acima dos créditos incluídos no plano
- Plan Management: faça upgrade, downgrade ou alterne entre cobrança mensal e anual
Acompanhamento programático do consumo
Você pode consultar seu consumo e seus limites atuais de forma programática pela API:
Endpoint:
GET /api/users/me/usage-limitsAutenticação:
- Inclua sua chave de API no header
X-API-Key
Exemplo de requisição:
curl -X GET -H "X-API-Key: YOUR_API_KEY" -H "Content-Type: application/json" https://agent-studio.seeyu.ai/api/users/me/usage-limitsExemplo de resposta:
{
"success": true,
"rateLimit": {
"sync": {
"isLimited": false,
"requestsPerMinute": 150,
"maxBurst": 300,
"remaining": 300,
"resetAt": "2025-09-08T22:51:55.999Z"
},
"async": {
"isLimited": false,
"requestsPerMinute": 1000,
"maxBurst": 2000,
"remaining": 2000,
"resetAt": "2025-09-08T22:51:56.155Z"
},
"authType": "api"
},
"usage": {
"currentPeriodCost": 12.34,
"limit": 100,
"plan": "pro_6000"
}
}Campos de rate limit:
requestsPerMinute: limite sustentado (os tokens são reabastecidos nessa taxa)maxBurst: máximo de tokens que você pode acumular (capacidade de burst)remaining: tokens disponíveis agora (pode chegar atémaxBurst)
Campos da resposta:
currentPeriodCostreflete o consumo no período de cobrança atual (em dólares)limitderiva dos limites individuais (Free/Pro/Max) ou dos limites compartilhados da organização (Team/Enterprise)plané o plano ativo de maior prioridade associado ao seu usuário
Compra de créditos adicionais
Quem está no plano Pro ou Team pode comprar créditos adicionais a qualquer momento em Settings → Subscription → Credit Balance:
- Faixa: de $10 a $1,000 por compra
- Conversão: 1 crédito = $0.005 (uma compra de $10 adiciona 2,000 créditos)
- Disponibilidade: os créditos entram na conta assim que o pagamento é concluído
- Validade: créditos comprados não expiram
- Reembolso: as compras não são reembolsáveis
- Planos de time: apenas owners e admins da organização podem comprar créditos. Os créditos comprados vão para o pool compartilhado do time.
Clientes Enterprise devem falar com o suporte para ajustes de crédito.
Estratégias para otimizar custos
- Escolha do modelo: escolha o modelo conforme a complexidade da tarefa. Tarefas simples podem usar o GPT-4.1-nano, enquanto raciocínio complexo pode exigir o1 ou Claude Opus.
- Engenharia de prompt: prompts bem estruturados e concisos reduzem o uso de tokens sem sacrificar a qualidade.
- Modelos locais: use Ollama ou VLLM em tarefas não críticas para eliminar totalmente o custo de API.
- Cache e reaproveitamento: guarde resultados usados com frequência em variáveis ou arquivos para evitar chamadas repetidas ao modelo.
- Processamento em lote: processe vários itens em uma única requisição ao modelo, em vez de fazer chamadas individuais.
Próximos passos
- Confira seu consumo atual em Settings → Subscription
- Conheça o Logging para acompanhar os detalhes das execuções
- Explore a External API para monitorar custos de forma programática
- Veja técnicas de otimização de workflows para reduzir custos