IA generativa

    IA OpenAI-compatible no mesmo console da plataforma

    Use modelos por API familiar, crie chaves no console, defina budget e acompanhe consumo em real junto dos seus apps e bancos.

    Catálogo de modelos

    Compare preços, contexto e recursos de todos os modelos disponíveis.

    Intelligence Index por Artificial Analysis · versão v4,3 · dados consultados em 06/10/2026

    zenifra/qwen3.8-max

    1.000.000
    ChatRaciocínioVisãoChamada de ferramentas
    Intelligence Index: 45,4
    Entrada:
    R$ 8,50 /1M tokens
    Saída:
    R$ 25,60 /1M tokens
    Cache:
    R$ 1,10 /1M tokens

    zenifra/kimi-k3

    1.048.576
    RaciocínioVisãoChamada de ferramentas
    Intelligence Index: 43,6
    Entrada:
    R$ 14,70 /1M tokens
    Saída:
    R$ 73,49 /1M tokens
    Cache:
    R$ 1,50 /1M tokens

    zenifra/qwen3.8-flash

    1.000.000
    ChatRaciocínioVisãoChamada de ferramentas
    Intelligence Index: 39,8
    Entrada:
    R$ 0,60 /1M tokens
    Saída:
    R$ 2,00 /1M tokens
    Cache:
    R$ 0,10 /1M tokens

    zenifra/deepseek-v4-pro

    1.000.000
    ChatRaciocínioChamada de ferramentas
    Intelligence Index: 36
    Preço padrão (off-peak)
    11:00-21:00 UTC−3
    Entrada:
    R$ 4,30 /1M tokens
    Saída:
    R$ 8,50 /1M tokens
    Cache:
    R$ 0,35 /1M tokens
    Preço de pico (peak)
    Entrada:
    R$ 8,50 /1M tokens
    Saída:
    R$ 17,00 /1M tokens
    Cache:
    R$ 0,70 /1M tokens

    zenifra/deepseek-v4-flash-0731

    1.000.000
    ChatRaciocínioChamada de ferramentas
    Intelligence Index: 34,3
    Preço padrão (off-peak)
    11:00-21:00 UTC−3
    Entrada:
    R$ 1,10 /1M tokens
    Saída:
    R$ 3,30 /1M tokens
    Cache:
    R$ 0,14 /1M tokens
    Preço de pico (peak)
    Entrada:
    R$ 2,20 /1M tokens
    Saída:
    R$ 6,60 /1M tokens
    Cache:
    R$ 0,29 /1M tokens

    zenifra/glm-5.2

    1.048.576
    ChatRaciocínioChamada de ferramentas
    Intelligence Index: 33,7
    Entrada:
    R$ 5,70 /1M tokens
    Saída:
    R$ 20,00 /1M tokens
    Cache:
    R$ 1,40 /1M tokens

    zenifra/qwen3.7-max

    1.000.000
    ChatRaciocínioChamada de ferramentas
    Intelligence Index: 29,5
    Entrada:
    R$ 8,50 /1M tokens
    Saída:
    R$ 25,50 /1M tokens
    Cache:
    R$ 1,70 /1M tokens

    zenifra/kimi-k2.7-code

    229.376
    ChatRaciocínioVisãoChamada de ferramentas
    Intelligence Index: 25,8
    Entrada:
    R$ 4,70 /1M tokens
    Saída:
    R$ 19,40 /1M tokens
    Cache:
    R$ 0,35 /1M tokens

    zenifra/qwen3.7-plus

    1.000.000
    ChatRaciocínioVisãoChamada de ferramentas
    Intelligence Index: 25,2
    Preço padrão
    Entrada:
    R$ 1,50 /1M tokens
    Saída:
    R$ 5,70 /1M tokens
    Cache:
    R$ 0,40 /1M tokens
    Faixas por tokens de entrada
    0–256.000 tokens
    Entrada:
    R$ 1,50 /1M tokens
    Saída:
    R$ 5,70 /1M tokens
    Cache:
    R$ 0,40 /1M tokens
    256.001–1.000.000 tokens
    Entrada:
    R$ 4,40 /1M tokens
    Saída:
    R$ 17,20 /1M tokens
    Cache:
    R$ 0,90 /1M tokens

    zenifra/kimi-k2.5

    229.376
    ChatRaciocínioVisãoChamada de ferramentas
    Intelligence Index: 23,5
    Entrada:
    R$ 3,00 /1M tokens
    Saída:
    R$ 15,70 /1M tokens
    Cache:
    R$ 0,60 /1M tokens

    zenifra/qwen3.6-flash

    991.808
    RaciocínioVisãoChamada de ferramentas
    Ainda não avaliado
    Preço padrão
    Entrada:
    R$ 0,85 /1M tokens
    Saída:
    R$ 5,10 /1M tokens
    Cache:
    R$ 0,09 /1M tokens
    Faixas por tokens de entrada
    0–256.000 tokens
    Entrada:
    R$ 0,85 /1M tokens
    Saída:
    R$ 5,10 /1M tokens
    Cache:
    R$ 0,09 /1M tokens
    256.001–991.808 tokens
    Entrada:
    R$ 3,40 /1M tokens
    Saída:
    R$ 20,40 /1M tokens
    Cache:
    R$ 0,34 /1M tokens

    zenifra/qwen3.6-plus

    991.808
    RaciocínioVisãoChamada de ferramentas
    Ainda não avaliado
    Preço padrão
    Entrada:
    R$ 1,43 /1M tokens
    Saída:
    R$ 8,51 /1M tokens
    Cache:
    R$ 0,15 /1M tokens
    Faixas por tokens de entrada
    0–256.000 tokens
    Entrada:
    R$ 1,43 /1M tokens
    Saída:
    R$ 8,51 /1M tokens
    Cache:
    R$ 0,15 /1M tokens
    256.001–991.808 tokens
    Entrada:
    R$ 5,68 /1M tokens
    Saída:
    R$ 34,01 /1M tokens
    Cache:
    R$ 0,58 /1M tokens

    zenifra/glm-5.1

    202.745
    RaciocínioChamada de ferramentas
    Ainda não avaliado
    Preço padrão
    Entrada:
    R$ 5,95 /1M tokens
    Saída:
    R$ 23,81 /1M tokens
    Cache:
    R$ 1,19 /1M tokens
    Faixas por tokens de entrada
    0–32.000 tokens
    Entrada:
    R$ 5,95 /1M tokens
    Saída:
    R$ 23,81 /1M tokens
    Cache:
    R$ 1,19 /1M tokens
    32.001–202.745 tokens
    Entrada:
    R$ 7,94 /1M tokens
    Saída:
    R$ 27,77 /1M tokens
    Cache:
    R$ 1,59 /1M tokens

    Da API key ao consumo observado

    A experiência de IA segue a mesma lógica da plataforma: criar chave, integrar por base URL, medir consumo e evoluir o uso com previsibilidade.

    Configuração base

    base_url: https://ai.zenifra.com/v1
    model: zenifra/deepseek-v4-flash-0731
    api_key: criada no console

    Casos de uso

    • Chatbots e atendimento interno
    • Agentes para automação operacional
    • Análise de documentos e extração de dados
    • Integrações com budget por chave

    Limitações atuais

    Consulte os modelos disponíveis, janela de contexto, concorrência e limites de consumo antes de levar para produção. A documentação técnica mantém os parâmetros e erros atualizados para integrações mais sensíveis.

    Quando usar IA na Zenifra

    Casos em que faz sentido manter API de IA, budget e consumo no mesmo console dos apps e bancos.

    Quando usar IA na Zenifra

    Use quando você quer integrar IA ao produto sem separar infraestrutura, chave, budget e consumo em outro console.

    Chatbots e agentes internos

    Conecte sistemas internos, atendimento e automações usando uma API familiar.

    Análise de documentos

    Extraia, classifique e transforme texto com acompanhamento de consumo em real.

    Fluxo de API key

    Uma sequência curta para criar chave, trocar a base URL e observar consumo antes de escalar uso.

    01

    Crie a chave

    Fluxo de API key por projeto, com budget para limitar uso e reduzir surpresa de consumo.

    02

    Troque a base URL

    Use a compatibilidade OpenAI com base_url da Zenifra e o modelo disponível no console.

    03

    Monitore consumo

    Acompanhe chamadas, custos e limites antes de expandir para fluxos críticos.

    Controle de consumo

    Decisões que ajudam a separar ambientes, limitar orçamento e entender limites atuais da API.

    Modelo

    Escolha o modelo disponível para o caso de uso e confirme limitações atuais.

    Budget por chave

    Controle de consumo por chave ajuda a separar ambientes e integrações.

    Contexto e concorrência

    Verifique janela de contexto e limites antes de workloads mais sensíveis.

    Ambiente

    Use chaves separadas para desenvolvimento, staging e produção.

    Exemplos rápidos

    Teste com a mesma interface que você já usa em projetos OpenAI-compatible: troque a base URL, use sua chave da Zenifra e envie a primeira requisição.

    curl
    curl https://ai.zenifra.com/v1/chat/completions \
      -H "Authorization: Bearer $ZENIFRA_AI_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{"model":"zenifra/deepseek-v4-flash-0731","messages":[{"role":"user","content":"Olá, quem é você?"}]}' \
      | jq -r '.choices[0].message.content'
    JavaScript
    import OpenAI from 'openai'
    
    const client = new OpenAI({
      apiKey: process.env.ZENIFRA_AI_API_KEY,
      baseURL: 'https://ai.zenifra.com/v1',
    })
    
    const completion = await client.chat.completions.create({
      model: 'zenifra/deepseek-v4-flash-0731',
      messages: [
        { role: 'user', content: 'Olá, quem é você?' },
      ],
    })
    
    console.log(completion.choices[0].message.content)
    Python
    import os
    from openai import OpenAI
    
    client = OpenAI(
        api_key=os.environ["ZENIFRA_AI_API_KEY"],
        base_url="https://ai.zenifra.com/v1",
    )
    
    completion = client.chat.completions.create(
        model="zenifra/deepseek-v4-flash-0731",
        messages=[
            {"role": "user", "content": "Olá, quem é você?"},
        ],
    )
    
    print(completion.choices[0].message.content)

    Modelos de IA no console

    Compare modelos, janela de contexto e preço por milhão de tokens em real, e acompanhe gasto, requisições e tokens no mesmo painel das chaves.

    Dúvidas frequentes

    Respostas curtas para decidir se a API de IA já encaixa no seu fluxo.

    Como controlo o consumo?

    Crie chaves por projeto, defina budget por chave e acompanhe uso no console antes de aumentar volume.

    Preciso trocar meu SDK?

    Na maioria dos casos, basta usar cliente compatível com OpenAI e alterar base URL, modelo e API key.

    Respeitamos sua privacidade

    Usamos cookies essenciais para o funcionamento do site. Cookies de medição e marketing, como Google Ads, só serão ativados se você aceitar todos. Consulte nossa política de cookies.