Modelos gerenciados
Modelos disponíveis no Digio hoje
Atribua um modelo padrão por agente ou substitua por tarefa. O uso é medido em Digio Tokens a partir do saldo do seu plano – a mesma carteira, quer o agente ligue para Sonnet, GPT-4o ou Gemini Flash.
Claude antrópico
-
Claude Opus 4.7
Raciocínio emblemático, contexto longo, trabalho de arquitetura e estratégia.
-
Claude Opus 4.6
Opus da geração anterior para análises estáveis e de alta qualidade.
-
Claude Sonnet 4.6
Driver diário – codificação, gravação e loops de agente de várias etapas.
-
Claude Sonnet 4.5 / 4
Camadas Fast Sonnet com cache imediato em cargas de trabalho suportadas.
-
Claude Haiku 4.5
Rascunhos de baixa latência, classificação e subtarefas de alto volume.
Rótulo de interface do usuário do site SaaS B2B. Traduzir para natural pt-br: OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
A mais recente família GPT-5 para cargas de trabalho gerais e de agente.
-
GPT-4.1 & GPT-4o
Bate-papo multimodal confiável e uso de ferramentas para agentes de produção.
-
GPT-4o mini
Roteamento econômico para resumos e etapas leves.
-
o3 / o3-pro / o3-mini / o4-mini
Modelos focados no raciocínio para matemática, planejamento e verificação.
-
GPT-5.3 Codex & Codex mini
Geração de código, refatoradores e habilidades de agente com reconhecimento de repositório.
Google Gêmeos
-
Gemini 2.5 Pro
Pesquisa de longo contexto e extração estruturada.
-
Gemini 2.5 Flash
Etapas de agente de alto rendimento com taxas de token competitivas.
-
Gemini 2.0 Flash
Passagens ultrarrápidas para análise, marcação e trabalhos em lote.
APIs abertas e especializadas
-
DeepSeek Chat & Reasoner
Forte valor para tarefas de bate-papo e estilo de cadeia de pensamento.
-
Mistral Large
Opção hospedada na Europa para equipes de agentes multilíngues.
-
Llama 3.3 70B
Modelo de classe de pesos abertos via API – combina bem com GPU privada.
-
Grok 3
Modelo orientado em tempo real para agentes de notícias e monitoramento social.
-
Sonar Pro
Respostas baseadas em pesquisa para agentes de pesquisa.
-
Command R+
Fluxos de trabalho de recuperação e bate-papo empresarial compatíveis com RAG.
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
-
1
Reservar GPU
Escolha VRAM, região e tempo de atividade (intermitente versus sempre ativo). O armazenamento para pesos é enviado com a instância ou montado em seu bucket.
-
2
Implantar a pilha
Inicie uma imagem de serviço ou SSH, instale drivers CUDA e carregue pontos de verificação. As verificações de integridade confirmam que o modelo está pronto.
-
3
Registrar endpoint
Adicione URL base, chave de API e ID do modelo nas configurações do espaço de trabalho. Digio valida a latência e o formato do token antes de entrar no ar.
-
4
Atribuir a agentes
Escolha seu modelo privado como padrão para agentes selecionados; os modelos Claude/GPT gerenciados permanecem disponíveis lado a lado.
O aluguel da GPU é cobrado separadamente das assinaturas do plano Digio. Contate-nos para planejamento de capacidade, SLAs e migração de um cluster de inferência existente.