Modelos geridos
Modelos disponíveis no Digio hoje
Atribua um modelo padrão por agente ou substitua por tarefa. A utilização é medida em Digio Tokens a partir do saldo do seu plano – a mesma carteira, quer o agente ligue para a Sonnet, GPT-4o ou Gemini Flash.
Claude antrópico
-
Claude Opus 4.7
Raciocínio emblemático, contexto longo, trabalho de arquitetura e estratégia.
-
Claude Opus 4.6
Opus da geração anterior para análises estáveis e de alta qualidade.
-
Claude Sonnet 4.6
Driver diário – codificação, escrita e loops de agente de várias etapas.
-
Claude Sonnet 4.5 / 4
Camadas Fast Sonnet com cache imediata nas cargas de trabalho suportadas.
-
Claude Haiku 4.5
Rascunhos de baixa latência, classificação e subtarefas de alto volume.
Rótulo da interface do utilizador do site SaaS B2B. Traduzir para pt natural: OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
A mais recente família GPT-5 para cargas de trabalho gerais e de agentes.
-
GPT-4.1 & GPT-4o
Chat multimodal fiável e utilização de ferramentas para agentes de produção.
-
GPT-4o mini
Encaminhamento económico para resumos e etapas leves.
-
o3 / o3-pro / o3-mini / o4-mini
Modelos focados no raciocínio para a matemática, planeamento e verificação.
-
GPT-5.3 Codex & Codex mini
Geração de código, refactorings e competências de agente com reconhecimento de repositório.
Google Gémeos
-
Gemini 2.5 Pro
Investigação de longo contexto e extração estruturada.
-
Gemini 2.5 Flash
Etapas de agente de alto rendimento com taxas de token competitivas.
-
Gemini 2.0 Flash
Passagens ultrarrápidas para análise, marcação e trabalhos em lote.
APIs abertas e especializadas
-
DeepSeek Chat & Reasoner
Forte valor para tarefas de chat e estilo de cadeia de pensamento.
-
Mistral Large
Opção alojada na Europa para equipas de agentes multilingues.
-
Llama 3.3 70B
Modelo de classe de pesos abertos via API – combina bem com GPU privado.
-
Grok 3
Modelo orientado em tempo real para agentes de notícias e monitorização social.
-
Sonar Pro
Respostas baseadas em inquéritos para agentes de investigação.
-
Command R+
Fluxos de trabalho de recuperação e chat empresarial compatíveis com RAG.
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
-
1
Reservar GPU
Escolha VRAM, região e tempo de atividade (intermitente versus sempre ativo). O armazenamento para os pesos é enviado com a instância ou montado no seu bucket.
-
2
Implantar a pilha
Inicie uma imagem de serviço ou SSH, instale controladores CUDA e carregue pontos de verificação. As verificações de integridade confirmam que o modelo está pronto.
-
3
Registar endpoint
Adicione URL base, chave API e ID do modelo nas definições do espaço de trabalho. Digio valida a latência e o formato do token antes de entrar em funcionamento.
-
4
Atribuir aos agentes
Escolha o seu modelo privado como padrão para os agentes selecionados; os modelos Claude/GPT geridos permanecem disponíveis lado a lado.
O aluguer da GPU é cobrado separadamente das subscrições do plano Digio. Contacte-nos para planeamento de capacidade, SLAs e migração de um cluster de inferência existente.