Migração 100% grátis na contratação semestral · nossa equipe migra tudo de qualquer provedor · novos clientes Migrar agora
Agente de IA no WhatsApp na API Oficial da Meta · somos Tech Provider aprovado · orçamento sob consulta Pedir orçamento
VPS com OpenClaw pré-instalado · a partir de R$ 56,90/mês · gerenciada pela Rollin Quero a VPS
VPS com Hermes Agent pré-instalado · a partir de R$ 56,90/mês · gerenciada pela Rollin Quero a VPS
Hospedagem com 30 dias de garantia · Não gostou? Devolvemos 100%, sem perguntas. Ver hospedagem
#hermes#ia#infraestrutura

Como corrigir o erro "no inference provider configured" do Hermes

por Equipe Rollin Host · · 8 min de leitura

Como corrigir o erro "no inference provider configured" do Hermes

O erro "no inference provider configured. run 'hermes model' to choose a provider" aparece quando você instala o Hermes Agent, tenta iniciar uma conversa e o sistema não consegue processar a requisição. Esse é o segundo erro pós-instalação mais comum — o primeiro é hermes command not found.

A causa é direta: o agente precisa de um provedor LLM configurado para funcionar, e a instalação não traz nenhum pré-selecionado por design.

TL;DR: Execute hermes model, escolha um provedor (Anthropic, OpenAI, OpenRouter, Ollama, etc.), cole sua chave de API e valide com hermes doctor. O erro desaparece imediatamente.

Por que o Hermes não vem com provedor padrão

O Hermes suporta múltiplos provedores de inferência: Anthropic, OpenAI, OpenRouter, Nous Portal, Gemini, xAI, Qwen, MiniMax, Hugging Face, Groq, além de qualquer endpoint local compatível com OpenAI como Ollama ou LM Studio.

Nenhum desses é um padrão óbvio. Escolher um pré-configurado significaria empurrar todos os usuários para um único vendor — o que contraria a arquitetura neutra do Hermes.

Se você pulou o wizard durante a instalação ou apagou o diretório ~/.hermes e reinstalou, a configuração de provedor fica vazia. Cada requisição de chat atinge a camada de inferência, não encontra provedor configurado e retorna o erro.

A correção em três comandos

hermes model
# escolha um provedor e cole a chave API quando solicitado

hermes doctor

hermes chat -q "say ok"

O comando hermes model conduz você pelo fluxo completo: seleção de provedor, escolha de modelo e entrada de chave em uma única sessão. O hermes doctor confirma que a configuração foi gravada corretamente. O teste smoke verifica o round trip end-to-end.

Qual provedor escolher para infraestrutura de produção

O wizard não oferece recomendações. Baseado em experiência rodando Hermes em diferentes projetos de infraestrutura, estas são as opções mais relevantes:

Anthropic direto

Melhor desempenho geral de agente. Claude Sonnet 4.6 é o modelo usado para a maioria dos workloads. A API é confiável, autenticação é simples, tool calls funcionam de forma limpa.

Desvantagem: não é a opção mais barata por token.

OpenRouter

Uma única chave API, centenas de modelos disponíveis. Útil quando você quer trocar modelos por tarefa sem gerenciar contas separadas.

Setup é ligeiramente mais complexo (você precisa escolher um modelo padrão do catálogo). Consulte a documentação do OpenRouter para configuração de conta.

Nous Portal

Usa os mesmos modelos hospedados pela Nous que alimentam o ranking do Hermes no OpenRouter. Frequentemente mais barato que Anthropic direto para alguns casos de uso.

Local via Ollama ou LM Studio

Custo zero por token. O trade-off: você precisa de uma máquina com VRAM suficiente.

Um modelo local de classe 32B é competente para chat simples e visivelmente inferior a um Sonnet hospedado em tarefas complexas com ferramentas. A abordagem híbrida é a resposta prática: local barato para chat, hospedado para tarefas com tools.

Para quem roda workloads de IA de forma recorrente, um servidor para IA dedicado faz diferença em latência e custo operacional — especialmente se você compara o custo acumulado de API versus self-hosting de LLMs locais.

O que o wizard hermes model faz nos bastidores

Quatro etapas executadas em sequência:

  1. Grava a escolha de provedor no arquivo de configuração
  2. Salva a chave API (em auth.json ou como variável de ambiente, você escolhe)
  3. Seleciona um modelo padrão do catálogo do provedor
  4. Executa uma requisição de validação para confirmar que a chave funciona

Se qualquer etapa falhar, o wizard informa qual. Normalmente é a etapa 4 (validação): erro de digitação na chave ou você colou uma chave de provedor diferente por engano.

Quando o comando hermes model não existe

Versões antigas do Hermes usavam hermes provider ou hermes inference set no lugar. Se hermes model retornar "command not found", você está em uma release antiga:

hermes upgrade
hermes --version

Você precisa de pelo menos v0.10 para o wizard unificado. Verifique a página de releases do Hermes para versões atuais.

Wizard roda mas o agente ainda diz "no provider"

Duas possibilidades observadas em ambientes de produção:

Possibilidade 1: Wizard gravou em config diferente do que o agente lê

Acontece com diretórios home criptografados, setups de path não convencionais ou instalações distribuídas entre múltiplos usuários.

Verifique:

echo $HOME
ls -la ~/.hermes/
hermes config show | head -30

Se ~/.hermes está faltando ou pertence ao usuário errado, esse é o problema.

Possibilidade 2: Você configurou como um usuário, o gateway roda como outro

Caso clássico. Você executou hermes model como seu usuário normal. O gateway executa como root via systemd. Root não tem ~/.hermes, então o agente inicia sem provedor.

Duas correções:

# Correção A: alterar a unit systemd para rodar como seu usuário
sudo systemctl edit hermes-gateway
# adicione: [Service]
#           User=seuusuario

# Correção B: copiar a config para o usuário correto
sudo cp -r ~/.hermes /root/.hermes
sudo chown -R root:root /root/.hermes

Correção A é a forma adequada. Nosso tutorial de setup systemd para Hermes mostra o formato correto da unit.

Mudando o modelo após configurar o provedor

O wizard escolhe um modelo padrão sensato. Se você quiser outro:

hermes model list
hermes model set anthropic/claude-sonnet-4-6

Para OpenRouter: openrouter/model-id conforme listado no catálogo OpenRouter. Para Ollama: ollama/nome-do-modelo (o nome local do modelo).

Sempre execute hermes doctor após configurar provedor

Não pule isso. Doctor verifica conexão com provedor, disponibilidade do modelo, rede, Python e permissões de disco.

Se algo mais estiver errado, você descobre agora em vez de encontrar cada problema um por vez durante o chat.

hermes doctor

Chat retorna 401 logo após wizard validar a chave

Raro, mas real. O wizard validou, a chave foi corrompida antes de chegar à chamada de inferência.

Comum com chaves muito longas (alguns provedores emitem chaves com mais de 200 caracteres) e shells que fazem wrap ou escape de forma estranha.

Redefina a chave:

hermes auth set anthropic

Cole diretamente no prompt, não use echo de uma variável. Se o 401 persistir, consulte nosso tutorial de erros de autenticação 401 no Hermes.

Trade-offs de custo e infraestrutura para self-hosting

Rodar Hermes com modelos locais via Ollama elimina custo por token, mas transfere a despesa para infraestrutura: você precisa de GPU com VRAM suficiente (mínimo 24 GB para modelos de 13B-32B com desempenho aceitável, 48 GB+ para 70B).

Para quem avalia essa rota, o cálculo é direto: compare o custo mensal de API (baseado no volume de tokens) com o custo de um servidor GPU dedicado.

Em workloads com alto volume de requisições (mais de 10 milhões de tokens/mês), self-hosting costuma compensar. Abaixo disso, API hospedada tende a ser mais econômica quando você conta manutenção, uptime e escala.

Nossa calculadora de custo de LLM ajuda a mapear esse breakeven point baseado no seu volume real.

Principais aprendizados

  • O erro "no inference provider configured" significa que nenhum provedor LLM foi configurado — não é bug, é design
  • hermes model resolve em uma única sessão: escolha de provedor, modelo e validação de chave
  • hermes doctor é obrigatório após configuração para validar conectividade e permissões
  • Providers hospedados (Anthropic, OpenRouter) têm setup mais rápido; self-hosting local (Ollama) exige infraestrutura com GPU
  • Problemas de permissão entre usuários (normal vs. root) são a segunda causa mais comum após chave inválida

Perguntas frequentes

O que causa o erro "no inference provider configured" no Hermes?

O Hermes não vem com provedor LLM pré-configurado. Você precisa executar hermes model para escolher um provedor (Anthropic, OpenAI, OpenRouter, Ollama, etc.) e configurar a chave de API antes de usar o agente.

Como configurar um provedor LLM no Hermes pela primeira vez?

Execute hermes model, escolha o provedor desejado no menu interativo, cole sua chave API quando solicitado e confirme. O wizard valida a chave automaticamente. Finalize com hermes doctor para verificar a configuração completa.

Posso usar o Hermes sem pagar por API de LLM?

Sim, configurando um provedor local como Ollama ou LM Studio. Você elimina custo por token, mas precisa de um servidor com GPU e VRAM suficiente (mínimo 24 GB para modelos de 13B-32B). O desempenho em tarefas complexas será inferior a modelos hospedados como Claude ou GPT-4.

O wizard validou minha chave mas o chat ainda retorna erro de autenticação. O que fazer?

Redefina a chave com hermes auth set nome-do-provedor e cole diretamente no prompt, sem usar variáveis de ambiente ou echo. Chaves muito longas (200+ caracteres) podem ser corrompidas por shells que fazem escape automático.

Qual provedor LLM escolher para rodar o Hermes em produção?

Anthropic (Claude Sonnet 4.6) oferece o melhor desempenho em tarefas com ferramentas. OpenRouter permite trocar modelos facilmente com uma única chave. Ollama local é viável se você tem infraestrutura GPU própria e workload alto o suficiente para justificar o custo fixo do servidor.

Como verificar se a configuração do Hermes está correta após escolher o provedor?

Execute hermes doctor — ele valida conexão com o provedor, disponibilidade do modelo, permissões de disco, Python e rede. Se todos os checks passarem, execute hermes chat -q "say ok" como teste smoke. Se retornar resposta, a configuração está funcional.


Rodando agentes de IA com infraestrutura própria? A Rollin Host oferece servidores para IA com Ollama e OpenWebUI pré-configurados, além de VPS para n8n otimizados para automação com agentes. Provisionamento em ~5 minutos, root access, sem fidelidade. Conheça os planos.