Astreus

Provedores

A Astreus CLI suporta múltiplos provedores de LLM. Alterne entre eles perfeitamente para testar seus agentes com modelos diferentes e encontrar o melhor...

A Astreus CLI suporta múltiplos provedores de LLM. Alterne entre eles perfeitamente para testar seus agentes com modelos diferentes e encontrar o melhor ajuste para o seu caso de uso.

Provedores Suportados

Os exemplos selecionam modelos explicitamente; os padrões que continuam sendo suportados não mudam. Modelos descontinuados nas APIs nativas exigem a seleção explícita de um substituto atual.

A CLI existente obtém as opções de modelos do framework instalado por meio de getModelsByProvider. As quatro opções continuam sendo openai, claude, gemini e ollama.

OpenAI

O provedor padrão com acesso aos modelos GPT.

export OPENAI_API_KEY="${OPENAI_API_KEY:?Set OPENAI_API_KEY in your environment}"
astreus

IDs de modelos para selecionar explicitamente:

  • gpt-6-astra
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna

Modelos hospedados gratuitos pelo OpenRouter

Mantenha ASTREUS_PROVIDER=openai para modelos hospedados gratuitos. Forneça uma chave do OpenRouter pelo ambiente e selecione o modelo explicitamente. Aplicam-se os mesmos limites de requisições e requisitos de endpoint do guia LLM do framework.

export OPENAI_BASE_URL="https://openrouter.ai/api/v1"
export OPENAI_API_KEY="${OPENROUTER_API_KEY:?Set OPENROUTER_API_KEY in your environment}"
ASTREUS_PROVIDER=openai ASTREUS_MODEL=openrouter/free astreus

Anthropic (Claude)

Acesse os modelos Claude para conversas mais refinadas.

export ANTHROPIC_API_KEY="${ANTHROPIC_API_KEY:?Set ANTHROPIC_API_KEY in your environment}"
ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

IDs de modelos para selecionar explicitamente:

  • claude-fable-5-1
  • claude-opus-5
  • claude-sonnet-5
  • claude-haiku-4-5-20251001

Google (Gemini)

Use os modelos Gemini do Google.

export GEMINI_API_KEY="${GEMINI_API_KEY:?Set GEMINI_API_KEY in your environment}"
ASTREUS_PROVIDER=gemini astreus

Modelos Disponíveis:

  • gemini-pro (padrão) - Gemini Pro
  • gemini-pro-vision - Com suporte a visão

Ollama (Modelos Locais)

Execute modelos localmente com Ollama. Nenhuma chave de API é necessária.

# Certifique-se de que o Ollama está em execução
ollama serve

# Iniciar a CLI com Ollama
ASTREUS_PROVIDER=ollama astreus

Modelos Disponíveis:

  • llama3 (padrão) - Llama 3
  • llama2 - Llama 2
  • mistral - Mistral
  • codellama - Llama focado em código

Trocando de Provedor

Na Inicialização

Use variáveis de ambiente:

ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

Durante a Sessão

Use comandos de barra para trocar:

/provider claude
/model claude-sonnet-5

Ou abra o seletor interativo:

/provider
/model

Configuração de Provedor

Endpoints Customizados

Para implantações corporativas ou proxies:

# Ollama em um host diferente
export OLLAMA_HOST=http://192.168.1.100:11434

Suporte a Visão

Alguns provedores suportam capacidades de visão (imagem):

# Chave de API separada para visão (opcional)
export OPENAI_VISION_API_KEY=sk-your-vision-key
export ANTHROPIC_VISION_API_KEY=your-vision-key
export GEMINI_VISION_API_KEY=your-vision-key

Suporte a Embeddings

Para recursos de memória e base de conhecimento:

export OPENAI_EMBEDDING_API_KEY=sk-your-embedding-key
export GEMINI_EMBEDDING_API_KEY=your-embedding-key

Escolha de Modelo para Desenvolvimento de Agentes

Escolha o modelo certo com base no tipo de agente que você está construindo:

Tipo de AgenteModelo RecomendadoPor quê
Agente de Análise de Códigoclaude-sonnet-5Excelente em entender estrutura e padrões de código
Agente de Raciocínio Complexogpt-4o, claude-sonnet-5Melhor para raciocínio e planejamento em múltiplas etapas
Agente de Resposta Rápidagpt-4o-mini, gemini-proBaixa latência para interações em tempo real
Agente Intensivo em Ferramentasgpt-4oChamadas de função e uso de ferramentas confiáveis
Agente de Contexto Longoclaude-sonnet-5Confira o limite de contexto do modelo e do endpoint antes de enviar documentos grandes
Agente Local/Privadollama3, codellamaNenhum dado sai da sua máquina
Agente Sensível a Custogpt-3.5-turbo, OllamaMinimize os custos de API

Testando Agentes em Diferentes Provedores

Ao construir agentes, é útil testar com provedores diferentes:

# Comece a desenvolver com um modelo rápido e barato
/provider openai
/model gpt-4o-mini

# Teste raciocínio complexo com os melhores modelos
/provider claude
/model claude-sonnet-5

# Teste localmente antes da implantação
/provider ollama
/model llama3

Esse fluxo de trabalho ajuda você a entender como seu agente se comporta em diferentes LLMs e a encontrar o melhor equilíbrio entre capacidade, velocidade e custo para o seu caso de uso.

Última atualização: 13 de setembro de 2026