Astreus

Proveedores

Astreus CLI admite múltiples proveedores de LLM. Cambia entre ellos sin esfuerzo para probar tus agentes con distintos modelos y encontrar el que mejor se...

Astreus CLI admite múltiples proveedores de LLM. Cambia entre ellos sin esfuerzo para probar tus agentes con distintos modelos y encontrar el que mejor se ajuste a tu caso de uso.

Proveedores compatibles

Los ejemplos seleccionan modelos explícitamente; los valores predeterminados que siguen siendo compatibles no cambian. Los modelos retirados de las API nativas requieren seleccionar explícitamente un reemplazo vigente.

La CLI existente obtiene las opciones de modelos del framework instalado mediante getModelsByProvider. Las cuatro opciones siguen siendo openai, claude, gemini y ollama.

OpenAI

El proveedor predeterminado, con acceso a los modelos GPT.

export OPENAI_API_KEY="${OPENAI_API_KEY:?Set OPENAI_API_KEY in your environment}"
astreus

Identificadores de modelos para seleccionar explícitamente:

  • gpt-6-astra
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna

Modelos alojados gratuitos a través de OpenRouter

Mantén ASTREUS_PROVIDER=openai para los modelos alojados gratuitos. Proporciona una clave de OpenRouter mediante el entorno y selecciona el modelo explícitamente. Se aplican los mismos límites de solicitudes y requisitos del endpoint que en la guía LLM del framework.

export OPENAI_BASE_URL="https://openrouter.ai/api/v1"
export OPENAI_API_KEY="${OPENROUTER_API_KEY:?Set OPENROUTER_API_KEY in your environment}"
ASTREUS_PROVIDER=openai ASTREUS_MODEL=openrouter/free astreus

Anthropic (Claude)

Accede a los modelos Claude para conversaciones más matizadas.

export ANTHROPIC_API_KEY="${ANTHROPIC_API_KEY:?Set ANTHROPIC_API_KEY in your environment}"
ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

Identificadores de modelos para seleccionar explícitamente:

  • claude-fable-5-1
  • claude-opus-5
  • claude-sonnet-5
  • claude-haiku-4-5-20251001

Google (Gemini)

Usa los modelos Gemini de Google.

export GEMINI_API_KEY="${GEMINI_API_KEY:?Set GEMINI_API_KEY in your environment}"
ASTREUS_PROVIDER=gemini astreus

Modelos disponibles:

  • gemini-pro (predeterminado) - Gemini Pro
  • gemini-pro-vision - Compatible con visión

Ollama (modelos locales)

Ejecuta modelos localmente con Ollama. No requiere clave de API.

# Make sure Ollama is running
ollama serve

# Start CLI with Ollama
ASTREUS_PROVIDER=ollama astreus

Modelos disponibles:

  • llama3 (predeterminado) - Llama 3
  • llama2 - Llama 2
  • mistral - Mistral
  • codellama - Llama enfocado en código

Cambiar de proveedor

Al iniciar

Usa variables de entorno:

ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

Durante la sesión

Usa comandos de barra para cambiar:

/provider claude
/model claude-sonnet-5

O abre el selector interactivo:

/provider
/model

Configuración de proveedores

Endpoints personalizados

Para despliegues empresariales o proxies:

# Ollama on different host
export OLLAMA_HOST=http://192.168.1.100:11434

Soporte de visión

Algunos proveedores admiten capacidades de visión (imágenes):

# Separate API key for vision (optional)
export OPENAI_VISION_API_KEY=sk-your-vision-key
export ANTHROPIC_VISION_API_KEY=your-vision-key
export GEMINI_VISION_API_KEY=your-vision-key

Soporte de embeddings

Para las funciones de memoria y conocimiento:

export OPENAI_EMBEDDING_API_KEY=sk-your-embedding-key
export GEMINI_EMBEDDING_API_KEY=your-embedding-key

Selección de modelo para el desarrollo de agentes

Elige el modelo adecuado según el tipo de agente que estés construyendo:

Tipo de agenteModelo recomendadoMotivo
Agente de análisis de códigoclaude-sonnet-5Excelente comprensión de la estructura y los patrones del código
Agente de razonamiento complejogpt-4o, claude-sonnet-5Lo mejor para razonamiento y planificación en varios pasos
Agente de respuesta rápidagpt-4o-mini, gemini-proBaja latencia para interacciones en tiempo real
Agente con uso intensivo de herramientasgpt-4oLlamadas a funciones y uso de herramientas fiables
Agente de contexto largoclaude-sonnet-5Comprueba el límite de contexto del modelo y del endpoint antes de enviar documentos extensos
Agente local/privadollama3, codellamaNingún dato sale de tu máquina
Agente sensible al costegpt-3.5-turbo, OllamaMinimiza los costes de la API

Probar agentes en distintos proveedores

Al construir agentes, resulta útil probarlos con distintos proveedores:

# Start developing with fast, cheap model
/provider openai
/model gpt-4o-mini

# Test complex reasoning with top models
/provider claude
/model claude-sonnet-5

# Test locally before deployment
/provider ollama
/model llama3

Este flujo de trabajo te ayuda a entender cómo se comporta tu agente en distintos LLM y a encontrar el mejor equilibrio entre capacidad, velocidad y coste para tu caso de uso.

Última actualización: 13 de septiembre de 2026