Proveedores
Astreus CLI admite múltiples proveedores de LLM. Cambia entre ellos sin esfuerzo para probar tus agentes con distintos modelos y encontrar el que mejor se...
Astreus CLI admite múltiples proveedores de LLM. Cambia entre ellos sin esfuerzo para probar tus agentes con distintos modelos y encontrar el que mejor se ajuste a tu caso de uso.
Proveedores compatibles
Los ejemplos seleccionan modelos explícitamente; los valores predeterminados que siguen siendo compatibles no cambian. Los modelos retirados de las API nativas requieren seleccionar explícitamente un reemplazo vigente.
La CLI existente obtiene las opciones de modelos del framework instalado mediante getModelsByProvider. Las cuatro opciones siguen siendo openai, claude, gemini y ollama.
OpenAI
El proveedor predeterminado, con acceso a los modelos GPT.
export OPENAI_API_KEY="${OPENAI_API_KEY:?Set OPENAI_API_KEY in your environment}"
astreusIdentificadores de modelos para seleccionar explícitamente:
gpt-6-astragpt-5.6-solgpt-5.6-terragpt-5.6-luna
Modelos alojados gratuitos a través de OpenRouter
Mantén ASTREUS_PROVIDER=openai para los modelos alojados gratuitos. Proporciona una clave de OpenRouter mediante el entorno y selecciona el modelo explícitamente. Se aplican los mismos límites de solicitudes y requisitos del endpoint que en la guía LLM del framework.
export OPENAI_BASE_URL="https://openrouter.ai/api/v1"
export OPENAI_API_KEY="${OPENROUTER_API_KEY:?Set OPENROUTER_API_KEY in your environment}"
ASTREUS_PROVIDER=openai ASTREUS_MODEL=openrouter/free astreusAnthropic (Claude)
Accede a los modelos Claude para conversaciones más matizadas.
export ANTHROPIC_API_KEY="${ANTHROPIC_API_KEY:?Set ANTHROPIC_API_KEY in your environment}"
ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreusIdentificadores de modelos para seleccionar explícitamente:
claude-fable-5-1claude-opus-5claude-sonnet-5claude-haiku-4-5-20251001
Google (Gemini)
Usa los modelos Gemini de Google.
export GEMINI_API_KEY="${GEMINI_API_KEY:?Set GEMINI_API_KEY in your environment}"
ASTREUS_PROVIDER=gemini astreusModelos disponibles:
gemini-pro(predeterminado) - Gemini Progemini-pro-vision- Compatible con visión
Ollama (modelos locales)
Ejecuta modelos localmente con Ollama. No requiere clave de API.
# Make sure Ollama is running
ollama serve
# Start CLI with Ollama
ASTREUS_PROVIDER=ollama astreusModelos disponibles:
llama3(predeterminado) - Llama 3llama2- Llama 2mistral- Mistralcodellama- Llama enfocado en código
Cambiar de proveedor
Al iniciar
Usa variables de entorno:
ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreusDurante la sesión
Usa comandos de barra para cambiar:
/provider claude
/model claude-sonnet-5O abre el selector interactivo:
/provider
/modelConfiguración de proveedores
Endpoints personalizados
Para despliegues empresariales o proxies:
# Ollama on different host
export OLLAMA_HOST=http://192.168.1.100:11434Soporte de visión
Algunos proveedores admiten capacidades de visión (imágenes):
# Separate API key for vision (optional)
export OPENAI_VISION_API_KEY=sk-your-vision-key
export ANTHROPIC_VISION_API_KEY=your-vision-key
export GEMINI_VISION_API_KEY=your-vision-keySoporte de embeddings
Para las funciones de memoria y conocimiento:
export OPENAI_EMBEDDING_API_KEY=sk-your-embedding-key
export GEMINI_EMBEDDING_API_KEY=your-embedding-keySelección de modelo para el desarrollo de agentes
Elige el modelo adecuado según el tipo de agente que estés construyendo:
| Tipo de agente | Modelo recomendado | Motivo |
|---|---|---|
| Agente de análisis de código | claude-sonnet-5 | Excelente comprensión de la estructura y los patrones del código |
| Agente de razonamiento complejo | gpt-4o, claude-sonnet-5 | Lo mejor para razonamiento y planificación en varios pasos |
| Agente de respuesta rápida | gpt-4o-mini, gemini-pro | Baja latencia para interacciones en tiempo real |
| Agente con uso intensivo de herramientas | gpt-4o | Llamadas a funciones y uso de herramientas fiables |
| Agente de contexto largo | claude-sonnet-5 | Comprueba el límite de contexto del modelo y del endpoint antes de enviar documentos extensos |
| Agente local/privado | llama3, codellama | Ningún dato sale de tu máquina |
| Agente sensible al coste | gpt-3.5-turbo, Ollama | Minimiza los costes de la API |
Probar agentes en distintos proveedores
Al construir agentes, resulta útil probarlos con distintos proveedores:
# Start developing with fast, cheap model
/provider openai
/model gpt-4o-mini
# Test complex reasoning with top models
/provider claude
/model claude-sonnet-5
# Test locally before deployment
/provider ollama
/model llama3Este flujo de trabajo te ayuda a entender cómo se comporta tu agente en distintos LLM y a encontrar el mejor equilibrio entre capacidad, velocidad y coste para tu caso de uso.
Última actualización: 13 de septiembre de 2026
En esta sección