Astreus

Provider

Astreus CLI unterstützt mehrere LLM-Provider. Wechsle nahtlos zwischen ihnen, um deine Agenten mit verschiedenen Modellen zu testen und die beste Lösung für...

Astreus CLI unterstützt mehrere LLM-Provider. Wechsle nahtlos zwischen ihnen, um deine Agenten mit verschiedenen Modellen zu testen und die beste Lösung für deinen Anwendungsfall zu finden.

Unterstützte Provider

Die Beispiele wählen Modelle ausdrücklich aus; weiterhin unterstützte Standardwerte bleiben unverändert. Für eingestellte Modelle der nativen APIs muss ausdrücklich ein aktuelles Ersatzmodell ausgewählt werden.

Die bestehende CLI bezieht ihre Modellauswahl über getModelsByProvider aus dem installierten Framework. Die vier Optionen bleiben openai, claude, gemini und ollama.

OpenAI

Der Standard-Provider mit Zugriff auf GPT-Modelle.

export OPENAI_API_KEY="${OPENAI_API_KEY:?Set OPENAI_API_KEY in your environment}"
astreus

Modell-IDs zur ausdrücklichen Auswahl:

  • gpt-6-astra
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna

Kostenlose gehostete Modelle über OpenRouter

Behalte für kostenlose gehostete Modelle ASTREUS_PROVIDER=openai bei. Stelle einen OpenRouter-Schlüssel über die Umgebung bereit und wähle das Modell ausdrücklich aus. Es gelten dieselben Anfragelimits und Endpunktanforderungen wie im LLM-Leitfaden des Frameworks.

export OPENAI_BASE_URL="https://openrouter.ai/api/v1"
export OPENAI_API_KEY="${OPENROUTER_API_KEY:?Set OPENROUTER_API_KEY in your environment}"
ASTREUS_PROVIDER=openai ASTREUS_MODEL=openrouter/free astreus

Anthropic (Claude)

Zugriff auf Claude-Modelle für differenzierte Unterhaltungen.

export ANTHROPIC_API_KEY="${ANTHROPIC_API_KEY:?Set ANTHROPIC_API_KEY in your environment}"
ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

Modell-IDs zur ausdrücklichen Auswahl:

  • claude-fable-5-1
  • claude-opus-5
  • claude-sonnet-5
  • claude-haiku-4-5-20251001

Google (Gemini)

Verwende Googles Gemini-Modelle.

export GEMINI_API_KEY="${GEMINI_API_KEY:?Set GEMINI_API_KEY in your environment}"
ASTREUS_PROVIDER=gemini astreus

Verfügbare Modelle:

  • gemini-pro (Standard) - Gemini Pro
  • gemini-pro-vision - Mit Bildverständnis

Ollama (Lokale Modelle)

Führe Modelle lokal mit Ollama aus. Kein API-Schlüssel erforderlich.

# Make sure Ollama is running
ollama serve

# Start CLI with Ollama
ASTREUS_PROVIDER=ollama astreus

Verfügbare Modelle:

  • llama3 (Standard) - Llama 3
  • llama2 - Llama 2
  • mistral - Mistral
  • codellama - Code-fokussiertes Llama

Provider wechseln

Beim Start

Verwende Umgebungsvariablen:

ASTREUS_PROVIDER=claude ASTREUS_MODEL=claude-sonnet-5 astreus

Während der Sitzung

Verwende Slash-Befehle zum Wechseln:

/provider claude
/model claude-sonnet-5

Oder öffne den interaktiven Selektor:

/provider
/model

Provider-Konfiguration

Benutzerdefinierte Endpunkte

Für Unternehmensbereitstellungen oder Proxys:

# Ollama on different host
export OLLAMA_HOST=http://192.168.1.100:11434

Vision-Unterstützung

Einige Provider unterstützen Vision (Bild)-Funktionen:

# Separate API key for vision (optional)
export OPENAI_VISION_API_KEY=sk-your-vision-key
export ANTHROPIC_VISION_API_KEY=your-vision-key
export GEMINI_VISION_API_KEY=your-vision-key

Embedding-Unterstützung

Für Speicher- und Wissensfunktionen:

export OPENAI_EMBEDDING_API_KEY=sk-your-embedding-key
export GEMINI_EMBEDDING_API_KEY=your-embedding-key

Modellauswahl für die Agentenentwicklung

Wähle das richtige Modell basierend auf dem Agententyp, den du erstellst:

AgententypEmpfohlenes ModellWarum
Code-Analyse-Agentclaude-sonnet-5Hervorragend im Verständnis von Codestruktur und -mustern
Komplexer Reasoning-Agentgpt-4o, claude-sonnet-5Am besten für mehrstufiges Reasoning und Planung
Schnell antwortender Agentgpt-4o-mini, gemini-proGeringe Latenz für Echtzeitinteraktionen
Tool-intensiver Agentgpt-4oZuverlässiges Function Calling und Tool-Nutzung
Agent mit langem Kontextclaude-sonnet-5Prüfe vor großen Dokumenten das Kontextlimit des gewählten Modells und Endpunkts
Lokaler/privater Agentllama3, codellamaKeine Daten verlassen deinen Rechner
Kostensensitiver Agentgpt-3.5-turbo, OllamaAPI-Kosten minimieren

Agenten providerübergreifend testen

Beim Erstellen von Agenten ist es hilfreich, mit verschiedenen Providern zu testen:

# Start developing with fast, cheap model
/provider openai
/model gpt-4o-mini

# Test complex reasoning with top models
/provider claude
/model claude-sonnet-5

# Test locally before deployment
/provider ollama
/model llama3

Dieser Workflow hilft dir zu verstehen, wie sich dein Agent über verschiedene LLMs hinweg verhält, und die beste Balance aus Leistungsfähigkeit, Geschwindigkeit und Kosten für deinen Anwendungsfall zu finden.

Zuletzt aktualisiert: 13. September 2026