pro Model HubDocs

Changelog

Neue Modelle, Funktionen und Änderungen.

05.10.2026

  • Neu: Credit-Pakete ersetzen Grundgebühr und Abrechnung nach Verbrauch. Du buchst ein Monatspaket (Starter, Pro, Business oder Business Plus) mit festem Kontingent an Credits, siehe Abrechnung.
  • Jedes Modell hat einen Credit-Faktor (Credits pro Token) statt Euro-Preisen für Input und Output. Die Faktoren stehen in der Modellübersicht.
  • Das Starter-Paket ist 30 Tage kostenlos testbar.
  • Der Abrechnungszeitraum beginnt mit der Bestellung statt mit dem Kalendermonat.
  • Requests pro Minute und parallele Requests richten sich nach dem Paket und gelten für den ganzen Account statt 60 Requests pro Minute pro Key (Limits).
  • Ist das Paket verbraucht, antwortet die API mit 429 und insufficient_quota, ohne Paket mit 403 und no_package (Fehler).
  • Limits pro Key und Nutzer werden in Credits pro Abrechnungszeitraum statt in Euro pro Monat festgelegt.

30.09.2026

  • Diese Dokumentation ist online: Anleitungen, API-Referenz und eine eigene Seite pro Modell.
  • Reasoning, Tool-Calling und Bildeingabe sind pro Modell dokumentiert.

28.09.2026

  • Neu: Gemma 4 31B (gemma-4-31b) als großes Allround-Modell, mit Bildeingabe und optionalem Reasoning. Ersetzt Llama 3.3 70B.
  • Neu: Qwen3-Coder-Next (qwen3-coder-next) für Programmierung und Coding-Agenten.
  • Neu: Qwen3.8 27B (qwen3.8-27b) mit Reasoning.
  • Neu: Embedding-Modell Qwen3-VL-Embedding 2B (qwen3-vl-embedding-2b) für semantische Suche und RAG.
  • Entfernt: Llama 3.3 70B.
  • Tool-Calling funktioniert bei allen Chat-Modellen.

26.09.2026

  • Mehrere API-Keys pro Nutzer, mit Modellbeschränkung, Monatslimit und Ablaufdatum.
  • Kontextfenster auf 32.768 Token erhöht.

25.09.2026

  • Beta-Start mit Llama 3.3 70B und Mistral Small 24B (mistral-small-24b).
  • Preise pro Modell statt Preisstufen.

Auf dieser Seite