Changelog
Neue Modelle, Funktionen und Änderungen.
05.10.2026
- Neu: Credit-Pakete ersetzen Grundgebühr und Abrechnung nach Verbrauch. Du buchst ein Monatspaket (Starter, Pro, Business oder Business Plus) mit festem Kontingent an Credits, siehe Abrechnung.
- Jedes Modell hat einen Credit-Faktor (Credits pro Token) statt Euro-Preisen für Input und Output. Die Faktoren stehen in der Modellübersicht.
- Das Starter-Paket ist 30 Tage kostenlos testbar.
- Der Abrechnungszeitraum beginnt mit der Bestellung statt mit dem Kalendermonat.
- Requests pro Minute und parallele Requests richten sich nach dem Paket und gelten für den ganzen Account statt 60 Requests pro Minute pro Key (Limits).
- Ist das Paket verbraucht, antwortet die API mit
429undinsufficient_quota, ohne Paket mit403undno_package(Fehler). - Limits pro Key und Nutzer werden in Credits pro Abrechnungszeitraum statt in Euro pro Monat festgelegt.
30.09.2026
- Diese Dokumentation ist online: Anleitungen, API-Referenz und eine eigene Seite pro Modell.
- Reasoning, Tool-Calling und Bildeingabe sind pro Modell dokumentiert.
28.09.2026
- Neu: Gemma 4 31B (
gemma-4-31b) als großes Allround-Modell, mit Bildeingabe und optionalem Reasoning. Ersetzt Llama 3.3 70B. - Neu: Qwen3-Coder-Next (
qwen3-coder-next) für Programmierung und Coding-Agenten. - Neu: Qwen3.8 27B (
qwen3.8-27b) mit Reasoning. - Neu: Embedding-Modell Qwen3-VL-Embedding 2B (
qwen3-vl-embedding-2b) für semantische Suche und RAG. - Entfernt: Llama 3.3 70B.
- Tool-Calling funktioniert bei allen Chat-Modellen.
26.09.2026
- Mehrere API-Keys pro Nutzer, mit Modellbeschränkung, Monatslimit und Ablaufdatum.
- Kontextfenster auf 32.768 Token erhöht.
25.09.2026
- Beta-Start mit Llama 3.3 70B und Mistral Small 24B (
mistral-small-24b). - Preise pro Modell statt Preisstufen.