Free
- Alle Modelle im Chat — LuNa 0.5, 0.4 & St (St nur bei GPU)
- 22 Nachrichten / 5 Std (gleitendes Fenster)
- Verlauf auf deinem Gerät
- API zum Ausprobieren — 5 / min per Account-Login (CLI)
- Eigene API-Keys
Plus
- Alle Modelle im Chat & per API
- Unbegrenzte Nachrichten im Chat
- API mit 60 / min
- Eigene API-Keys erstellen
Pro
- Alles aus Plus
- API mit 120 / min
- Vorrang in der Queue — höchste Priorität
- Früher Zugang zu neuen Modellen
- Unterstützt direkt GPU-Zeit & das Training der nächsten LuNa
Die Pläne gelten schon — nur die monatlichen Beträge sind ein Ausblick; aktuell zahlst du nichts. Deine API-Keys verwaltest du auf der Keys-Seite. Fragen? Schau ins FAQ.
API-Preise pro Modell · geplant
So könnte die Abrechnung später aussehen — pro 1 Million Tokens, getrennt nach Ein- und Ausgabe. Aktuell ist die API kostenlos. LuNa 0.4 ist von Grund auf selbst trainiert, LuNa 0.5 ist unser kompaktes Hauptmodell, LuNa St ein Finetune von Qwen2.5-7B — alles selbst gehostet.
| Modell | Kontext | Input / 1M | Output / 1M |
|---|---|---|---|
| LuNa Stluna-0.1 | 8K | 3,00 € | 12,00 € |
| LuNa 0.5luna-0.5 | 2K | 0,50 € | 2,00 € |
| LuNa 0.4Legacyluna-0.4 | 2K | 0,30 € | 1,20 € |
Alle Modelle liefern meist 30–40 Tokens/s — unter Last kann das Tempo zeitweise auf ~3 Tok/s sinken (Live-Zustand: Status). Zum Testen gibt es ein Gratis-Kontingent. Technische Details in der Modell-Doku, Keys verwaltest du hier.