Kein KYC
Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.
Wählen Sie das richtige Gleichgewicht aus Leistungsfähigkeit, Kontext und Kosten.
Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.
WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.
Veröffentlichte Modellquellen geprüft 2026-09-04. Check service status for current availability. API-Modellliste ↗
| Modell | Eingabe / 1M | Ausgabe / 1M | Kontext | Typ |
|---|---|---|---|---|
| LLlama 3.1 8B | $0.03 | $0.05 | 128K* | Text |
| DDeepSeek V4 Flash | $0.09 | $0.18 | 128K* | Text |
| GGemma 3 27B | $0.10 | $0.15 | 128K* | Text + Bilder |
| MMistral Small 3 | $0.10 | $0.20 | 32K* | Text |
| QQwen3-Coder-Next | $0.12 | $0.80 | 128K* | Text |
| HHermes 4 70B | $0.13 | $0.40 | 128K* | Text |
| MMistral Small 4 | $0.15 | $0.60 | 128K* | Text + Bild |
| QQwen3 32B | $0.15 | $0.20 | 128K* | Text |
| DDolphin Mistral 24B Venice Edition | $0.20 | $0.90 | 128K* | Text + Bild |
| QQwen3 235B A22B | $0.20 | $0.60 | 128K* | Text |
| DDeepSeek V3 | $0.25 | $0.85 | 128K* | Text |
| LLlama 3.3 70B | $0.35 | $0.40 | 128K* | Text |
| DDeepSeek R1 | $0.50 | $2.15 | 128K* | Text |
| MMixtral 8×22B | $0.60 | $0.60 | 64K* | Text |
| LLlama 3.1 405B | $1.20 | $1.20 | 128K* | Text |
Schnelle Klassifizierung, Extraktion und leichtgewichtiger Chat.
Ein Textmodell für Langkontext-Denken, Programmierung und Tool-Workflows, mit einem konfigurierten 1.048.576-Token-Fenster.
Bildverständnis und mehrsprachige Konversation.
Effiziente Textaufgaben, Funktionsaufrufe und Chat in europäischen Sprachen.
Ein reines Text-Coding-Modell für die Codebasis-Erkundung und Tool-Workflows, mit einem veröffentlichten nativen Kontext von 262.144 Token.
Kreative Konversation, Rollenspiel und logisches Denken mit konfigurierbaren Anweisungen, veröffentlicht von Nous Research.
Ein offizielles Mistral-Modell, das Text- und Bildeingabe, Tool-Aufrufe und konfigurierbares logisches Denken kombiniert, mit einem veröffentlichten Fenster von 262.144 Token.
Eine ausgewogene Wahl für Code, mehrsprachigen Chat und logisches Denken.
Konversationen und Charaktere mit anwendungsgesteuerten Anweisungen, von Dolphin und Venice.
Starke allgemeine Anweisungsbefolgung und Tool-Nutzung.
Codegenerierung, komplexe Anweisungen und strukturierte Aufgaben.
Allzweck-Assistenten, Zusammenfassung und Tool-Nutzung.
Schwieriges logisches Denken, Mathematik und Codeanalyse.
Mehrsprachige Generierung und Workflows für Funktionsaufrufe.
Anspruchsvolle Allzweck-Generierung und komplexe Anweisungen.