weightsapi.INFERENZKonsole
Navigation
Modellkatalog

Modellkatalog

Wählen Sie das richtige Gleichgewicht aus Leistungsfähigkeit, Kontext und Kosten.

Kein KYC

Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.

Keine zusätzlichen Inhaltsfilter

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.

15 Open-Weight-Modelle. Veröffentlichungen der Herausgeber.

Veröffentlichte Modellquellen geprüft 2026-09-04. Check service status for current availability. API-Modellliste ↗

ModellEingabe / 1MAusgabe / 1MKontextTyp
LLlama 3.1 8B$0.03$0.05128K*Text
DDeepSeek V4 Flash$0.09$0.18128K*Text
GGemma 3 27B$0.10$0.15128K*Text + Bilder
MMistral Small 3$0.10$0.2032K*Text
QQwen3-Coder-Next$0.12$0.80128K*Text
HHermes 4 70B$0.13$0.40128K*Text
MMistral Small 4$0.15$0.60128K*Text + Bild
QQwen3 32B$0.15$0.20128K*Text
DDolphin Mistral 24B Venice Edition$0.20$0.90128K*Text + Bild
QQwen3 235B A22B$0.20$0.60128K*Text
DDeepSeek V3$0.25$0.85128K*Text
LLlama 3.3 70B$0.35$0.40128K*Text
DDeepSeek R1$0.50$2.15128K*Text
MMixtral 8×22B$0.60$0.6064K*Text
LLlama 3.1 405B$1.20$1.20128K*Text

Nach Workload auswählen

Llama 3.1 8B

Schnelle Klassifizierung, Extraktion und leichtgewichtiger Chat.

$0.03 / $0.05Llama 3.1 Community

DeepSeek V4 Flash

Ein Textmodell für Langkontext-Denken, Programmierung und Tool-Workflows, mit einem konfigurierten 1.048.576-Token-Fenster.

$0.09 / $0.18MIT

Gemma 3 27B

Bildverständnis und mehrsprachige Konversation.

$0.10 / $0.15Gemma Terms of Use

Mistral Small 3

Effiziente Textaufgaben, Funktionsaufrufe und Chat in europäischen Sprachen.

$0.10 / $0.20Apache 2.0

Qwen3-Coder-Next

Ein reines Text-Coding-Modell für die Codebasis-Erkundung und Tool-Workflows, mit einem veröffentlichten nativen Kontext von 262.144 Token.

$0.12 / $0.80Apache 2.0

Hermes 4 70B

Kreative Konversation, Rollenspiel und logisches Denken mit konfigurierbaren Anweisungen, veröffentlicht von Nous Research.

$0.13 / $0.40Meta Llama Community

Mistral Small 4

Ein offizielles Mistral-Modell, das Text- und Bildeingabe, Tool-Aufrufe und konfigurierbares logisches Denken kombiniert, mit einem veröffentlichten Fenster von 262.144 Token.

$0.15 / $0.60Apache 2.0

Qwen3 32B

Eine ausgewogene Wahl für Code, mehrsprachigen Chat und logisches Denken.

$0.15 / $0.20Apache 2.0

Dolphin Mistral 24B Venice Edition

Konversationen und Charaktere mit anwendungsgesteuerten Anweisungen, von Dolphin und Venice.

$0.20 / $0.90Apache 2.0

Qwen3 235B A22B

Starke allgemeine Anweisungsbefolgung und Tool-Nutzung.

$0.20 / $0.60Apache 2.0

DeepSeek V3

Codegenerierung, komplexe Anweisungen und strukturierte Aufgaben.

$0.25 / $0.85MIT

Llama 3.3 70B

Allzweck-Assistenten, Zusammenfassung und Tool-Nutzung.

$0.35 / $0.40Llama 3.3 Community

DeepSeek R1

Schwieriges logisches Denken, Mathematik und Codeanalyse.

$0.50 / $2.15MIT

Mixtral 8×22B

Mehrsprachige Generierung und Workflows für Funktionsaufrufe.

$0.60 / $0.60Apache 2.0

Llama 3.1 405B

Anspruchsvolle Allzweck-Generierung und komplexe Anweisungen.

$1.20 / $1.20Llama 3.1 Community