# WeightsAPI > Kein KYC · Keine zusätzlichen Inhaltsfilter Entdecken Sie Open-Weight-Modelle, vergleichen Sie Tokenpreise und bereiten Sie einen OpenAI-kompatiblen Inferenz-Workflow mit WeightsAPI vor. ## Muss ich KYC abschließen? Der aktuelle Anmeldevorgang beinhaltet kein Hochladen von Ausweisdokumenten oder einen KYC-Verifizierungsschritt. Ein angemeldetes Konto ist dennoch erforderlich, und die Nutzung bleibt mit diesem Konto verknüpft. - [Muss ich KYC abschließen?](https://weightsapi.com/de/faq#kyc-and-account) ## Sind die Modelle unzensiert? WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Der Katalog umfasst Originalmodelle und von ihren jeweiligen Erstellern veröffentlichte feinabgestimmte Varianten, einschließlich Dolphin und Hermes. Einige Varianten sind darauf ausgelegt, Ablehnungen zu reduzieren; das Modelltraining kann dennoch Ablehnungen verursachen. Lesen Sie die Quellen- und Verhaltenshinweise jedes Modells. - [Sind die Modelle unzensiert?](https://weightsapi.com/de/faq#model-filters) ## Kontozugriff und Modellverhalten Der aktuelle WeightsAPI-Kontoablauf umfasst keinen Upload von Ausweisdokumenten oder KYC-Schritt; Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft. WeightsAPI fügt keinen Gateway-Inhaltsfilter hinzu. Der Katalog umfasst Originalmodelle und veröffentlichte feinabgestimmte Varianten, einschließlich Dolphin und Hermes. Deren Training und Konfiguration können dennoch Ablehnungen verursachen. - [Wissen Sie, wovon Ihre Anfrage abhängt.](https://weightsapi.com/de/trust#account-and-model-behavior) ## Kontozugriff Melden Sie sich an und bestätigen Sie eine Aufladung von mindestens USD 100, dann geben Sie Ihr Prepaid-Guthaben aus. Jede Aufladung hat dasselbe Minimum; kleinere Restguthaben bleiben nutzbar. Prüfen Sie den Servicestatus auf Modellverfügbarkeit. ## Schnellstart - [llms-full.txt](https://weightsapi.com/de/llms-full.txt): Schnellstart - [service-info.json](https://weightsapi.com/service-info.json) - [Managed LLM-Inferenz. Offene Modelle, eine API.](https://weightsapi.com/de): Entdecken Sie Open-Weight-Modelle, vergleichen Sie Tokenpreise und bereiten Sie einen OpenAI-kompatiblen Inferenz-Workflow mit WeightsAPI vor. - [Häufig gestellte Fragen](https://weightsapi.com/de/faq): Praktische Antworten zu WeightsAPI-Zugriff, API-Integration, Krypto-Guthaben, Abrechnung und Datenverarbeitung. - [Wissen Sie, wovon Ihre Anfrage abhängt.](https://weightsapi.com/de/trust): Kontosteuerung, Datenverarbeitung, Zahlungsverifizierung und Umfang der Dienstverfügbarkeit. - [Modellkatalog](https://weightsapi.com/de/models): Wählen Sie das richtige Gleichgewicht aus Leistungsfähigkeit, Kontext und Kosten. - [Transparent bis auf den Token.](https://weightsapi.com/de/pricing): Vergleichen Sie Pay-as-you-go-Tokenpreise und prepaid monatliche GPU-Mieten. - [Schnellstart](https://weightsapi.com/de/docs): Stellen Sie Ihre erste OpenAI-kompatible Anfrage. - [Authentifizierung](https://weightsapi.com/de/docs/authentication): Bearer-Schlüssel, Budgets pro Schlüssel und Modellbeschränkungen. - [Abrechnung und Krypto-Einzahlungen](https://weightsapi.com/de/docs/billing): Guthaben, Bestätigungen, Buchhaltung und Auszahlungen. - [Datenverarbeitung](https://weightsapi.com/de/docs/privacy): Was das Gateway speichert und was es niemals protokolliert. - [Dienststatus](https://weightsapi.com/de/status): Modellverfügbarkeit und Störungsverlauf. - [Über WeightsAPI](https://weightsapi.com/de/about): Wie WeightsAPI verwaltete Inferenz, gemeinsame und dedizierte Kapazität, Modellwahl und Kontosteuerung angeht. - [Was eine Million Tokens tatsächlich kostet](https://weightsapi.com/de/blog/cost-per-million): Eine Million Eingabetokens und eine Million Ausgabetokens sind unterschiedliche Produkte. Bei Qwen3 32B kosten 800.000 Eingabe- und 200.000 Ausgabetokens zu den angegebenen Tarifen $0.16. Dieselbe Gesamtzahl mit einem Ausgabeanteil von 80 % kostet $0.19. - [Schätzen Sie den Verbrauch, bevor Sie migrieren](https://weightsapi.com/de/blog/estimate-migration): Wählen Sie eine repräsentative Woche und gruppieren Sie Anfragen nach Workflow. Bewahren Sie Token-Zahlen und Zeitangaben, ohne sensible Inhalte in Analysen zu speichern. - [Technische Hinweise](https://weightsapi.com/de/blog): Praktische Kompromisse beim Betrieb und der Nutzung offener Modelle. - [Latenz und Durchsatz beantworten unterschiedliche Fragen](https://weightsapi.com/de/blog/latency-throughput): TTFT umfasst Warteschlangen und Prefill. Es bestimmt, wie lange ein Benutzer wartet, bevor er eine Ausgabe sieht. - [Quantisierung ist ein Kompromiss, kein kostenloses Upgrade](https://weightsapi.com/de/blog/quantization): Geringere Präzision reduziert den Speicherverbrauch und kann den Durchsatz verbessern. Ob sich die Qualität ändert, hängt vom Modell, der Quantisierungsmethode und der Aufgabe ab. - [Self-Hosting versus API: Rechnen Sie nach](https://weightsapi.com/de/blog/self-hosting): Die monatlichen Kosten für dedizierte Kapazität geteilt durch die effektiven API-Kosten pro eine Million Tokens ergeben die Volumenschwelle vor Engineering- und Zuverlässigkeitskosten. Eine H100 für $1,690 und effektive $0.16 pro eine Million Tokens ergeben etwa 10.56 Milliarden Tokens pro Monat. Das beweist nicht, dass eine einzelne H100 diese Arbeitslast bedienen kann. - [Dokumentation und Buchhaltungskonsole](https://weightsapi.com/de/changelog/2026-09-04-documentation-preview): Erstveröffentlichung von Katalog, Dokumentation und Kontoverwaltung, wobei Bereitstellung und Zahlungsverfügbarkeit getrennt erfasst werden. - [Änderungsprotokoll](https://weightsapi.com/de/changelog): Produktänderungen und Versionshinweise, datiert und nachvollziehbar. - [Modelle vergleichen](https://weightsapi.com/de/compare): Eine einzige Informationsquelle für Preise, Kontext und Fähigkeiten. - [Hunderttausend Dokumente im Batch verarbeiten](https://weightsapi.com/de/cookbook/batch-documents): Bereiten Sie einen JSONL-Batch vor, senden Sie ihn ab und pollen Sie dann auf die Ausgabedatei. - [An einen Browser streamen](https://weightsapi.com/de/cookbook/browser-streaming): Ein Same-Origin-Node-Server hält den API-Schlüssel und leitet SSE weiter. - [Ein Chatbot in zwanzig Zeilen](https://weightsapi.com/de/cookbook/chatbot): Eine Terminal-Konversation, die nur die Python-Standardbibliothek verwendet. - [Rezepte, die Sie ausführen können.](https://weightsapi.com/de/cookbook): Kleine, eigenständige Beispiele für echte Inferenz-Workflows. - [Nach Aufgabenschwierigkeit routen](https://weightsapi.com/de/cookbook/model-routing): Eine explizite Heuristik leitet kurze Aufgaben und komplexe Analysen weiter. - [RAG mit Zitaten](https://weightsapi.com/de/cookbook/rag-with-citations): Eine kleine Retrieval-Pipeline mit überprüfbaren Quell-IDs. - [Validierte strukturierte Ausgabe](https://weightsapi.com/de/cookbook/structured-output): Ein striktes Schema plus unabhängige Validierung. - [Ein Agent, der ein Tool aufruft](https://weightsapi.com/de/cookbook/tool-agent): Ein begrenzter, auf der Allowlist stehender Funktionsaufruf und eine Folgeantwort. - [Mieten Sie eine dedizierte GPU für Ihr Modell.](https://weightsapi.com/de/dedicated): Wählen Sie aus sechs GPU-Konfigurationen, geben Sie eine monatliche Mietbestellung auf und zahlen Sie mit Ihrem Kontoguthaben oder Krypto-Guthaben. - [API-Referenz](https://weightsapi.com/de/docs/api-reference): Endpunkte, Anfragefelder und Antwortverträge. - [Fehler und Wiederherstellung](https://weightsapi.com/de/docs/errors): Verstehen Sie, was fehlgeschlagen ist und was als Nächstes zu tun ist. - [Funktionsaufrufe](https://weightsapi.com/de/docs/function-calling): Rufen Sie Tools auf der Zulassungsliste mit validierten Argumenten auf. - [Ratenbegrenzungen und Kontingente](https://weightsapi.com/de/docs/limits): Token-Fenster, Zugang für finanzierte Konten und Anfragegrenzen. - [Migration von OpenAI oder Anthropic](https://weightsapi.com/de/docs/migration): Exakte Änderungen für die Chat Completions API. - [Streaming](https://weightsapi.com/de/docs/streaming): Server-Sent Events konsumieren und Verbindungsabbrüche behandeln. - [Strikte JSON-Ausgabe](https://weightsapi.com/de/docs/structured-output): Begrenzen Sie die Struktur und validieren Sie jede Antwort. - [Von einer Aufgabe zu einem klareren Inferenz-Workflow.](https://weightsapi.com/de/how-it-works): Verstehen Sie Managed Inference, wählen Sie ein Modell, bereiten Sie eine Anfrage vor und verfolgen Sie den Zusammenhang zwischen Guthaben, reservierten Beträgen und Nutzung. - [Cline](https://weightsapi.com/de/integrations/cline): Konfigurieren Sie Cline mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Continue.dev](https://weightsapi.com/de/integrations/continue): Konfigurieren Sie Continue.dev mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Cursor](https://weightsapi.com/de/integrations/cursor): Konfigurieren Sie Cursor mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Dify](https://weightsapi.com/de/integrations/dify): Konfigurieren Sie Dify mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Ihre Tools. Unsere Inferenz.](https://weightsapi.com/de/integrations): Exakte Konfigurationsanleitungen für die Tools, die Sie bereits verwenden. - [LangChain (Python)](https://weightsapi.com/de/integrations/langchain): Konfigurieren Sie LangChain (Python) mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [LibreChat](https://weightsapi.com/de/integrations/librechat): Konfigurieren Sie LibreChat mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [LlamaIndex (Python)](https://weightsapi.com/de/integrations/llamaindex): Konfigurieren Sie LlamaIndex (Python) mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [n8n](https://weightsapi.com/de/integrations/n8n): Konfigurieren Sie n8n mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Obsidian](https://weightsapi.com/de/integrations/obsidian): Konfigurieren Sie Obsidian mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Open WebUI](https://weightsapi.com/de/integrations/open-webui): Konfigurieren Sie Open WebUI mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [Roo Code](https://weightsapi.com/de/integrations/roo-code): Konfigurieren Sie Roo Code mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [SillyTavern](https://weightsapi.com/de/integrations/sillytavern): Konfigurieren Sie SillyTavern mit dem WeightsAPI OpenAI-kompatiblen Endpunkt. - [DeepSeek R1](https://weightsapi.com/de/models/deepseek-r1): Schwieriges logisches Denken, Mathematik und Codeanalyse. - [DeepSeek V3](https://weightsapi.com/de/models/deepseek-v3): Codegenerierung, komplexe Anweisungen und strukturierte Aufgaben. - [DeepSeek V4 Flash](https://weightsapi.com/de/models/deepseek-v4-flash): Ein Textmodell für Langkontext-Denken, Programmierung und Tool-Workflows, mit einem konfigurierten 1.048.576-Token-Fenster. - [Dolphin Mistral 24B Venice Edition](https://weightsapi.com/de/models/dolphin-mistral-24b-venice-edition): Konversationen und Charaktere mit anwendungsgesteuerten Anweisungen, von Dolphin und Venice. - [Gemma 3 27B](https://weightsapi.com/de/models/gemma-3-27b): Bildverständnis und mehrsprachige Konversation. - [Hermes 4 70B](https://weightsapi.com/de/models/hermes-4-70b): Kreative Konversation, Rollenspiel und logisches Denken mit konfigurierbaren Anweisungen, veröffentlicht von Nous Research. - [Llama 3.1 405B](https://weightsapi.com/de/models/llama-3-1-405b): Anspruchsvolle Allzweck-Generierung und komplexe Anweisungen. - [Llama 3.1 8B](https://weightsapi.com/de/models/llama-3-1-8b): Schnelle Klassifizierung, Extraktion und leichtgewichtiger Chat. - [Llama 3.3 70B](https://weightsapi.com/de/models/llama-3-3-70b): Allzweck-Assistenten, Zusammenfassung und Tool-Nutzung. - [Mistral Small 3](https://weightsapi.com/de/models/mistral-small-3): Effiziente Textaufgaben, Funktionsaufrufe und Chat in europäischen Sprachen. - [Mistral Small 4](https://weightsapi.com/de/models/mistral-small-4): Ein offizielles Mistral-Modell, das Text- und Bildeingabe, Tool-Aufrufe und konfigurierbares logisches Denken kombiniert, mit einem veröffentlichten Fenster von 262.144 Token. - [Mixtral 8×22B](https://weightsapi.com/de/models/mixtral-8x22b): Mehrsprachige Generierung und Workflows für Funktionsaufrufe. - [Qwen3 235B A22B](https://weightsapi.com/de/models/qwen3-235b-a22b): Starke allgemeine Anweisungsbefolgung und Tool-Nutzung. - [Qwen3 32B](https://weightsapi.com/de/models/qwen3-32b): Eine ausgewogene Wahl für Code, mehrsprachigen Chat und logisches Denken. - [Qwen3-Coder-Next](https://weightsapi.com/de/models/qwen3-coder-next): Ein reines Text-Coding-Modell für die Codebasis-Erkundung und Tool-Workflows, mit einem veröffentlichten nativen Kontext von 262.144 Token. - [Datenschutz und Datenverarbeitung](https://weightsapi.com/de/privacy): Kontodaten, Anfrageinhalte und Umfang der Datenverarbeitung. - [Bringen Sie eine Anfrage wieder auf Kurs.](https://weightsapi.com/de/support): Diagnostizieren Sie API-, Streaming- und Abrechnungsprobleme und erstellen Sie anschließend einen nützlichen Bericht, ohne Geheimnisse preiszugeben. - [Dienstbedingungen](https://weightsapi.com/de/terms): Zahlung, Aktivierung, Mietzeiträume und Servicebedingungen. - [Anwendungsfälle, die Sie bewerten können](https://weightsapi.com/de/use-cases): Praktische Szenarien für Konversationsassistenten, Code- und Tool-Workflows sowie Dokumentfragen, mit klaren Eingaben und Qualitätsprüfungen. ## Sprache - [English](https://weightsapi.com/llms.txt) - [Français](https://weightsapi.com/fr/llms.txt) - [Deutsch](https://weightsapi.com/de/llms.txt) - [Español](https://weightsapi.com/es/llms.txt) - [简体中文](https://weightsapi.com/zh/llms.txt) - [Italiano](https://weightsapi.com/it/llms.txt) - [Português (Brasil)](https://weightsapi.com/pt/llms.txt) - [Nederlands](https://weightsapi.com/nl/llms.txt) - [Polski](https://weightsapi.com/pl/llms.txt) - [Русский](https://weightsapi.com/ru/llms.txt) - [Українська](https://weightsapi.com/uk/llms.txt) - [Türkçe](https://weightsapi.com/tr/llms.txt) - [العربية](https://weightsapi.com/ar/llms.txt) - [日本語](https://weightsapi.com/ja/llms.txt) - [한국어](https://weightsapi.com/ko/llms.txt)