DE ▾

OpenAI-API für LLM-Modelle ohne Anbieterbindung

API-Schlüssel erhalten
Basis-URL
https://api.apiiasemcensura.com/v1
Modell
unzensiert

Kompletter Leitfaden: KI ohne Einschränkungen in deine Anwendung integrieren

Eine KI ohne Einschränkungen entfernt die künstlichen Sicherheitsbarrieren, die Kreativität und Tiefe der Antworten begrenzen, und ermöglicht es LLM-Modellen, erwachsene Inhalte zu generieren, kontroverse Nuancen zu erkunden und komplexe Rollenspiele ohne vorzeitige Ablehnungen durchzuführen. Dieser technische Leitfaden erklärt, wie du eine OpenAI-kompatible API integrierst, die dieses konsistente Verhalten bietet, mit Fokus auf praktische Implementierung und Management technischer Grenzen.

Aktualisiert

Hauptpunkte

  1. Das 'unzensierte' Modell ist offen, läuft auf eigenen Servern und ignoriert Ablehnungen von rechtmäßigem Erwachseneninhalten, außer bei Minderjährigen.
  2. Die API folgt dem OpenAI-Standard und erfordert nur die Änderung der base_url und des Authentifizierungstokens für eine sofortige Integration.
  3. Der Kontext von 100.000 Token ermöglicht lange Gespräche, erfordert aber aktives Management, um Trunkierung oder übermäßige Kosten zu vermeiden.
  4. Der Preis ist transparent ($0,25/1M Input-Token und $1,00/1M Output-Token) mit Prepaid-Guthaben, das nie verfällt.

Warum eine KI ohne Einschränkungen nutzen?

Viele Standard-LLMs sind mit einem Sicherheitsbias trainiert, der sie dazu bringt, erwachsene, sexuelle oder politisch sensible Themen abzulehnen, auch wenn diese für den beabsichtigten Einsatz völlig geeignet sind. Eine unzensierte KI entfernt diesen willkürlichen Filter und ermöglicht es dem Modell, auf Basis des Open-Weight-Trainings zu antworten, wobei der Fokus auf der Treue zum User-Prompt liegt und nicht auf einer proprietären Moderationsschicht.

Dies ist entscheidend für immersive Rollenspielanwendungen, bei denen die Figur mutigere Persönlichkeitsmerkmale aufweisen kann, oder für die Generierung von Erwachsenentext, bei dem das Modell keine narrativen Schritte überspringen sollte, um die Antwort zu 'bereinigen'. Im Gegensatz zu generischen Plattformen, die aggressive Filter anwenden, ist unser Modell speziell darauf abgestimmt, auf alles zu antworten, was rechtmäßig ist, und behält die Kontextkonsistenz bei, ohne häufige Unterbrechungen durch 'unangemessene Inhalte'.

Vorteile der OpenAI-kompatiblen API

Der größte technische Vorteil einer API, die dem OpenAI-Standard folgt, ist die Portabilität. Du musst keine neue Anfrage-Syntax lernen oder einen eigenen Client schreiben. Lege einfach die base_url auf https://api.apiiasemcensura.com/v1 und ersetze deinen API-Schlüssel. So kannst du die offiziellen Bibliotheken (SDKs) für Python, Node.js und andere Sprachen nutzen.

  • Sofortige Integration: Bestehender Code, der openai nutzt, funktioniert mit minimalen Konfigurationsanpassungen.
  • Standardisierung: Der Endpunkt /v1/chat/completions ist der Industriestandard und gewährleistet die Kompatibilität mit Drittanbieter-Tools, die OpenAI-kompatible APIs unterstützen.
  • Einfachheit: Kein komplexes Routing zwischen mehreren Modellen. Du hast direkten Zugriff auf das unzensierte Modell, das auf unseren dedizierten GPU-Servern gehostet wird.

Initiale Konfiguration des API-Schlüssels

Die initiale Konfiguration ist schnell und reibungslos gestaltet. Du erstellst ein Konto, indem du nur eine E-Mail und ein Passwort angibst. Es ist keine Kreditkarte erforderlich, um das Testguthaben zu erhalten, und der API-Schlüssel wird sofort nach der Registrierung angezeigt.

Um zu beginnen, musst du deinen Schlüssel auf der Seite zur Kontoeinrichtung erhalten. Denke daran, dass jedes Konto nur einen aktiven Schlüssel hat. Falls nötig, kannst du ihn jederzeit neu generieren, wodurch der vorherige Schlüssel sofort ungültig wird. Dieser Schlüssel muss in allen Anfragen im Header Authorization: Bearer YOUR_API_KEY gesendet werden.

Implementierung des Chat Completions Endpunkts

Der Kern unserer API ist der Endpunkt POST /v1/chat/completions. Er akzeptiert eine Liste von Nachrichten (System, User, Assistant) und gibt eine vollständige Textantwort zurück. Um das unzensierte Modell zu nutzen, musst du das model auf uncensored setzen.

from openai import OpenAI

client = OpenAI(base_url="https://api.apiiasemcensura.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Aktivierung des Streamings für schnelle Antworten

Für Anwendungen mit geringer Latenz, wie Echtzeit-Chatbots, ist das Streaming über Server-Sent Events (SSE) unerlässlich. Durch das Setzen von stream: true sendet der Server Token-Chunks, sobald sie generiert werden, sodass der Client sie sofort anzeigen kann, ohne auf das Ende der Berechnung warten zu müssen.

Dies verbessert die Benutzererfahrung erheblich, insbesondere für lange Antworten. Das 'unzensierte' Modell unterstützt diese Funktion nativ über denselben Chat-Completions-Endpunkt.

Nutzung von Tool Calling für erweiterte Funktionen

Neben der Textgenerierung unterstützt die API das Function Calling. Dies ermöglicht es dem Modell, externe Aktionen auszuführen, wie das Abrufen von Daten oder das Durchführen von Berechnungen, indem Schemata im Feld tools der Anfrage definiert werden.

Das Modell erkennt, wann ein Tool verwendet werden soll, und gibt eine Antwort vom Typ tool_calls anstelle von reinem Text zurück. Du führst dann die Funktion in deinem Backend aus und sendest das Ergebnis an die API zurück, damit das Modell eine finale Antwort basierend auf dem Ergebnis generieren kann. Dies ist leistungsstark für die Erstellung autonomer Agenten, die ohne die typischen Tool-Einschränkungen geschlossener Modelle arbeiten.

Verwaltung des 100k-Token-Kontexts

Unsere API unterstützt ein Kontextfenster von 100.000 Token, das Prompt und Completion kombiniert. So kannst du große Mengen an Gesprächsverlauf oder Referenzdokumente laden. Der Kontext ist jedoch begrenzt.

Du musst die Gesprächsgröße aktiv verwalten. Wenn der Verlauf das Limit überschreitet, kann die API ältere Nachrichten kürzen oder die Anfrage ablehnen, wenn der Body 8 MB überschreitet. Es gibt keine feste Regel der API, ob am Anfang oder Ende gekürzt wird; die Verantwortung für das Management des Kontextfensters (z. B. durch Entfernen alter Nachrichten oder Zusammenfassen früherer Gespräche) liegt beim Entwickler.

Überwachung der Nutzung und Limits

Um die Stabilität des Dienstes zu gewährleisten, gibt es klare Nutzungsgrenzen. Jeder API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Der Anfrage-Body darf 8 MB nicht überschreiten.

Wenn du das Ratenlimit überschreitest, erhältst du den HTTP-Fehler 429 (Too Many Requests). Es ist wichtig, Retries mit exponentiellem Backoff in deinem Code zu implementieren. Da es kein monatliches Abonnement gibt, wird der Verbrauch nach verarbeiteten Token gemessen. Du kannst dein Guthaben auf der Kontoseite überwachen, wo das Prepaid-Guthaben nie verfällt.

Fazit und nächste Schritte

Die Integration einer unzensierten KI über eine OpenAI-kompatible API bietet die ideale Balance zwischen vollständiger Kontrolle über den generierten Inhalt und einfacher technischer Implementierung. Durch die Nutzung des unzensierten Modells stellst du sicher, dass deine Roleplay-, Adult-Text- oder Forschungsanwendungen nicht durch künstliche Filter unterbrochen werden.

Um zu beginnen, rufe unsere Plattform auf, erstelle ein Konto und erhalte deinen API-Schlüssel. Teste das Modell mit deinem kostenlosen Testguthaben von $0,50 und füge bei Bedarf Credits hinzu, um den Dienst weiterhin zu nutzen. Mit klarer technischer Dokumentation und transparentem Preis ist die Integration direkt und effizient.

Häufig gestellte Fragen

Was bedeutet „unzensiert“ bei diesem Modell genau?

Das bedeutet, dass das Modell keine aggressiven Inhaltsfilter hat, die erwachsene, sexuelle oder kontroverse Themen blockieren, solange sie rechtmäßig sind. Es beantwortet den Prompt des Nutzers ohne Ablehnungen aufgrund von „Empfindlichkeit“, was mehr kreative Freiheit und Kontexttreue ermöglicht. Die einzige strenge und universelle Grenze ist der Inhalt sexueller Handlungen mit Minderjährigen, der immer blockiert wird.

Wie sind die Preise und wie funktioniert die Bezahlung?

Das Modell kostet $0,25 pro 1 Million Input-Token und $1,00 pro 1 Million Output-Token. Es gibt keine monatlichen Abonnements oder Nutzungsgebühren. Du zahlst mit Prepaid-Guthaben, das verfällt nie. Das Minimum für eine Aufladung beträgt $10, und Guthaben-Boni werden bei größeren Aufladungen gewährt (+5% ab $50, +10% ab $100).

Kann ich dieses Modell zur Bild- oder Audioerzeugung nutzen?

Nein. Diese API bietet ausschließlich das Language Model (LLM) für Text. Es gibt keine Unterstützung für Embeddings, Bild-, Audio- oder Videoerzeugung. Der Haupt-Endpunkt ist /v1/chat/completions, der sich rein auf die Textinteraktion konzentriert.

Werden meine Prompt-Daten zum Trainieren des Modells verwendet?

Nein. Die Privatsphäre ist gewährleistet: Deine Prompts und Antworten werden nicht zur Trainings des Modells verwendet. Das Modell ist ein Open-Weight-Modell, das auf unseren Servern läuft, und die Nutzung dient ausschließlich der Bearbeitung deiner spezifischen Anfrage.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel und ändere die Basis-URL. Das ist die gesamte Konfiguration.

API-Schlüssel erhalten