Dolphin Mistral 24B Venice Edition: Spezifikationen, Geschichte und wo man es jetzt verwenden kann

Wenn Sie Dolphin-Mistral-24b-Venice-Edition auf Hugging Face oder Reddit gesehen haben und tatsächlich mit ihm sprechen möchten, haben Sie im Jahr 2026 zwei Arbeitsmöglichkeiten: Führen Sie eine quantisierte Kopie auf Ihrer eigenen Hardware aus oder nutzen Sie den gehosteten Nachfolger online. Hier ist das Modell, seine Geschichte und beide Wege.

Dolphin Mistral 24B Venice Edition ist eine unzensierte Feinabstimmung des 24B-Modells von Mistral, das vom Dolphin-Team (Cognitive Computations) für Venice AI gebaut wurde. Der ursprüngliche Slug API wurde eingestellt; Sein direkter Nachfolger, Venice Uncensored 1.2, ist das, was Venice heute anbietet – und Sie können mit ihm unter Pinkerton AI chatten, ohne ein Konto zu erstellen. Für die lokale Verwendung bleiben GGUF-Quantisierungen des Originals auf Hugging Face verfügbar und werden unter Ollama ausgeführt.

Last updated

Was ist Dolphin Mistral 24B Venice Edition?

Eine Zusammenarbeit zwischen Cognitive Computations – dem Team hinter der Dolphin-Serie unzensierter Feinabstimmungen – und Venice AI, angewendet auf Mistrals 24B-Basis. Dolphin-Modelle sind darauf trainiert, den Systemaufforderungen absolut zu folgen und ohne Ablehnung zu antworten, was die Venice Edition zu einem der am häufigsten verwendeten unzensierten Modelle ihrer Generation gemacht hat: stark im kreativen Schreiben, im Rollenspiel und bei unverblümten technischen Antworten, klein genug, um sich selbst zu hosten, freizügig lizenziert.

Warum können Sie es nicht mehr auf der Venedig API finden?

Venice stellt Modellschnecken aus dem Verkehr, da neuere Versionen ausgeliefert werden, und die Delphin-Mistral-24b-Venice-Edition-Schnecke wurde aus der Modellliste von api.venice.ai entfernt. Seine Abstammung wird als Venice Uncensored – derzeit Version 1.2 – fortgesetzt, das die gleiche Rolle wie die unzensierte Flaggschiff-Feinabstimmung der Plattform bei fp16 mit einem 128K-Kontextfenster erfüllt. Wenn ein Tutorial oder ein Reddit-Thread Sie auf die alte Schnecke hinweist, ist Venice Uncensored 1.2 genau das Richtige für Sie.

So nutzen Sie es online ohne Konto

Pinkerton AI hostet Venice Uncensored 1.2 in seiner Modellauswahl – öffnen Sie den Chat, wählen Sie ihn aus und sprechen Sie. Keine E-Mail, keine Anmeldung und keine serverseitigen Konversationsprotokolle; Eine kostenlose Sitzung beinhaltet genügend Credits, um sie ordnungsgemäß bewerten zu können. Dies ist der schnellste Weg vom „Modell auf Hugging Face gesehen“ bis zur tatsächlichen Nutzung, und die Datenschutzlage – anonyme Sitzungen, Krypto-Zahlung bei einem Upgrade – entspricht dem, was Menschen überhaupt zu Dolphin-Modellen hinzieht.

So führen Sie das Original lokal aus

GGUF-Quantisierungen von Dolphin-Mistral-24b-Venice-Edition werden auf Hugging Face veröffentlicht und in Ollama, LM Studio oder llama.cpp geladen. Budgetieren Sie etwa 14 GB für eine Q4-Quantisierung und deutlich mehr für Q8; Eine 24-GB-GPU sorgt für eine angenehme Geschwindigkeit und die reine CPU-Inferenz funktioniert, ist aber langsam. Lokal gewinnt durch absolute Privatsphäre – die Eingabeaufforderung verlässt nie Ihren Computer – auf Kosten von Quantisierungsqualitätsverlusten und Hardware. Es ist der richtige Anruf, wenn Ihr Bedrohungsmodell es erfordert.

Ist es tatsächlich unzensiert?

Ja, im spezifischen Dolphin-Sinn: Die Feinabstimmung entfernt Ablehnungsverhalten und verschiebt sich auf die Eingabeaufforderung Ihres Systems, sodass legale, aber sensible Anfragen – düstere Fiktion, explizite Rollenspiele zwischen Erwachsenen, offene Sicherheitsdetails, ungesicherte Meinungen – direkte Antworten erhalten. Es stellt keine illegalen Inhalte zur Verfügung und der gehostete Zugriff auf Pinkerton AI setzt unabhängig vom Modell dieselben rechtlichen Grundsätze durch.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
ModellversionVenice Uncensored 1.2 (Nachfolger)Original 24B GGUF von Hugging Face
AufstellenKeine – wählen Sie es aus und chatten SieOllama / llama.cpp + ~14-50 GB Download
Präzisionfp16, 128K KontextQuantisiert (Q4-Q8), kürzerer praktischer Kontext
Hardware erforderlichKeiner24 GB+ VRAM für komfortable Geschwindigkeit
KontoKeine – anonyme SitzungKeiner
PrivatsphäreKeine serverseitigen ProtokolleVollständig lokal – so stark wie möglich

Was hat den Dolphin Mistral 24B Venice Edition ersetzt?

Venice Uncensored 1.2 – die Fortsetzung derselben unzensierten Flaggschifflinie auf der Infrastruktur Venedigs. Es kann bei Pinkerton AI ohne Konto ausgewählt werden.

Kann ich Dolphin Mistral 24B Venice Edition trotzdem herunterladen?

Ja – GGUF-Quantisierungen bleiben auf Hugging Face (dphn/dolphin-mistral-24b-venice-edition und Community-GGUF-Repos) und laufen unter Ollama, LM Studio oder llama.cpp.

Welche Hardware benötigt Dolphin Mistral 24B vor Ort?

Etwa 14 GB Speicher für einen Q4 GGUF, mehr für höhere Quantisierungen; Eine 24-GB-VRAM-GPU sorgt für den komfortablen Betrieb. Für den gehosteten Zugriff ist nichts erforderlich.

Eignet sich Dolphin Mistral für Rollenspiele?

Es ist eines der Referenzmodelle dafür – das Dolphin-Training ermöglicht es ihm, Persona- und Szenarioanweisungen aus der Systemaufforderung zu befolgen, ohne den Charakter zu verweigern.

Kann ich die Dolphin/Venice-Linie kostenlos online testen?

Ja – das kostenlose Kontingent von Pinkerton AI beinhaltet Credits und erfordert kein Konto; Venice Uncensored 1.2 kostet 3 Credits pro Nachricht.

Related answers

Pinkerton AI · Blog