Dolphin Mistral 24B Venice Edition : spécifications, histoire et où l'utiliser maintenant

Si vous avez vu Dolphin-mistral-24b-venice-edition sur Hugging Face ou Reddit et que vous souhaitez réellement lui parler, vous avez deux options de travail en 2026 : exécuter une copie quantifiée sur votre propre matériel ou utiliser son successeur hébergé en ligne. Voici le modèle, son histoire et les deux chemins.

Dolphin Mistral 24B Venice Edition est une mise au point non censurée du modèle 24B de Mistral, construit par l'équipe Dolphin (Cognitive Computations) pour Venice AI. Le slug API d'origine a été retiré ; son successeur direct, Venice Uncensored 1.2, est ce que Venice propose aujourd'hui – et vous pouvez discuter avec lui à Pinkerton AI sans créer de compte. Pour une utilisation locale, les quantifications GGUF de l'original restent disponibles sur Hugging Face et exécutées sous Ollama.

Last updated

Qu'est-ce que le Dolphin Mistral 24B Venice Edition ?

Une collaboration entre Cognitive Computations – l'équipe à l'origine de la série de mises au point non censurées Dolphin – et Venice AI, appliquée à la base 24B de Mistral. Les modèles Dolphin sont formés pour suivre absolument l'invite du système et pour répondre sans refus, ce qui a fait de l'édition Venice l'un des modèles non censurés les plus utilisés de sa génération : fort en écriture créative, en jeu de rôle et en réponses techniques brutales, suffisamment petit pour s'auto-héberger, sous licence permissive.

Pourquoi ne le trouvez-vous plus sur le API Venise ?

Venice retire les modèles de limaces en tant que versions plus récentes, et la limace Dolphin-mistral-24b-venice-edition a été supprimée de la liste des modèles d'api.venice.ai. Sa lignée se poursuit sous le nom de Venice Uncensored – actuellement version 1.2 – qui joue le même rôle que le réglage fin non censuré phare de la plate-forme, à fp16 avec une fenêtre contextuelle de 128 Ko. Si un tutoriel ou un fil de discussion Reddit vous pointe vers l'ancienne limace, Venice Uncensored 1.2 est ce à quoi il résout dans la pratique.

Comment l'utiliser en ligne sans compte

Pinkerton AI héberge Venice Uncensored 1.2 dans son sélecteur de modèles : ouvrez le chat, sélectionnez-le et parlez. Pas d'e-mail, pas d'inscription et pas de journaux de conversations côté serveur ; une session gratuite comprend suffisamment de crédits pour l'évaluer correctement. Il s'agit du chemin le plus rapide entre « avoir vu le modèle sur Hugging Face » et son utilisation réelle, et la politique de confidentialité (sessions anonymes, paiement crypté si vous effectuez une mise à niveau) correspond à ce qui attire les gens vers les modèles Dolphin en premier lieu.

Comment exécuter l'original localement

Les quantifications GGUF de Dolphin-mistral-24b-venice-edition sont publiées sur Hugging Face et chargées dans Ollama, LM Studio ou llama.cpp. Prévoyez environ 14 Go pour une quantification au quatrième trimestre et sensiblement plus pour le huitième ; un GPU de 24 Go offre une vitesse confortable et l'inférence uniquement sur le processeur fonctionne mais est lente. Le local gagne en confidentialité absolue (l'invite ne quitte jamais votre machine) au prix d'une perte de qualité de quantification et de matériel. C'est la bonne décision lorsque votre modèle de menace l'exige.

Est-ce vraiment non censuré ?

Oui, dans le sens spécifique de Dolphin : le réglage fin supprime les comportements de refus et s'en remet à l'invite de votre système, de sorte que les demandes légales mais sensibles (fiction sombre, jeu de rôle explicite entre adultes, détails de sécurité francs, opinions non couvertes) obtiennent des réponses directes. Il ne rend pas disponible le contenu illégal et l'accès hébergé sur Pinkerton AI applique la même ligne juridique quel que soit le modèle.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Version du modèleVenise non censurée 1.2 (successeur)GGUF 24B d'origine de Hugging Face
InstallationAucun – sélectionnez-le et discutezOllama / lama.cpp + ~ 14-50 Go de téléchargement
Précisionfp16, contexte 128KQuantisé (Q4-Q8), contexte pratique plus court
Matériel nécessaireAucun24 Go+ VRAM pour une vitesse confortable
CompteAucun — session anonymeAucun
ConfidentialitéZéro journal côté serveurEntièrement local – le plus fort possible

Qu'est-ce qui a remplacé le Dolphin Mistral 24B Venice Edition ?

Venice Uncensored 1.2 — la continuation de la même ligne phare non censurée sur l'infrastructure de Venise. Il est sélectionnable à Pinkerton AI sans compte.

Puis-je quand même télécharger Dolphin Mistral 24B Venice Edition ?

Oui — les quantifications GGUF restent sur Hugging Face (dphn/dolphin-mistral-24b-venice-edition et dépôts communautaires GGUF) et s'exécutent sous Ollama, LM Studio ou llama.cpp.

De quel matériel le Dolphin Mistral 24B a-t-il besoin localement ?

Environ 14 Go de mémoire pour un GGUF Q4, plus pour des quantifications plus élevées ; un GPU VRAM de 24 Go l’exécute confortablement. L'accès hébergé n'a besoin de rien.

Dolphin Mistral est-il bon pour le jeu de rôle ?

C'est l'un des modèles de référence pour cela - la formation Dolphin lui fait suivre les instructions du personnage et du scénario à partir de l'invite du système sans interrompre le personnage pour refuser.

Puis-je essayer la lignée Dolphin/Venice gratuitement en ligne ?

Oui : l'offre gratuite de Pinkerton AI comprend des crédits et ne nécessite aucun compte ; Venice Uncensored 1.2 coûte 3 crédits par message.

Related answers

Pinkerton AI · Blog