Dolphin Mistral 24B Venice Edition: especificações, história e onde usá-lo agora

Se você viu o dolphin-mistral-24b-venice-edition no Hugging Face ou no Reddit e deseja realmente conversar com ele, você tem duas opções de trabalho em 2026: executar uma cópia quantizada em seu próprio hardware ou usar seu sucessor hospedado online. Aqui está o modelo, sua história e ambos os caminhos.

Dolphin Mistral 24B Venice Edition é um ajuste fino sem censura do modelo 24B do Mistral, construído pela equipe Dolphin (Cognitive Computations) para Venice AI. O slug API original foi retirado; seu sucessor direto, Venice Uncensored 1.2, é o que Venice serve hoje – e você pode conversar com ele em Pinkerton AI sem criar uma conta. Para uso local, as quantizações GGUF do original permanecem disponíveis em Hugging Face e são executadas no Ollama.

Last updated

O que é o Dolphin Mistral 24B Venice Edition?

Uma colaboração entre a Cognitive Computations – a equipe por trás da série Dolphin de ajustes finos sem censura – e Venice AI, aplicada à base 24B do Mistral. Os modelos Dolphin são treinados para seguir absolutamente as instruções do sistema e responder sem recusa ao padrão, o que tornou a Venice Edition um dos modelos sem censura mais usados ​​de sua geração: forte em escrita criativa, dramatização e respostas técnicas contundentes, pequeno o suficiente para auto-hospedar, licenciado permissivamente.

Por que você não consegue mais encontrá-lo em Veneza API?

Venice retira slugs de modelo à medida que versões mais recentes são enviadas, e o slug dolphin-mistral-24b-venice-edition foi removido da lista de modelos de api.venice.ai. Sua linhagem continua como Venice Uncensored – atualmente versão 1.2 – que desempenha a mesma função do ajuste fino sem censura carro-chefe da plataforma, em fp16 com uma janela de contexto de 128K. Se um tutorial ou tópico do Reddit apontar para o slug antigo, Venice Uncensored 1.2 é o que ele resolve na prática.

Como usá-lo online sem uma conta

Pinkerton AI hospeda Venice Uncensored 1.2 em seu seletor de modelos — abra o chat, selecione-o e fale. Sem e-mail, sem inscrição e sem registros de conversas no servidor; uma sessão gratuita inclui créditos suficientes para avaliá-la adequadamente. Este é o caminho mais rápido desde 'vi o modelo em Hugging Face' até realmente usá-lo, e a postura de privacidade – sessões anônimas, pagamento criptografado se você atualizar – corresponde ao que atrai as pessoas para os modelos Dolphin em primeiro lugar.

Como executar o original localmente

As quantizações GGUF de dolphin-mistral-24b-venice-edition são publicadas em Hugging Face e carregadas em Ollama, LM Studio ou llama.cpp. Orçamento de aproximadamente 14 GB para uma quantização do 4º trimestre e materialmente mais para o 8º trimestre; uma GPU de 24 GB oferece velocidade confortável e a inferência somente da CPU funciona, mas é lenta. O local ganha em privacidade absoluta — o prompt nunca sai da sua máquina — ao custo da perda de qualidade de quantização e de hardware. É a decisão certa quando o seu modelo de ameaça assim o exige.

É realmente sem censura?

Sim, no sentido específico do Dolphin: o ajuste fino remove o comportamento de recusa e adia o prompt do sistema, de modo que solicitações legais, mas sensíveis – ficção sombria, dramatização explícita entre adultos, detalhes de segurança francos, opiniões não protegidas – obtenham respostas diretas. Não disponibiliza conteúdo ilegal e o acesso hospedado em Pinkerton AI impõe a mesma linha legal, independentemente do modelo.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Versão do modeloVeneza sem censura 1.2 (sucessor)24B GGUF original de Hugging Face
ConfigurarNenhum – selecione-o e converseOllama / llama.cpp + download de aproximadamente 14-50 GB
Precisãofp16, contexto de 128KQuantizado (Q4-Q8), contexto prático mais curto
Hardware necessárioNenhum24 GB+ VRAM para velocidade confortável
ContaNenhum – sessão anônimaNenhum
PrivacidadeZero logs do lado do servidorTotalmente local – mais forte possível

O que substituiu o Dolphin Mistral 24B Venice Edition?

Venice Uncensored 1.2 — a continuação da mesma linha emblemática sem censura na infraestrutura de Veneza. É selecionável em Pinkerton AI sem conta.

Ainda posso baixar o Dolphin Mistral 24B Venice Edition?

Sim — as quantizações de GGUF permanecem em Hugging Face (dphn/dolphin-mistral-24b-venice-edition e repositórios GGUF da comunidade) e são executadas em Ollama, LM Studio ou llama.cpp.

De que hardware o Dolphin Mistral 24B precisa localmente?

Cerca de 14 GB de memória para um Q4 GGUF, mais para quantizações mais altas; uma GPU VRAM de 24 GB funciona confortavelmente. O acesso hospedado não precisa de nada.

O Dolphin Mistral é bom para RPG?

É um dos modelos de referência para isso – o treinamento do Dolphin faz com que ele siga as instruções da pessoa e do cenário do prompt do sistema sem quebrar o caráter para recusar.

Posso experimentar a linhagem Dolphin/Veneza online gratuitamente?

Sim — o nível gratuito de Pinkerton AI inclui créditos e não requer conta; Venice Uncensored 1.2 custa 3 créditos por mensagem.

Related answers

Pinkerton AI · Blog