Dolphin Mistral 24B Venice Edition: especificaciones, historia y dónde usarlo ahora

Si has visto Dolphin-mistral-24b-venice-edition en Hugging Face o Reddit y realmente quieres hablar con él, tienes dos opciones de trabajo en 2026: ejecutar una copia cuantificada en tu propio hardware o usar su sucesor alojado en línea. Aquí está el modelo, su historia y ambos caminos.

Dolphin Mistral 24B Venice Edition es una puesta a punto sin censura del modelo 24B de Mistral, construido por el equipo Dolphin (Cognitive Computations) para Venice AI. La babosa API original ha sido retirada; su sucesor directo, Venice Uncensored 1.2, es lo que ofrece Venice hoy, y puedes chatear con él en Pinkerton AI sin crear una cuenta. Para uso local, las cuantificaciones GGUF del original permanecen disponibles en Hugging Face y se ejecutan bajo Ollama.

Last updated

¿Qué es el Dolphin Mistral 24B Edición Venecia?

Una colaboración entre Cognitive Computations, el equipo detrás de la serie Dolphin de ajustes finos sin censura, y Venice AI, aplicada a la base 24B de Mistral. Los modelos Dolphin están entrenados para seguir absolutamente las instrucciones del sistema y responder sin negarse, lo que convirtió a la Edición Venecia en uno de los modelos sin censura más utilizados de su generación: fuerte en escritura creativa, juegos de rol y respuestas técnicas contundentes, lo suficientemente pequeño como para autohospedarse, con licencia permisiva.

¿Por qué ya no puedes encontrarlo en Venecia API?

Venice retira los modelos slug a medida que se envían versiones más nuevas, y el slug Dolphin-mistral-24b-venice-edition se ha eliminado de la lista de modelos de api.venice.ai. Su linaje continúa como Venice Uncensored, actualmente versión 1.2, que cumple la misma función que el principal ajuste sin censura de la plataforma, en fp16 con una ventana de contexto de 128K. Si un tutorial o un hilo de Reddit te señala la vieja babosa, Venice Uncensored 1.2 es lo que resuelve en la práctica.

Cómo usarlo en línea sin una cuenta

Pinkerton AI aloja Venice Uncensored 1.2 en su selector de modelo: abre el chat, selecciónalo y habla. Sin correo electrónico, sin registro ni registros de conversaciones del lado del servidor; una sesión gratuita incluye créditos suficientes para evaluarla adecuadamente. Este es el camino más rápido desde 'vi el modelo en Hugging Face' hasta usarlo realmente, y la postura de privacidad (sesiones anónimas, pago criptográfico si actualiza) coincide con lo que atrae a las personas a los modelos Dolphin en primer lugar.

Cómo ejecutar el original localmente

Las cuantificaciones GGUF de Dolphin-mistral-24b-venice-edition se publican en Hugging Face y se cargan en Ollama, LM Studio o llama.cpp. Presuponga aproximadamente 14 GB para una cuantificación Q4 y mucho más para Q8; una GPU de 24 GB ofrece una velocidad cómoda y la inferencia solo de la CPU funciona pero es lenta. Lo local gana en privacidad absoluta (el mensaje nunca sale de su máquina) a costa de la pérdida de calidad de cuantificación y de hardware. Es la decisión correcta cuando su modelo de amenaza lo exige.

¿Está realmente sin censura?

Sí, en el sentido específico de Dolphin: el ajuste elimina el comportamiento de rechazo y difiere el aviso de su sistema, por lo que las solicitudes legales pero sensibles (ficción oscura, juegos de roles explícitos entre adultos, detalles de seguridad francos, opiniones sin cobertura) obtienen respuestas directas. No pone a disposición contenido ilegal y el acceso alojado en Pinkerton AI aplica la misma línea legal independientemente del modelo.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Versión del modeloVenecia sin censura 1.2 (sucesor)Original 24B GGUF de Hugging Face
ConfiguraciónNinguno: selecciónalo y chatea.Ollama / llama.cpp + ~14-50 GB de descarga
Precisiónfp16, contexto 128KCuantificado (Q4-Q8), contexto práctico más breve
Hardware necesarioNinguno24 GB+ VRAM para una velocidad cómoda
CuentaNinguno: sesión anónimaNinguno
PrivacidadCero registros del lado del servidorTotalmente local: lo más fuerte posible

¿Qué reemplazó al Dolphin Mistral 24B Venice Edition?

Venice Uncensored 1.2: la continuación de la misma línea insignia sin censura en la infraestructura de Venecia. Se puede seleccionar en Pinkerton AI sin cuenta.

¿Todavía puedo descargar el Dolphin Mistral 24B Venice Edition?

Sí, las cuantificaciones de GGUF permanecen en Hugging Face (dphn/dolphin-mistral-24b-venice-edition y repositorios comunitarios de GGUF) y se ejecutan en Ollama, LM Studio o llama.cpp.

¿Qué hardware necesita Dolphin Mistral 24B localmente?

Alrededor de 14 GB de memoria para un Q4 GGUF, más para cuantificaciones más altas; una GPU VRAM de 24 GB lo ejecuta cómodamente. El acceso alojado no necesita nada.

¿Dolphin Mistral es bueno para juegos de rol?

Es uno de los modelos de referencia: el entrenamiento Dolphin le permite seguir instrucciones de personajes y escenarios desde el indicador del sistema sin romper el personaje para negarse.

¿Puedo probar el linaje Dolphin/Venice gratis en línea?

Sí, el nivel gratuito de Pinkerton AI incluye créditos y no requiere cuenta; Venice Uncensored 1.2 cuesta 3 créditos por mensaje.

Related answers

Pinkerton AI · Blog