Dolphin Mistral 24B 威尼斯版:规格、故事以及现在使用地点

如果您在 Hugging Face 或 Reddit 上看到了 dolphin-mistral-24b-venice-edition,并且想实际与它交谈,那么 2026 年您有两个工作选择:在您自己的硬件上运行量化副本,或在线使用其托管的后继版本。这是模型、它的故事和两条路径。

Dolphin Mistral 24B Venice Edition 是 Mistral 24B 模型的未经审查的微调,由 Dolphin 团队(认知计算)为 Venice AI 构建。原来的 API slug 已退役;它的直接继承者,Venice Uncensored 1.2,是 Venice 今天提供的服务 - 您可以在 Pinkerton AI 上与它聊天,而无需创建帐户。对于本地使用,原始的 GGUF 量化在 Hugging Face 上仍然可用,并在 Ollama 下运行。

Last updated

什么是 Dolphin Mistral 24B 威尼斯版?

Cognitive Computations(海豚系列未经审查的微调背后的团队)与 Venice AI 之间的合作,应用于米斯特拉尔的 24B 基地。海豚模型经过训练,可以绝对遵循系统提示,并且不拒绝模板地回答,这使得威尼斯版成为这一代最常用的未经审查的模型之一:擅长创意写作、角色扮演和直率的技术答案,小到足以自我托管,获得许可。

为什么你在威尼斯API上找不到它了?

随着新版本的发布,Venice 退役了模型 slug,并且 dolphin-mistral-24b-venice-edition slug 已从 api.venice.ai 的模型列表中删除。它的血统延续为 Venice Uncensored(当前版本为 1.2),与该平台的旗舰未经审查微调具有相同的作用,fp16,具有 128K 上下文窗口。如果教程或 Reddit 帖子将您指向旧版本,那么 Venice Uncensored 1.2 就是它在实践中解决的问题。

没有账户如何在线使用

Pinkerton AI 在其模型选择器中托管 Venice Uncensored 1.2 — 打开聊天室,选择它并进行交谈。没有电子邮件,没有注册,也没有服务器端对话日志;免费课程包含足够的积分来正确评估它。这是从“在 Hugging Face 上看到模型”到实际使用它的最快路径,并且隐私状态(匿名会话、升级时的加密支付)与最初吸引人们使用 Dolphin 模型的因素相匹配。

如何在本地运行原版

dolphin-mistral-24b-venice-edition 的 GGUF 量化发布在 Hugging Face 上,并加载到 Ollama、LM Studio 或 llama.cpp 中。第 4 季度的量化预算大约为 14 GB,第 8 季度的量化预算则更多; 24 GB GPU 提供舒适的速度,仅 CPU 推理可以工作,但速度很慢。本地在绝对隐私方面获胜——提示永远不会离开你的机器——但代价是量化质量损失和硬件。当您的威胁模型需要时,这是正确的选择。

真的是未经审查的吗?

是的,在特定的海豚意义上:微调消除了拒绝行为并遵循您的系统提示,因此合法但敏感的请求 - 黑暗小说、成人之间明确的角色扮演、坦率的安全细节、不加限制的意见 - 得到直接答案。它不会提供非法内容,并且 Pinkerton AI 上的托管访问强制执行相同的法律界限,无论模型如何。

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
型号版本威尼斯未经审查 1.2(后继者)原始 24B GGUF 来自 Hugging Face
设置无 — 选择它并聊天Ollama / llama.cpp + ~14-50 GB 下载
精确fp16,128K 上下文量化(Q4-Q8),更短的实际背景
所需硬件没有任何24 GB+ VRAM 提供舒适的速度
帐户无 — 匿名会话没有任何
隐私服务器端日志为零完全本地化——最强可能

什么取代了 Dolphin Mistral 24B 威尼斯版?

威尼斯未经审查 1.2 — 威尼斯基础设施上相同未经审查旗舰线的延续。无需帐户即可在 Pinkerton AI 处选择。

我还可以下载 Dolphin Mistral 24B 威尼斯版吗?

是的 - GGUF 量化保持在 Hugging Face(dphn/dolphin-mistral-24b-venice-edition 和社区 GGUF 存储库)并在 Ollama、LM Studio 或 llama.cpp 下运行。

Dolphin Mistral 24B 本地需要什么硬件?

Q4 GGUF 需要大约 14 GB 内存,更高量化需要更多内存; 24 GB VRAM GPU 可以轻松运行。托管访问不需要任何东西。

海豚米斯特拉尔适合角色扮演吗?

它是它的参考模型之一——海豚训练使其遵循系统提示中的角色和场景指令,而不会破坏角色拒绝。

我可以在线免费试用海豚/威尼斯血统吗?

是 - Pinkerton AI 的免费套餐包含积分且无需帐户; Venice Uncensored 1.2 每条消息需要 3 个积分。

Related answers

Pinkerton AI · Blog