Dolphin Mistral 24B Venice Edition: Thông số kỹ thuật, câu chuyện và nơi sử dụng ngay bây giờ

Nếu bạn đã xem Dolphin-mistral-24b-venice-edition trên Hugging Face hoặc Reddit và thực sự muốn nói chuyện với nó, thì bạn có hai lựa chọn làm việc vào năm 2026: chạy một bản sao lượng tử hóa trên phần cứng của riêng bạn hoặc sử dụng phiên bản kế thừa được lưu trữ trực tuyến của nó. Đây là mô hình, câu chuyện của nó và cả hai con đường.

Dolphin Mistral 24B Venice Edition là bản tinh chỉnh không kiểm duyệt của mô hình 24B của Mistral, được xây dựng bởi nhóm Dolphin (Tính toán nhận thức) cho Venice AI. Sên API ban đầu đã bị loại bỏ; phiên bản kế nhiệm trực tiếp của nó, Venice Uncensored 1.2, là phiên bản mà Venice phục vụ ngày nay — và bạn có thể trò chuyện với nó tại Pinkerton AI mà không cần tạo tài khoản. Để sử dụng cục bộ, lượng tử hóa GGUF của bản gốc vẫn có sẵn trên Hugging Face và chạy dưới Ollama.

Last updated

Phiên bản Dolphin Mistral 24B Venice là gì?

Sự hợp tác giữa Cognitive Computations — nhóm đằng sau chuỗi các giai điệu tinh chỉnh không bị kiểm duyệt của Dolphin — và Venice AI, được áp dụng cho cơ sở 24B của Mistral. Các mô hình cá heo được đào tạo để tuân theo lời nhắc của hệ thống một cách tuyệt đối và trả lời mà không từ chối bản tóm tắt, điều này đã khiến Phiên bản Venice trở thành một trong những mô hình không bị kiểm duyệt được sử dụng nhiều nhất trong thế hệ của nó: mạnh về khả năng viết sáng tạo, nhập vai và trả lời kỹ thuật thẳng thắn, đủ nhỏ để tự lưu trữ, được cấp phép cho phép.

Tại sao bạn không thể tìm thấy nó ở Venice API nữa?

Venice ngừng sử dụng sên mô hình khi xuất xưởng các phiên bản mới hơn và sên phiên bản cá heo-mistral-24b-venice đã bị xóa khỏi danh sách mô hình của api.venice.ai. Dòng dõi của nó tiếp tục là Venice Uncensored — hiện tại là phiên bản 1.2 — đóng vai trò tương tự như tính năng tinh chỉnh không kiểm duyệt hàng đầu của nền tảng, ở fp16 với cửa sổ ngữ cảnh 128K. Nếu một hướng dẫn hoặc chủ đề Reddit chỉ cho bạn lỗi cũ, thì Venice Uncensored 1.2 chính là điều mà nó giải quyết trong thực tế.

Cách sử dụng trực tuyến mà không cần tài khoản

Pinkerton AI lưu trữ Venice Uncensored 1.2 trong bộ chọn mô hình của nó - mở cuộc trò chuyện, chọn cuộc trò chuyện và nói chuyện. Không có email, không đăng ký và không có nhật ký hội thoại phía máy chủ; một phiên miễn phí bao gồm đủ tín chỉ để đánh giá nó một cách chính xác. Đây là con đường nhanh nhất từ ​​'thấy mô hình trên Hugging Face' đến thực sự sử dụng mô hình đó và chế độ bảo mật — phiên ẩn danh, thanh toán bằng tiền điện tử nếu bạn nâng cấp — phù hợp với những gì thu hút mọi người đến với mô hình Dolphin ngay từ đầu.

Cách chạy bản gốc cục bộ

Các phép lượng tử hóa GGUF của phiên bản cá heo-mistral-24b-venice được xuất bản trên Hugging Face và tải trong Ollama, LM Studio hoặc llama.cpp. Ngân sách khoảng 14 GB cho lượng tử hóa Q4 và nhiều hơn về mặt vật chất cho Q8; GPU 24 GB cho tốc độ thoải mái và khả năng suy luận chỉ của CPU hoạt động nhưng chậm. Lợi ích cục bộ về quyền riêng tư tuyệt đối — lời nhắc không bao giờ rời khỏi máy của bạn — phải trả giá bằng việc giảm chất lượng lượng tử hóa và phần cứng. Đó là quyết định đúng đắn khi mô hình mối đe dọa của bạn yêu cầu điều đó.

Nó thực sự không được kiểm duyệt?

Có, theo nghĩa riêng của Dolphin: tính năng tinh chỉnh sẽ loại bỏ hành vi từ chối và tuân theo lời nhắc của hệ thống, do đó, các yêu cầu hợp pháp nhưng nhạy cảm — hư cấu đen tối, nhập vai rõ ràng giữa những người lớn, chi tiết bảo mật thẳng thắn, ý kiến ​​không được bảo vệ — sẽ nhận được câu trả lời trực tiếp. Nó không cung cấp nội dung bất hợp pháp và quyền truy cập được lưu trữ trên Pinkerton AI thực thi cùng một dòng pháp lý bất kể mô hình.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Phiên bản mẫuVenice Không Kiểm Duyệt 1.2 (kế thừa)24B GGUF gốc từ Hugging Face
Cài đặtKhông có - chọn nó và trò chuyệnOllama / llama.cpp + ~14-50 GB tải xuống
Độ chính xácbối cảnh fp16, 128KLượng tử hóa (Q4-Q8), bối cảnh thực tế ngắn hơn
Phần cứng cần thiếtKhông có24 GB+ VRAM cho tốc độ thoải mái
Tài khoảnKhông có - phiên ẩn danhKhông có
Sự riêng tưKhông có nhật ký phía máy chủHoàn toàn cục bộ - mạnh nhất có thể

Điều gì đã thay thế Dolphin Mistral 24B Venice Edition?

Venice Uncensored 1.2 — sự tiếp nối của dòng hàng đầu không bị kiểm duyệt tương tự trên cơ sở hạ tầng của Venice. Có thể chọn ở mức Pinkerton AI mà không cần tài khoản.

Tôi vẫn có thể tải xuống Dolphin Mistral 24B Venice Edition chứ?

Có — Lượng tử hóa GGUF vẫn duy trì trên Hugging Face (dphn/dolphin-mistral-24b-venice-edition và kho lưu trữ GGUF cộng đồng) và chạy trong Ollama, LM Studio hoặc llama.cpp.

Dolphin Mistral 24B cần phần cứng gì tại địa phương?

Khoảng 14 GB bộ nhớ cho Q4 GGUF, nhiều hơn cho lượng tử hóa cao hơn; GPU VRAM 24 GB chạy thoải mái. Truy cập được lưu trữ không cần gì cả.

Dolphin Mistral có phù hợp để nhập vai không?

Đây là một trong những mô hình tham khảo cho nó - quá trình đào tạo Dolphin khiến nó tuân theo các hướng dẫn về tính cách và kịch bản từ lời nhắc của hệ thống mà không phá vỡ ký tự để từ chối.

Tôi có thể dùng thử dòng Dolphin/Venice trực tuyến miễn phí không?

Có — Cấp miễn phí của Pinkerton AI bao gồm các khoản tín dụng và không yêu cầu tài khoản; Venice Uncensored 1.2 tốn 3 tín chỉ cho mỗi tin nhắn.

Related answers

Pinkerton AI · Blog