Gemma Uncensored — Gemma 4 de Google, sans les refus

Gemma est la famille à pondération ouverte de Google : performante, efficace et réputée fortement alignée : les modèles d'instructions boursières refusent un large éventail d'invites juridiques. Les versions communautaires non censurées résolvent ce problème. Cette page couvre la version hébergée de Gemma 4 non censurée que vous pouvez utiliser dès maintenant et comment elle se compare au modèle standard.

Vous pouvez discuter en ligne avec une version non censurée du Gemma 4 de Google à Pinkerton AI : un modèle composé de 26 milliards d'experts (25,2 milliards au total, 3,8 milliards de paramètres actifs) avec comportement de refus supprimé, servi crypté de bout en bout dans un environnement d'exécution de confiance avec attestation matérielle. Aucun compte n'est requis, aucun journal côté serveur n'est conservé et cela coûte 3 crédits par message avec un niveau gratuit.

Last updated

Qu'est-ce que Gemma non censuré ?

Une version modifiée par la communauté de Gemma 4 de Google dans laquelle le comportement de refus entraîné a été supprimé, tandis que les connaissances et la qualité d'écriture du modèle restent intactes. Stock Gemma est l’un des modèles ouverts les plus conservateurs – il refuse ou moralise la fiction sombre, les opinions directes, les détails de sécurité et les thèmes les plus matures. La version non censurée répond directement à ces questions, dans le cadre de la loi. La variante hébergée ici est le mélange d'experts Gemma 4 : 25,2 B de paramètres totaux avec 3,8 B d'actifs par jeton, il fonctionne donc rapidement pour sa classe de qualité.

Ce qui rend cet hébergement atypique : E2EE en TEE

Le point de terminaison non censuré Gemma s'exécute dans un environnement d'exécution de confiance, une enclave matérielle cryptée dont l'intégrité peut être vérifiée par une attestation. Vos messages sont cryptés de bout en bout dans l'enclave, ce qui signifie que même l'opérateur du serveur ne peut pas lire l'échange en transit ou en mémoire. Combiné avec la conception sans compte et sans journaux de Pinkerton AI, c'est à peu près aussi privé que l'inférence hébergée l'est : rien de lisible côté serveur, rien de stocké, personne à qui l'attacher.

Comment se compare-t-il au Gemma 4 d'origine ?

Capacité de base identique – même architecture, mêmes connaissances. La différence est comportementale : là où le stock Gemma insère des refus, des avertissements de sécurité et un contrôle du ton sur les invites légales, la version non censurée répond simplement. Si vous avez utilisé Gemma localement et que vous avez apprécié sa vitesse et son écriture mais que vous vous êtes heurté à son mur de refus, il s'agit du même modèle avec le mur supprimé. Les contenus illégaux restent refusés ; la non-censure supprime le jugement éditorial, pas la loi.

Gemma en ligne non censurée ou exécutable vous-même

Les builds Gemma non censurés circulent sur Hugging Face et fonctionnent bien localement – ​​la conception MoE est suffisamment efficace pour un GPU de milieu de gamme au quatrième trimestre. Le local gagne en matière de confidentialité absolue ; l'hébergement gagne en termes d'installation (aucun), de vitesse (matériel du centre de données) et ici spécifiquement sur la garantie E2EE/TEE, que la plupart des configurations auto-hébergées ne reproduisent pas pour l'accès à distance. Si vous souhaitez simplement parler à Gemma sans refus dans les trente secondes suivantes, l'hébergement est la réponse pratique.

Commencer

Ouvrez le chat, choisissez « Gemma 4 26B A4B Uncensored » dans le sélecteur de modèle et démarrez – pas de compte, pas d'e-mail. Cela coûte 3 crédits par message ; une session gratuite comprend des crédits pour le tester par rapport aux versions par défaut de GLM Heretic et Venice Uncensored 1.2. Si le contexte 64K E2EE est limitant pour votre cas d'utilisation, les autres modèles non censurés ici proposent jusqu'à 200K sans l'enclave.

Pinkerton AI vs Stock Gemma 4: how do they compare?

FeaturePinkerton AIStock Gemma 4
Comportement de refusSupprimé – répond directement aux invites juridiquesRefus fréquents et couverture
ArchitectureGemma 4 MoE, 25,2 milliards au total / 3,8 milliards actifsMême architecture de base
HébergementE2EE dans un TEE, attestation matérielleOù que vous le déployiez
InstallationAucun – sélectionnez et discutez, pas de compteAuto-hébergement ou déploiement cloud
Fenêtre contextuelle64 Ko sur le point de terminaison E2EEJusqu'à 256 000 auto-hébergés
Coût3 crédits/message, niveau gratuitPoids libres + votre matériel

Existe-t-il une version non censurée de Gemma de Google ?

Oui – versions communautaires de Gemma 4 avec comportement de refus supprimé. Pinkerton AI héberge la version non censurée du MoE 26B, pouvant être discutée en ligne sans compte.

L'utilisation de Gemma non censurée est-elle gratuite ?

Une session gratuite avec crédits et sans inscription vous permet de le tester ; il coûte ensuite 3 crédits par message, avec des forfaits à partir de 17,99 €/mois.

Que garantit réellement l'hébergement E2EE/TEE ?

Les messages sont chiffrés de bout en bout dans un environnement d'exécution de confiance avec attestation matérielle : l'échange est illisible côté serveur, même par l'opérateur, et aucun journal de conversation n'est conservé.

Gemma non censurée est-elle aussi intelligente que Gemma d'origine ?

Oui, la modification supprime le comportement de refus, pas la capacité. Les connaissances et la qualité rédactionnelle sont celles de Gemma 4 26B MoE.

Puis-je exécuter Gemma localement sans censure ?

Oui, les versions Gemma non censurées sont sur Hugging Face et s'exécutent sous Ollama ou llama.cpp sur un GPU de milieu de gamme. L'accès hébergé ici est disponible lorsque vous le souhaitez instantanément, avec E2EE et à pleine vitesse de service.

Related answers

Pinkerton AI · Blog