Outil gratuit · sans inscription

Calculateur de risque des modèles abliterés

Évaluez le risque d’un LLM sans refus (« abliteré ») avant qu’il n’entre dans votre environnement.

Ouvrir l’outil →

L’outil interactif s’ouvre en anglais.

Le Calculateur de risque des modèles abliterés évalue le risque de déployer un LLM sans refus (« abliteré » ou « sans censure ») dans un contexte précis. L’abliteration modifie les poids du modèle pour supprimer la direction interne qui produit les refus, de sorte que le modèle répond à tout, y compris aux demandes offensives. Le modèle seul n’est pas le risque ; la portée et la gouvernance le sont.

  1. Choisissez le type de modèle : avec sécurité, base ouverte, fine-tune, abliteré, ou abliteré avec fine-tune offensif.
  2. Décrivez la provenance, le code personnalisé, la portée, les données, les utilisateurs et la gouvernance.
  3. Lisez le score par bande et traitez les contrôles recommandés ; rien ne quitte votre navigateur.

Questions fréquentes

Qu’est-ce qu’un modèle abliteré ?

Un LLM à poids ouverts auquel on a retiré, en modifiant ses poids, la capacité de refuser des demandes. Il n’ajoute pas de connaissances ; il retire le frein.

Est-il légal de l’utiliser ?

Posséder ou exécuter le modèle n’est généralement pas illégal ; ce que vous en faites est régi par la loi, sa licence et votre politique d’usage acceptable. Les équipes de red team autorisées ont un usage légitime.

Quel est le principal facteur de risque ?

Connecter un modèle sans refus à un agent doté d’outils et d’identifiants, sans approbation ni journalisation.

Calculateur de risque des modèles abliterés · PlayCISO · PlayCISO