Skip to content
Outil d'IA

Heretic Review

Heretic est un outil en ligne de commande open-source qui supprime automatiquement les filtres de sécurité et les comportements de refus des modèles de langage d'IA à poids ouverts avec un effort humain minimal.

shipped 27 août 2026freemium
Heretic - AI tool for heretic. Professional illustration showing core functionality and features.

Pourquoi c'est important

1Outil en ligne de commande open-source pour les modèles de langage d'IA.
2Supprime automatiquement les filtres de sécurité et les comportements de refus.
3Prend en charge les adaptateurs LoRA et la quantification 4 bits depuis la v1.2.0 (février 2026).
4Système de benchmarking intégré (MMLU, EQ-Bench, GSM8K, HellaSwag) introduit dans la v1.3 (mai 2026).

overview

Qu'est-ce que Heretic ?

Heretic est un outil d'IA développé par Philipp Emanuel Weidmann qui permet aux utilisateurs de supprimer automatiquement la censure de sécurité et les comportements de refus des grands modèles de langage (LLM) basés sur des transformeurs. Il y parvient grâce à une implémentation avancée de l'ablation directionnelle combinée à un optimiseur Tree-structured Parzen Estimator (TPE) alimenté par Optuna, modifiant les poids internes du modèle pour éliminer les tendances à refuser certaines invites.

features

Fonctionnalités clés de Heretic

Heretic offre une suite de fonctionnalités conçues pour modifier et analyser les modèles de langage d'IA à poids ouverts, en se concentrant sur la suppression des alignements de sécurité et des comportements de refus.

  • Suppression automatisée des filtres de sécurité des modèles de langage d'IA.
  • Élimination des comportements de refus des modèles de langage d'IA.
  • Compatibilité avec les modèles de langage d'IA à poids ouverts.
  • Interface en ligne de commande pour une interaction directe.
  • Disponibilité open-source pour l'inspection et la modification par la communauté.
  • Prise en charge des adaptateurs LoRA et de la quantification 4 bits (v1.2.0, février 2026).
  • Exécutions reproductibles sur différents environnements matériels et logiciels (v1.3, mai 2026).
  • Système de benchmarking intégré utilisant lm-evaluation-harness (v1.3, mai 2026).
  • Utilisation réduite de la VRAM de pointe pour le traitement de modèles plus grands (v1.3, mai 2026).
  • Large prise en charge des modèles, y compris Qwen3.5, Gemma 4 et IBM Granite MoE (v1.3, mai 2026).

use cases

Qui devrait utiliser Heretic ?

Heretic est principalement conçu pour les individus et les organisations nécessitant un contrôle précis sur le comportement des modèles d'IA, en particulier en ce qui concerne les alignements de sécurité et la génération de contenu.

  • Personnalisation du modèle : Utilisateurs recherchant des modèles entièrement réactifs sans restrictions de sécurité pour des applications ou des préférences spécifiques.
  • Recherche et interprétabilité du modèle : Chercheurs explorant la sémantique interne du modèle, visualisant les transformations de vecteurs résiduels et comprenant les mécanismes d'alignement de sécurité.
  • Optimisation des performances : Développeurs visant à équilibrer la suppression de la censure avec la préservation de l'intelligence et de la qualité originales d'un modèle.
  • Apprentissage éducatif : Étudiants et praticiens intéressés par les applications pratiques de l'alignement de sécurité des modèles de langage et des techniques d'ablation.

how to use

Comment utiliser Heretic

Heretic est installé en tant qu'outil de ligne de commande Python, permettant aux utilisateurs de modifier les poids des LLM pour supprimer les directions de refus avec un effort humain minimal.

  • 1Installez Heretic via pip ou clonez le dépôt GitHub.
  • 2Identifiez un modèle de langage d'IA à poids ouverts cible pour la modification.
  • 3Exécutez Heretic depuis la ligne de commande, en spécifiant le modèle et les paramètres d'ablation souhaités.
  • 4Utilisez le système de benchmarking intégré pour évaluer les performances du modèle modifié.
  • 5Déployez le modèle 'décensuré' pour des applications personnalisées ou des recherches supplémentaires.

pricing

Tarifs et plans Heretic

Heretic fonctionne sur un modèle freemium. L'outil de ligne de commande principal est open-source et gratuit, permettant aux utilisateurs de l'installer et de l'exécuter sans frais. Bien que l'outil lui-même soit gratuit, la désignation 'freemium' suggère de futures options ou services premium potentiels, bien qu'aucun ne soit explicitement détaillé selon les informations actuelles.

  • Freemium : Gratuit avec des options premium (détails non spécifiés)

Pros

  • +Automated removal of safety filters and refusal behaviors from LLMs.
  • +Preserves original model intelligence with low KL divergence (e.g., 0.16).
  • +Open-source and accessible via pip install for local use.
  • +Offers an on-demand decensoring service for various model sizes without local GPU.
  • +Outperforms manual ablation and some other abliteration tools in benchmarks.
  • +Provides a training-free alternative to expensive fine-tuning for decensoring.

Cons

  • Requires Python 3.10 or later for local installation.
  • On-demand service tiers are limited by access token and wallet balance.
  • Primarily a command-line tool, lacking a graphical user interface.
  • Focuses specifically on filter removal, not general model deployment or interaction.
  • Raises ethical concerns among policymakers regarding uncensored AI capabilities.

Outils similaires

Heretic vs Concurrents

Heretic se distingue en automatisant le processus complexe d'ablation directionnelle, une tâche qui nécessitait auparavant un effort manuel important et une expertise spécialisée.

1

Provides a C/C++ implementation for running LLaMA and other open-weight models locally on consumer hardware, primarily via command-line.

Heretic aims to automatically remove filters from existing models. llama.cpp provides the raw, unfiltered access to the model's core inference, allowing users to implement their own prompting strategies or use models that inherently lack strong safety filters. It requires more manual effort in crafting prompts compared to Heretic's automated approach.

2

A comprehensive, script-based web UI for running and interacting with various open-weight LLMs locally, offering extensive control over generation parameters and prompt engineering.

While it primarily presents a web UI, it is launched and managed via command-line scripts, giving users deep control over model behavior and allowing for advanced prompt engineering to bypass model guardrails. Heretic is purely CLI and focuses on automated filter removal, whereas this tool provides a flexible environment for manual experimentation and control.

3
KoboldCpp

A user-friendly, locally runnable inference server for `llama.cpp` compatible models, offering both a web UI and a CLI mode for direct interaction and fine-tuning of generation parameters.

Like Heretic, KoboldCpp allows for local interaction with open-weight models. It provides a more integrated experience for running models and offers a CLI mode for direct control, which can be used to craft prompts and settings that bypass typical safety mechanisms, though it doesn't automate filter removal in the same way Heretic does.

4
MLC LLM

A universal deployment framework that allows users to compile and run LLMs locally on various hardware platforms, providing fine-grained control over model execution via its command-line interface.

MLC LLM focuses on the deployment and execution of LLMs, giving users direct control over the model's runtime environment and parameters through its CLI. This allows for interaction with models without higher-level safety wrappers, similar to Heretic's goal, but requires more technical setup for model compilation and deployment rather than just automated filter removal.

Plus sur Stork

Outils IA connexes

Autres outils de cette catégorie, rapprochés par tags communs

Featured in articles