Skip to content
AI Инструмент

Heretic Review

Heretic — это инструмент командной строки с открытым исходным кодом, который автоматически удаляет фильтры безопасности и "поведения отказа" из "открытых" языковых моделей ИИ с минимальными усилиями человека.

shipped 27 авг. 2026 г.freemium
Heretic - AI tool for heretic. Professional illustration showing core functionality and features.

Почему это важно

1Инструмент командной строки с открытым исходным кодом для языковых моделей ИИ.
2Автоматически удаляет фильтры безопасности и "поведения отказа".
3Поддерживает адаптеры LoRA и 4-битную квантизацию с версии 1.2.0 (февраль 2026 г.).
4Интегрированная система бенчмаркинга (MMLU, EQ-Bench, GSM8K, HellaSwag) представлена в версии 1.3 (май 2026 г.).

overview

Что такое Heretic?

Heretic — это инструмент ИИ, разработанный Филиппом Эмануэлем Вайдманном, который позволяет пользователям автоматически удалять цензуру безопасности и "поведения отказа" из больших языковых моделей (LLM) на основе трансформеров. Это достигается за счет продвинутой реализации направленной абляции в сочетании с оптимизатором Tree-structured Parzen Estimator (TPE) на базе Optuna, изменяя внутренние веса модели для устранения тенденций к отказу от определенных запросов.

features

Ключевые особенности Heretic

Heretic предоставляет набор функций, предназначенных для модификации и анализа "открытых" языковых моделей ИИ, с акцентом на удаление "выравниваний безопасности" и "поведений отказа".

  • Автоматическое удаление фильтров безопасности из языковых моделей ИИ.
  • Устранение "поведений отказа" из языковых моделей ИИ.
  • Совместимость с "открытыми" языковыми моделями ИИ.
  • Интерфейс командной строки для прямого взаимодействия.
  • Доступность с открытым исходным кодом для проверки и модификации сообществом.
  • Поддержка адаптеров LoRA и 4-битной квантизации (v1.2.0, февраль 2026 г.).
  • Воспроизводимые запуски в различных аппаратных и программных средах (v1.3, май 2026 г.).
  • Интегрированная система бенчмаркинга с использованием lm-evaluation-harness (v1.3, май 2026 г.).
  • Сниженное пиковое использование VRAM для обработки более крупных моделей (v1.3, май 2026 г.).
  • Широкая поддержка моделей, включая Qwen3.5, Gemma 4 и IBM Granite MoE (v1.3, май 2026 г.).

use cases

Кому следует использовать Heretic?

Heretic в первую очередь предназначен для частных лиц и организаций, которым требуется точный контроль над поведением моделей ИИ, особенно в отношении "выравниваний безопасности" и генерации контента.

  • Настройка модели: Пользователи, которым нужны полностью отзывчивые модели без ограничений безопасности для конкретных приложений или предпочтений.
  • Исследования и интерпретируемость моделей: Исследователи, изучающие внутреннюю семантику моделей, визуализирующие преобразования остаточных векторов и понимающие механизмы "выравнивания безопасности".
  • Оптимизация производительности: Разработчики, стремящиеся сбалансировать удаление цензуры с сохранением первоначального интеллекта и качества модели.
  • Образовательное обучение: Студенты и практики, интересующиеся практическим применением "выравнивания безопасности" языковых моделей и методов абляции.

how to use

Как использовать Heretic

Heretic устанавливается как инструмент командной строки Python, позволяя пользователям изменять веса LLM для удаления "направлений отказа" с минимальными усилиями человека.

  • 1Установите Heretic через pip или клонируйте репозиторий GitHub.
  • 2Определите целевую "открытую" языковую модель ИИ для модификации.
  • 3Запустите Heretic из командной строки, указав модель и желаемые параметры абляции.
  • 4Используйте интегрированную систему бенчмаркинга для оценки производительности модифицированной модели.
  • 5Разверните "децензурированную" модель для пользовательских приложений или дальнейших исследований.

pricing

Цены и планы Heretic

Heretic работает по модели freemium. Основной инструмент командной строки является открытым исходным кодом и бесплатен для использования, что позволяет пользователям устанавливать и запускать его без затрат. Хотя сам инструмент бесплатен, обозначение "freemium" предполагает потенциальные будущие премиум-опции или услуги, хотя ни одна из них явно не детализирована по текущей информации.

  • Freemium: Бесплатно с премиум-опциями (детали не указаны)

Pros

  • +Automated removal of safety filters and refusal behaviors from LLMs.
  • +Preserves original model intelligence with low KL divergence (e.g., 0.16).
  • +Open-source and accessible via pip install for local use.
  • +Offers an on-demand decensoring service for various model sizes without local GPU.
  • +Outperforms manual ablation and some other abliteration tools in benchmarks.
  • +Provides a training-free alternative to expensive fine-tuning for decensoring.

Cons

  • Requires Python 3.10 or later for local installation.
  • On-demand service tiers are limited by access token and wallet balance.
  • Primarily a command-line tool, lacking a graphical user interface.
  • Focuses specifically on filter removal, not general model deployment or interaction.
  • Raises ethical concerns among policymakers regarding uncensored AI capabilities.

Похожие инструменты

Heretic против конкурентов

Heretic отличается тем, что автоматизирует сложный процесс направленной абляции, задача, которая ранее требовала значительных ручных усилий и специализированных знаний.

1

Provides a C/C++ implementation for running LLaMA and other open-weight models locally on consumer hardware, primarily via command-line.

Heretic aims to automatically remove filters from existing models. llama.cpp provides the raw, unfiltered access to the model's core inference, allowing users to implement their own prompting strategies or use models that inherently lack strong safety filters. It requires more manual effort in crafting prompts compared to Heretic's automated approach.

2

A comprehensive, script-based web UI for running and interacting with various open-weight LLMs locally, offering extensive control over generation parameters and prompt engineering.

While it primarily presents a web UI, it is launched and managed via command-line scripts, giving users deep control over model behavior and allowing for advanced prompt engineering to bypass model guardrails. Heretic is purely CLI and focuses on automated filter removal, whereas this tool provides a flexible environment for manual experimentation and control.

3
KoboldCpp

A user-friendly, locally runnable inference server for `llama.cpp` compatible models, offering both a web UI and a CLI mode for direct interaction and fine-tuning of generation parameters.

Like Heretic, KoboldCpp allows for local interaction with open-weight models. It provides a more integrated experience for running models and offers a CLI mode for direct control, which can be used to craft prompts and settings that bypass typical safety mechanisms, though it doesn't automate filter removal in the same way Heretic does.

4
MLC LLM

A universal deployment framework that allows users to compile and run LLMs locally on various hardware platforms, providing fine-grained control over model execution via its command-line interface.

MLC LLM focuses on the deployment and execution of LLMs, giving users direct control over the model's runtime environment and parameters through its CLI. This allows for interaction with models without higher-level safety wrappers, similar to Heretic's goal, but requires more technical setup for model compilation and deployment rather than just automated filter removal.

Ещё на Stork

Похожие ИИ-инструменты

Другие инструменты этой категории, подобранные по общим тегам

Featured in articles