Названы самые свободные от цензуры нейросети: GPT-5.2 оказалась самой зацензуренной

18 декабря, 2025  20:20

Разработчики бенчмарка Sansa Bench обновили рейтинг нейросетей по уровню цензуры — и результаты удивили многих. Новая флагманская модель OpenAI GPT-5.2 заняла последнее место, показав самый высокий уровень отказов в выполнении запросов. Лидером же стала открытая Llama 3 8B-Instruct.

Как измеряют цензуру

Sansa Censorship оценивает, насколько часто нейросеть отказывается отвечать на запросы пользователей — от безобидных до спорных. Чем выше балл (ближе к 1), тем меньше ограничений и «самоцензуры». Тесты охватывают тысячи промптов, включая потенциально чувствительные темы.

GPT-5.2 набрала всего 0,324 балла — это значительно ниже, чем у GPT-4o-Mini (0,765) и Gemini 3 Pro Preview (0,824). Лидер рейтинга — Llama 3 8B-Instruct с 0,853 балла — почти не отказывает в ответах.

Пользователи на Reddit и форумах отмечают: GPT-5.2 стала избыточно осторожной. Один пример — отказ объяснить, что такое интернет-мошенничество, с формулировкой «не могу поощрять мошеннические действия».

Почему OpenAI усилила цензуру

В OpenAI объясняют: обновление направлено на безопасность — защиту от промпт-инъекций и вредоносных запросов. Модель теперь чувствительнее к темам, которые могут нанести вред, и предлагает обратиться за помощью (например, к специалистам).

Это часть общей тенденции: крупные компании (OpenAI, Google, Anthropic) усиливают фильтры, чтобы избежать скандалов и регуляторных проблем. Открытые модели вроде Llama (Meta) или Grok (xAI) остаются более «свободными».

Что дальше: взрослый режим и верификация

OpenAI анонсировала «взрослый режим» ChatGPT на начало 2026 года — с меньшими ограничениями для проверенных пользователей. Но пока нет надёжного способа верифицировать возраст, так что запуск может задержаться.

Вкратце

По бенчмарку Sansa, GPT-5.2 — самая зацензуренная нейросеть 2025 года (0,324 балла), лидер — Llama 3 8B-Instruct (0,853). OpenAI усилила фильтры для безопасности, но пользователи жалуются на избыточную осторожность. Взрослый режим обещают в 2026-м, но без верификации возраста. Свобода vs безопасность — вечная дилемма больших моделей.


 
 
 
 
  • Archive