Модели

Какую модель выбрать

Обновлено 2026-09-20

В API шесть id — не шесть «тарифов», а шесть голов под разные задачи. По умолчанию идёт GLM; остальные меняют характер ответа, длину текста и наличие обязательного reasoning. Цифры — на странице цен, вызов — в документации.

Ключ в @uncensobot, Base URL https://uncensored.monster/v1. Протокол только Chat Completions. Пустой model = z-ai/glm-5.3-flash-uncensored. Переключатель модели в Telegram на API не влияет — id задаёте в клиенте.

GLM — стартовая точка

z-ai/glm-5.3-flash-uncensored — GLM 5.3 Flash Uncensored. Универсальный чат: текст, код, при необходимости фото, поиск и reasoning в одном id.

Берите GLM, если не знаете, с чего начать, или нужен один id на весь день. Подробнее — в заметке про GLM по умолчанию. Меняйте модель только когда задача явно не ложится: длинный аналитический текст, другой стиль диалога, принудительная цепочка рассуждений.

Abliterated: короткий и тяжёлый текст

Две модели на одной линии abliteration, разный масштаб:

Обе заточены под текст без лишнего театра отказов — почему это работает, в статье про отказы и abliteration. Large v2 дороже на входе и выходе; имеет смысл, когда нужен объём, а не экономия на коротком рерайте.

Qwen: с reasoning и без

Одна база Qwen 3.8 27B, два id:

Версия :thinking — когда важен ход мысли: многоусловная логика, разбор вариантов, пошаговый план. Обычный Qwen — когда нужен быстрый текст в чат или скрипт парсит только content, без отдельного reasoning-поля.

Gemma — диалог и тексты

Gemma-4-31B-Gembrain-uncensored-heretic — Gemma 4 31B Gembrain uncensored heretic. Другой «голос»: fiction, ролевой диалог, литературные черновики. Не замена GLM для кода или поиска — отдельная голова под prose.

У Gemma в прайсе только вход и выход; отдельной строки кеша нет — учитывайте при сравнении с GLM и Qwen на ценах.

Как не ошибиться на практике

Скопируйте id целиком, без суффиксов вроде [1m]. Окно контекста в клиенте — 1048576, ответ — до 16384 токенов или свой max_tokens. Минимум за запрос $0.005 — детали в сколько стоит запрос.

Не гоняйтесь за «самой uncensored» моделью. Все шесть уже прошли abliteration или аналог; разница в задаче и в цене, не в моральном рейтинге. Сервис для исследований — формулировка на вас.

Быстрая шпаргалка

Чат и код на каждый день → GLM. Короткая правка → Abliterated base. Длинный разбор → Abliterated Large v2. Логика с видимыми шагами → Qwen :thinking. Быстрый Qwen без thinking → qwen/qwen3.8-27b-uncensored. Художественный текст → Gemma.

Частые вопросы

Достаточно ли оставить model пустым?

Да, уйдёт GLM. Но явный id проще отлаживать и сравнивать головы в одном клиенте.

Модель в боте уже Qwen — API тоже Qwen?

Нет, пока в запросе не указан qwen/qwen3.8-27b-uncensored или :thinking. Telegram-пicker на ключ не действует.

Где полный список цен?

На /pricing/. Здесь — только кому какой id; калькуляция запроса — в заметке про стоимость.