Модели
Какую модель выбрать
В API шесть id — не шесть «тарифов», а шесть голов под разные задачи. По умолчанию идёт GLM; остальные меняют характер ответа, длину текста и наличие обязательного reasoning. Цифры — на странице цен, вызов — в документации.
Ключ в @uncensobot, Base URL https://uncensored.monster/v1. Протокол только Chat Completions. Пустой model = z-ai/glm-5.3-flash-uncensored. Переключатель модели в Telegram на API не влияет — id задаёте в клиенте.
GLM — стартовая точка
z-ai/glm-5.3-flash-uncensored — GLM 5.3 Flash Uncensored. Универсальный чат: текст, код, при необходимости фото, поиск и reasoning в одном id.
Берите GLM, если не знаете, с чего начать, или нужен один id на весь день. Подробнее — в заметке про GLM по умолчанию. Меняйте модель только когда задача явно не ложится: длинный аналитический текст, другой стиль диалога, принудительная цепочка рассуждений.
Abliterated: короткий и тяжёлый текст
Две модели на одной линии abliteration, разный масштаб:
abliteration-ai/abliterated-model— базовый Abliterated. Короткие ответы, правки, компактные черновики.abliteration-ai/abliterated-model-large-v2— Abliterated Large v2. Сложный и длинный текст, разбор, многошаговые формулировки.
Обе заточены под текст без лишнего театра отказов — почему это работает, в статье про отказы и abliteration. Large v2 дороже на входе и выходе; имеет смысл, когда нужен объём, а не экономия на коротком рерайте.
Qwen: с reasoning и без
Одна база Qwen 3.8 27B, два id:
qwen/qwen3.8-27b-uncensored— ответ сразу в теле сообщения, без обязательного блока «думаю».qwen/qwen3.8-27b-uncensored:thinking— тот же прайс, но модель сначала строит цепочку рассуждений, потом финальный ответ.
Версия :thinking — когда важен ход мысли: многоусловная логика, разбор вариантов, пошаговый план. Обычный Qwen — когда нужен быстрый текст в чат или скрипт парсит только content, без отдельного reasoning-поля.
Gemma — диалог и тексты
Gemma-4-31B-Gembrain-uncensored-heretic — Gemma 4 31B Gembrain uncensored heretic. Другой «голос»: fiction, ролевой диалог, литературные черновики. Не замена GLM для кода или поиска — отдельная голова под prose.
У Gemma в прайсе только вход и выход; отдельной строки кеша нет — учитывайте при сравнении с GLM и Qwen на ценах.
Как не ошибиться на практике
Скопируйте id целиком, без суффиксов вроде [1m]. Окно контекста в клиенте — 1048576, ответ — до 16384 токенов или свой max_tokens. Минимум за запрос $0.005 — детали в сколько стоит запрос.
Не гоняйтесь за «самой uncensored» моделью. Все шесть уже прошли abliteration или аналог; разница в задаче и в цене, не в моральном рейтинге. Сервис для исследований — формулировка на вас.
Быстрая шпаргалка
Чат и код на каждый день → GLM. Короткая правка → Abliterated base. Длинный разбор → Abliterated Large v2. Логика с видимыми шагами → Qwen :thinking. Быстрый Qwen без thinking → qwen/qwen3.8-27b-uncensored. Художественный текст → Gemma.
Частые вопросы
Достаточно ли оставить model пустым?
Да, уйдёт GLM. Но явный id проще отлаживать и сравнивать головы в одном клиенте.
Модель в боте уже Qwen — API тоже Qwen?
Нет, пока в запросе не указан qwen/qwen3.8-27b-uncensored или :thinking. Telegram-пicker на ключ не действует.
Где полный список цен?
На /pricing/. Здесь — только кому какой id; калькуляция запроса — в заметке про стоимость.