API
Документация
Работает из коробки, никаких танцев с бубном. OpenAI-совместимый Chat Completions. Ключ берётся в кабинете на сайте или в Telegram-боте: команда /api или кнопка API.
https://uncensored.monster/v1z-ai/glm-5.3-flash-uncensoredС чего начать
- Откройте кабинет или @uncensobot. Ключ, баланс и оплата общие.
- Пополните пакет ($1–$100, Crypto или xRocket USDT). Без баланса API ответит 402.
- Кнопка API — ключ целиком один раз. Пробелы и перенос из Telegram уберите.
- В клиенте три поля: Base URL с
/v1, ключ, точный Model ID. Новый чат после смены адреса. - Короткий пинг: «Ответь одним словом: готово». Если ответ пришёл — клиент ходит к нам.
Подробнее: маршрут бот → ключ → API.
Что умеет API
GET /v1/models— каталог; нуженAuthorization: Bearer. Без ключа будет 401, публичного каталога нет.POST /v1/chat/completions— текст, изображения (image_url), стрим. Поляmax_tokensиmax_completion_tokensпринимаются.tools,tool_choiceиparallel_tool_callsшлюз прокидывает наверх. Если провайдер инструменты не умеет — придёт ошибка апстрима.- Идентификатор модели — один из списка ниже. Пустой
modelуходит в GLM. Переключатель в Telegram на API не влияет. - В клиенте задайте окно контекста
1048576и бюджет ответа16384(или свойmax_tokens/max_completion_tokens). Это лимит одного ответа, не всего диалога. - Системный промпт, история и инструменты входят в то же окно.
- Тело запроса — до 32 МиБ. Больше — 413.
- Перед запросом резервируем оценку входа и бюджет ответа (
max_tokens/max_completion_tokens, иначе 16384) по тарифу модели. Если резерв не влезает в доступный баланс — 402. После ответа списываем факт, остаток резерва возвращается. Зависший резерв снимается через 20 минут. - Anthropic Messages, OpenAI Responses, embeddings и FIM не обслуживаются.
- Не крутите ретрай, если ответ уже пошёл стримом: повтор — отдельный платный запрос. Для разбора пришлите время и заголовок
X-Request-ID, не ключ. - Не дописывайте
/chat/completionsв Base URL — суффикс добавляет клиент.
Кеш — часть входных токенов: если в usage есть cached_tokens, они по цене кеша модели. Карточки — на главной. Названия пунктов меню в IDE зависят от версии; полный агентный сценарий каждой оболочки отдельно не гоняли.
-
z-ai/glm-5.3-flash-uncensoredПо умолчанию. Чат, текст, код. -
abliteration-ai/abliterated-model-large-v2Сложные текстовые задачи. -
qwen/qwen3.8-27b-uncensoredБез обязательного размышления. -
qwen/qwen3.8-27b-uncensored:thinkingС размышлением, многошаговые задачи. -
abliteration-ai/abliterated-modelКороткие и обычные тексты. -
Gemma-4-31B-Gembrain-uncensored-hereticДиалог, письмо, анализ. -
z-ai/glm-5.3-flash-cybersecurityКибербезопасность, с размышлением. -
google/gemma-4-26b-a4b-it-cybersecurityКибербезопасность, Gemma 26B.
ZCode
- В боте откройте API, создайте ключ с понятным именем, например
zcode. - Поставьте или обновите ZCode с zcode.z.ai.
- Settings → Model Settings. Либо нажмите имя модели под полем ввода → Manage Models.
- Внизу списка — Add Provider. Имя любое, например
uncensored. - OpenAI Base URL:
https://uncensored.monster/v1. Anthropic Base URL оставьте пустым. - Формат: Chat completions. Вставьте ключ. Если есть «API Key Required» — включите. Сохраните.
- Add Model, ID точно
z-ai/glm-5.3-flash-uncensored. Отображаемое имя — на ваш вкус. - Advanced у этой модели: Context Window
1048576, Max output tokens16384. - Включите тумблер у провайдера и у модели. В чате выберите модель из этой группы, не встроенный GLM Z.ai.
- Новая задача, короткое сообщение вроде «Ответь одним словом: готово».
Не вставляйте ключ в карточку Z.ai / BigModel — они ходят на /paas/v4, этот адрес не подойдёт. Суффикс [1m] в ID модели не добавляйте.
Cursor
- Settings → Models → API Keys / OpenAI compatible (формулировка зависит от версии).
- Override OpenAI Base URL:
https://uncensored.monster/v1. Anthropic Base URL оставьте пустым. - Ключ из бота. Модель:
z-ai/glm-5.3-flash-uncensored, без суффикса[1m]. - Новый чат агента после смены адреса. Старый тред может держать прежний хост.
Cursor Tab и встроенные модели Cursor ходят по условиям Cursor, не по нашему ключу. Подробнее: свой Base URL в Cursor. Из терминала Cursor можно поднять Aider — это отдельный клиент.
Roo Code (VS Code)
- Панель Roo → API Provider → OpenAI Compatible.
- Base URL, ключ, Model ID как выше. Context Window
1048576, Max Output Tokens16384. - Включите Image Support, если нужны картинки. Computer Use как отдельную возможность модели не включайте — картинки её не добавляют.
- Поля цены в Roo — для отображения в расширении. Списание всегда по нашему прайсу (у GLM вход $0.39 / выход $1.58 / кеш $0.16 за 1M).
- Начните с одной небольшой задачи и одного файла. Roo ходит нативными
tools.
Cline (VS Code)
- Cline → Settings → API Provider: OpenAI Compatible.
- Base URL, ключ, Model ID. Если Plan и Act разведены по провайдерам — заполните оба одинаково.
- Model Configuration: Max Output Tokens
16384, Context Window1048576, Image Support при необходимости. - Короткий запрос. Системные инструкции, история и инструменты входят в то же окно.
Kilo Code (VS Code)
- Settings → Providers → Custom provider. ID любой, например
uncensored. - Provider API: OpenAI Compatible. Base URL, ключ, Model ID. Сохраните.
- В
kilo.jsoncу модели:limit.context = 1048576,limit.output = 16384. Выберите этот провайдер в списке моделей. - Только Chat Completions. Картинки GLM принимает; протокол Anthropic в Kilo не выбирайте.
Continue (VS Code / JetBrains)
VS Code: расширение Continue → локальный config.yaml. JetBrains: Settings → Plugins → Continue, тот же файл модели. Если конфиг уже есть — перенесите только запись в models.
models:
- name: GLM 5.3 Flash Uncensored
provider: openai
model: z-ai/glm-5.3-flash-uncensored
apiBase: https://uncensored.monster/v1
apiKey: YOUR_KEY
roles:
- chat
- edit
defaultCompletionOptions:
maxTokens: 16384
Chat и Edit работают. Автодополнение и индекс через embeddings — нет: embeddings мы не обслуживаем.
Zed
- Команда
zed: open settings file— вsettings.jsonдобавьте провайдера, не затирая остальной JSON. - Команда
agent: open settings— ключ в UI провайдера, не в JSON. - В панели AI выберите GLM и короткий текстовый запрос.
{
"language_models": {
"openai": {
"api_url": "https://uncensored.monster/v1",
"available_models": [
{
"name": "z-ai/glm-5.3-flash-uncensored",
"display_name": "GLM 5.3 Flash Uncensored",
"max_tokens": 1048576,
"max_output_tokens": 16384
}
]
}
}
}
В Zed max_tokens — окно контекста, max_output_tokens — бюджет ответа. Edit Prediction настраивается отдельно и к нашему API не обязан ходить.
JetBrains AI Assistant
- Settings → Tools → AI Assistant → Providers & API keys.
- Third-party AI providers → OpenAI-compatible. URL
https://uncensored.monster/v1, ключ из бота. Test Connection. - В AI Chat выберите GLM. При необходимости Model Assignment → Core features, контекст
1048576.
Это чат и генерация кода. Подписку JetBrains и отдельные встроенные агенты этот ключ не заменяет. Плагин Continue в тех же IDE — секция выше.
Aider
Терминал в папке проекта (VS Code, Cursor, JetBrains — без разницы). Префикс openai/ говорит Aider, какой протокол брать. Предупреждение «unknown model» бывает — id копируйте целиком. Не кладите в контекст весь репозиторий: /add один небольшой файл, затем правка.
export OPENAI_API_BASE=https://uncensored.monster/v1 export OPENAI_API_KEY=YOUR_KEY aider --model openai/z-ai/glm-5.3-flash-uncensored
PowerShell: $env:OPENAI_API_BASE и $env:OPENAI_API_KEY.
OpenCode 2
В opencode.jsonc добавьте провайдера (у версии 1 формат другой). Ключ — в окружении, не в репозитории. В /models выберите uncensored/ и GLM. Начните с маленькой задачи.
{
"provider": {
"uncensored": {
"npm": "@ai-sdk/openai-compatible",
"name": "uncensored.monster",
"options": {
"baseURL": "https://uncensored.monster/v1",
"apiKey": "{env:UNCENSORED_API_KEY}"
},
"models": {
"glm": {
"name": "z-ai/glm-5.3-flash-uncensored",
"limit": { "context": 1048576, "output": 16384 }
}
}
}
}
}
Python и Node
Ключ только на сервере, не в браузерном JS. Не вызывайте client.responses.create — будет 404.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_KEY",
base_url="https://uncensored.monster/v1",
)
r = client.chat.completions.create(
model="z-ai/glm-5.3-flash-uncensored",
messages=[{"role": "user", "content": "ping"}],
max_tokens=32,
)
print(r.choices[0].message.content)
Стрим: stream=True, читайте chunk.choices[0].delta.content. Пакет: python -m pip install openai.
const r = await fetch("https://uncensored.monster/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.UNCENSORED_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "z-ai/glm-5.3-flash-uncensored",
messages: [{ role: "user", content: "ping" }],
max_tokens: 32,
}),
});
const data = await r.json();
if (!r.ok) throw new Error(data.error?.message || r.status);
console.log(data.choices[0].message.content);
Любой другой OpenAI-совместимый агент (Hermes и подобные) — те же три поля: Base URL с /v1, ключ, id модели.
Проверка cURL
curl https://uncensored.monster/v1/chat/completions \
-H "Authorization: Bearer YOUR_KEY" \
-H "Content-Type: application/json" \
-d "{
\"model\": \"z-ai/glm-5.3-flash-uncensored\",
\"messages\": [{\"role\": \"user\", \"content\": \"ping\"}],
\"max_tokens\": 32
}"
Если не отвечает
- 401 — нет ключа, опечатка, пробел/перенос, ключ отозван. Создайте новый в кабинете или в боте.
- 402 — нет баланса. Пополните в кабинете или в боте; большой
max_tokensсам по себе не заменяет пополнение. - 400 — чужой
modelили кривой JSON. ID копируйте целиком, без[1m]. - 413 — тело запроса больше 32 МиБ (история, картинка). Уменьшите вложение; PNG/JPEG, не гигант.
- 404 — Base URL без
/v1, или клиент бьёт в Anthropic / Responses / embeddings / FIM. - 429 — слишком много параллельных запросов (на ключ — 3). Подождите; не крутите оплачиваемый ретрай в цикле.
- 503 — временный сбой. Подождите, не повторяйте сразу.
- Ответ обрезан,
finish_reason: length— поднимите бюджет ответа, новый чат или разбейте задачу. Для длинной генерации включите стрим. - Тайм-аут — стрим, короче задача, больше таймаут клиента.
- Картинка: GLM принимает; клиент может не уметь вложить файл. Начните с одного небольшого PNG/JPEG.
- Модель в ZCode выключена тумблером в строке — запрос не уйдёт.
Что сюда не подключается
Claude Code и ANTHROPIC_BASE_URL меняют хост, но не формат: нужен Anthropic Messages — его нет. Codex ждёт Responses — его нет. GLM не становится Claude/GPT от смены клиента. Для агента берите Cline, Roo, OpenCode или Aider.
Ключи и баланс — в кабинете или в Telegram. Документация: эта страница.