API
Зачем PAYG, если можно поднять свой сервер
Свой GLM на RunPod держит карту включённой, даже когда вы молчите — порядка $40 в час. Здесь списание за токены. Пакет от $1 в Telegram, не аренда железа по часам.
Это не страница «мы дешевле всех». Это разница биллинга: час простоя против миллиона токенов. Как считается запрос — стоимость запроса. Маршрут ключа — как начать. Выбор головы — какую модель. Карточки шести моделей — на ценах.
Что вы платите на своём сервере
Пока инстанс жив, счёт идёт. Нет запросов — карта всё равно греется. Драйверы, диск, бэкап весов, обновления — на вас. Для редких сессий это дороже, чем PAYG.
Что вы платите здесь
Вход, выход, кеш за 1M токенов. У GLM: $0.39 / $1.58 / $0.16. Минимум $0.005 за запрос. Пустой model = GLM. Другие ставки — на /pricing/, не усредняйте.
Пополнение — пакеты $1, $5, $10, $25, $50, $100 в @uncensobot. На сайте кассы нет.
Когда свой ящик всё же нужен
Если держите постоянную нагрузку 24/7 и сами хотите железо — аренда может сойтись. Открыли чат вечером и закрыли — PAYG. Сравнивайте свои часы простоя с токенами, не чужие скриншоты.
Частые вопросы
Есть ли бесплатный API?
Нет. Бесплатный слот только в чате бота: 1 раз в месяц, 2 с Premium, без поиска и think.
$1 — это безлимит?
Нет. Это пакет баланса. Списание за токены, пока баланс не кончится.
Почему GLM дешевле Large v2?
Разные модели и разные ставки за 1M. Смотрите таблицу на /pricing/.