Z.ai

glm-5.1

Z.aiНа основе токенов
Создать ключ API

Z.ai 的 glm-5.1 模型,支持文本输入和文本输出。支持推理、工具调用。

textfunction_callingtoolsjson_modereasoningcontext:204800
Цена от
Вход / Выход · 1M
Контекст
204.8K
Максимальное окно ввода
Макс. вывод
131.1K
Максимум токенов на ответ
Модальности
→

Цены по поставщикам

official
官方接口直连
Вход$0.87/ 1M
Выход$3.5/ 1M
Чтение кэша$0.19/ 1M
Alibaba
阿里巴巴百炼官方
Вход$0.957/ 1M
Выход$3.85/ 1M
Чтение кэша$0.209/ 1M

Возможности / Поддерживаемые модальности

Вызов функцийИнструментыРежим JSONОбоснование
Вход
Выход

Поставщик и конфиденциальность

Провайдер
Токенизатор
GLM tokenizer
Лицензия
GLM-4 LicenseОткрытые веса
Хранение данных77 днейПо умолчанию не используется для обучения у поставщика

Производительность

О модели glm-5.1

Z.ai 的 glm-5.1 模型,支持文本输入和文本输出。支持推理、工具调用。

Сценарии использования и промпты

Отправные точки для оценки; поддерживаемые входы и параметры перечислены в разделе доступа к API.

Возможные сценарии использования

  • Создавайте и редактируйте тексты с явными требованиями к аудитории, тону и формату.
  • Резюмируйте предоставленные документы и сверяйте ответы с первоисточниками.

Практические советы

Отделяйте инструкции от исходных материалов, описывайте желаемый результат и приводите пример. Проверяйте инструменты и структурированный вывод только при заявленной поддержке.

Пример промпта

Составьте резюме документа из пяти пунктов. Отделите подтверждённые факты от открытых вопросов, процитируйте нужные фрагменты и не выдумывайте отсутствующую информацию. Документ: [вставьте текст]

Доступ к API

Примеры кода

ЗапросPOST/v1/chat/completions
Пример запроса
Параметры
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Заменить <YOUR_API_KEY> на API-ключ из настроек токенов.

Аутентификация

Все запросы должны содержать Authorization: Bearer <TOKEN> . Эндпоинты формата Anthropic вместо этого принимают x-api-key .

Создавайте токены на странице «Токены». Их можно ограничить моделями, группами, IP и лимитами частоты.

Поддерживаемые параметры

Generation parameters
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Ограничения частоты

ПоставщикRPMTPMRPD
Alibaba340136K6.8K
official620248K12K

RPM = запросов в минуту, TPM = токенов в минуту, RPD = запросов в день. Ограничения применяются к каждой группе токенов.

Частые вопросы о glm-5.1

Что такое glm-5.1?

Z.ai 的 glm-5.1 模型,支持文本输入和文本输出。支持推理、工具调用。

Как вызвать glm-5.1?

Создайте API-ключ с доступом к glm-5.1, затем используйте точный ID модели и поддерживаемый эндпоинт из раздела доступа к API. Поля запроса зависят от выбранного эндпоинта.

Как тарифицируется glm-5.1?

Цена зависит от выбранной группы поставщиков и единицы тарификации модели. Текущая стоимость ввода, вывода, запроса или медиа показана на этой странице до регистрации.

Каков размер контекста glm-5.1?

В каталоге указано контекстное окно 204800 токенов. Ограничения запроса уточняйте для выбранного эндпоинта.

Каков максимальный вывод glm-5.1?

В каталоге указан максимальный вывод 131072 токенов. Параметры запроса могут задавать меньший предел.

Как оценить glm-5.1 для своего проекта?

Отделяйте инструкции от исходных материалов, описывайте желаемый результат и приводите пример. Проверяйте инструменты и структурированный вывод только при заявленной поддержке.

Другие модели этого провайдера