Z.ai: GLM 4.7 Flash
z-ai/glm-4.7-flash
Являясь SOTA-моделью класса 30B, GLM-4.7-Flash предлагает новый вариант, сочетающий производительность и эффективность. Она дополнительно оптимизирована для сценариев агентского программирования, усиливая способности к кодингу, планированию долгосрочных задач и совместной работе с инструментами. Модель достигла лидирующих показателей среди открытых моделей аналогичного размера в ряде популярных публичных бенчмарков.
Контекст
202K
Макс. выход
16K
Модальность
text->text
Цены
Вход
5.76 ₽ / 1M токенов
Выход
38.40 ₽ / 1M токенов
Чтение кэша
0.96 ₽ / 1M токенов
Запись кэша
Бесплатно / 1M токенов
Возможности
Вход
Выход
Токенизатор
Other
Провайдеры (4)
| Провайдер | Данные | Контекст | Макс. выход | Вход / 1M | Выход / 1M | Uptime 24ч | Кэш |
|---|---|---|---|---|---|---|---|
|
DeepInfra
deepinfra/bf16 |
Не обучает
Не хранит
|
202K | 16K | 5.76 ₽ | 38.40 ₽ | 99.4% | 0.96 ₽ -83% |
|
Cloudflare
cloudflare US
|
Не обучает
Хранит
|
131K | 131K | 5.81 ₽ | 38.40 ₽ | 98.3% | - |
|
Novita
novita/bf16 |
Не обучает
Не хранит
|
200K | 128K | 6.72 ₽ | 38.40 ₽ | 91.8% | 0.96 ₽ -86% |
|
Venice
venice/fp8 |
Не обучает
Не хранит
|
128K | 16K | 12.00 ₽ | 48.00 ₽ | 99.0% | - |