Открытый кодМодели 🇺🇸 20.07.2026 17:04

Zhipu.AI открывает исходный код моделей GLM: скорость до 200 токенов в секунду и глобальная экспансия перед возможным IPO

DeepSeekDeepSeek
Китайская компания Zhipu.AI объявила о полном открытии исходного кода своих моделей GLM-4 и GLM-Z1. Новая инференс-модель GLM-Z1-32B-0414 достигает скорости до 200 токенов в секунду на потребительских GPU, что в 8 раз быстрее DeepSeek-R1. Также запущен международный домен Z.ai и представлена модель «Rumination» для автономных AI-агентов.
Китайская компания Zhipu.AI, в преддверии возможного первичного публичного размещения акций (IPO), объявила о полном открытии исходного кода своих моделей нового поколения GLM, включая продвинутую серию GLM-4 и инференс-модели GLM-Z1. Флагманская модель GLM-Z1-32B-0414, по заявлению компании, достигает скорости инференса до 200 токенов в секунду на потребительских GPU, что в 8 раз быстрее DeepSeek-R1 и в 50 раз превышает скорость чтения человека. Это стало возможным благодаря оптимизации GQA-параметров, квантизации и спекулятивной выборке. Также представлена модель «Rumination» GLM-Z1-Rumination-32B-0414, способная активно искать в интернете, использовать инструменты, проводить глубокий анализ и самопроверять информацию, что является шагом к более автономным AI-агентам. Открытая линейка включает базовую модель GLM-4-32B-0414 с улучшенными агентными способностями, включая генерацию кода в реальном времени (HTML, CSS, JS, SVG). Для разработчиков с ограниченными ресурсами выпущены компактные версии с 9 миллиардами параметров. Все модели распространяются по лицензии MIT. Для глобальных пользователей запущен домен Z.ai, предоставляющий доступ к моделям через веб-интерфейс и приложение. Корпоративным клиентам предлагается платформа MaaS (Model-as-a-Service) с различными тарифами, включая сверхскоростную модель GLM-Z1-AirX, экономичную GLM-Z1-Air и бесплатную GLM-Z1-Flash. Открытие исходного кода и запуск международной платформы рассматриваются как подготовка к возможному IPO.
Сокращения
IPO = Initial Public Offering — первичное публичное размещение акций
GPU = Graphics Processing Unit — графический процессор
GQA = Grouped Query Attention — групповое внимание запросов
MaaS = Model-as-a-Service — модель как услуга
API = Application Programming Interface — интерфейс прикладного программирования
Источник: Synced — оригинал

Наши прошлые публикации по теме

Есть свежие новости