Виклик гігантам зі США: китайська Z.ai випустила GLM-5.3, що наздоганяє ШІ OpenAI та Anthropic

Поділитися
Виклик гігантам зі США: китайська Z.ai випустила GLM-5.3, що наздоганяє ШІ OpenAI та Anthropic © Getty Images
Нова модель перевершує попередню в низці тестувань та показує значне зростання кіберможливостей.

Китайська Z.ai представила GLM-5.3 — оновлення своєї флагманської моделі зі ставкою на програмування. Компанія заявляє про значний прогрес у складному кодингу, агентних завданнях та кібербезпеці. Ваги моделі планують відкрити через два тижні після завершення перевірки безпеки, повідомляє Bloomberg.

За даними Z.ai, базова модель має 743 мільярди параметрів. Компанія заявляє, що GLM-5.3 стала найпотужнішою моделлю з відкритими вагами для програмування та встановила нові найкращі результати серед відкритих моделей у низці публічних тестів.

Результати тестувань

У публічному тесті Terminal Bench 2.1 нова модель отримала 88,2 бала, майже зрівнявшись із Fable 5 від Anthropic та GPT-5.6 Sol від OpenAI, які набрали 88,0 та 88,8 бала відповідно. У DeepSWE v1.1 результат GLM-5.3 становив 66,9 бала, тоді як GLM-5.2 отримала 46,2, а Fable 5 і GPT-5.6 Sol — 69,7 та 72,7 бала. На FrontierSWE GLM-5.3 показала 78,1 бала, поступившись Fable 5 із 88,2 бала та водночас перегнавши Opus 4.8 із 66,5 бала за наведеними в тестуванні результатами. У SWE-Marathon v1.1 модель набрала 42,5 бала, тоді як Fable 5 — 33,1.

Окремо Z.ai відзначила зростання можливостей GLM-5.3 у кібербезпеці. За словами компанії, під час масштабування пост-навчання модель продемонструвала вищу, ніж очікувалося, ефективність у завданнях із пошуку та експлуатації вразливостей.

У ExploitGym модель виконала 105 завдань за дві години та 130 за шість годин. Для порівняння, GLM-5.2 показала 29 і 39 відповідно, а Fable 5 — 181 і 247.

Створення GLM-5.3

GLM-5.3 розробляли на технологічному стеку, створеному для попередньої версії. Він включає IndexShare для ефективнішої роботи з довгими контекстами, SAO для навчання з підкріпленням у завданнях із довгостроковим плануванням та slime для масштабного асинхронного навчання.

Протягом останнього місяця Z.ai збільшувала кількість середовищ для навчання, урізноманітнювала завдання та нарощувала обсяги обчислювальних ресурсів. Компанія наголошує, що для GLM-5.3 не змінювала базову модель, а зосередилася саме на масштабуванні пост-навчання (post-training). За словами розробників, саме накопичені середовища для виконання довгострокових завдань дали змогу збільшувати масштаб навчання нової моделі.

Відкриті ваги

Z.ai планує оприлюднити ваги GLM-5.3 приблизно через два тижні після запуску. Перед цим компанія має завершити перевірку безпеки та заходи з підвищення стійкості системи.

Відкриті ваги є важливою частиною стратегії Z.ai. Це дає розробникам широкі можливості для використання та налаштування моделі й має допомогти компанії залучити більше користувачів.

Серед головних конкурентів Z.ai у Китаї — Moonshot AI з моделями Kimi, DeepSeek із лінійкою V4 та Alibaba з Qwen. Їхні моделі вже посідали високі позиції в незалежних тестуваннях систем ШІ.

Для Z.ai ситуація може відкрити додаткові можливості для розширення ринкової частки. Напередодні DeepSeek оголосила про підвищення цін на моделі V4 Flash та V4 Pro, причому в окремих випадках зростання становило до чотирьох разів, хоча середня вартість V4 Pro, за даними Artificial Analysis, все ще залишається нижчою за GLM-5.2.

Незалежні оцінювачі надали GLM-5.2 та флагманській моделі DeepSeek однаковий показник інтелекту — 53. Обидві моделі поступалися Kimi K3, а також передовим американським системам, зокрема Fable 5 від Anthropic та GPT-5.6 від OpenAI.

Водночас результати GLM-5.3 показують, що китайська модель поки не випереджає провідні американські системи за всіма напрямами. Її головна перевага наразі полягає у швидкому прогресі програмування, агентних можливостей та кібербезпеки, а також у майбутній доступності для розробників.

GLM-5.3 виходить на тлі загострення конкуренції між китайськими та американськими розробниками ШІ. Anthropic та OpenAI залишаються серед лідерів галузі, однак китайські компанії дедалі частіше демонструють близькі результати за нижчої вартості використання моделей.

Поділитися
Помітили помилку?

Будь ласка, виділіть її мишкою та натисніть Ctrl+Enter або Надіслати помилку

Додати коментар
Всього коментарів: 0
Текст містить неприпустимі символи
Залишилось символів: 2000
Будь ласка, виберіть один або кілька пунктів (до 3 шт.), які на Вашу думку визначає цей коментар.
Будь ласка, виберіть один або більше пунктів
Нецензурна лексика, лайка Флуд Порушення дійсного законодвства України Образа учасників дискусії Реклама Розпалювання ворожнечі Ознаки троллінгу й провокації Інша причина Відміна Надіслати скаргу ОК
Залишайтесь в курсі останніх подій!
Підписуйтесь на наш канал у Telegram
Стежити у Телеграмі