
Фото до статті
Андрій Савчук
Автор новин
Китайська компанія Alibaba презентувала новітню передову модель Qwen3.8-Max, яка за низкою показників перевершує нещодавно випущений фаворит — модель Kimi K3 від Moonshot AI. Цей реліз демонструє, як стрімко китайські технологічні розробки наближаються до рівня таких гігантів, як Anthropic та OpenAI.

Що таке Qwen3.8-Max
19 липня Alibaba представила попередню версію Qwen3.8-Max, а тепер пропонує її повноцінний реліз. Ця нова велика мовна модель функціонує за архітектурою «суміш експертів» (Mixture of Experts), має загалом 2,4 трильйона параметрів. Водночас, одночасно активними є лише 95 мільярдів параметрів, що дозволяє суттєво зменшити обчислювальні ресурси та скоротити час відгуку. Модель є мультимодальною, тобто здатною обробляти тексти, зображення та відео. Її контекстне вікно сягає 1 мільйона токенів, з можливістю генерації близько 131 тисячі токенів за один вивід.
Наразі доступ до моделі надається через хмарну платформу QwenCloud, включаючи API, який повністю сумісний з OpenAI. Alibaba також планує опублікувати відкриті ваги моделі на платформах Hugging Face та ModelScope протягом наступного тижня. Це знаменна подія, адже вперше компанія робить загальнодоступною модель такого високого рівня.
Kimi K3 поступається лідерством серед відкритих моделей
На початку липня модель Kimi K3 від Moonshot AI (2,8 трильйона параметрів) викликала значний резонанс, посівши перше місце у рейтингу Arena Frontend Code, обійшовши навіть такі моделі, як Claude Fable 5 та GPT-5.6 Sol. В індексі штучного аналізу Artificial Analysis модель отримала 57 балів, зайнявши четверте місце серед 189 представлених моделей, що є найвищим показником для LLM з відкритими вагами.
Однак, після випуску Qwen3.8-Max, ця ситуація змінилася. Згідно з даними рейтингу Arena Code, нова модель від Alibaba випередила Kimi K3 приблизно на 6 балів, поступившись лише Claude Fable 5 (з відривом близько 12,6 бала). Qwen3.8-Max демонструє перевагу над GPT-5.6 Sol та Fable 5 у семи тестах, що охоплюють кодування, агентні завдання та загальні можливості. У 36 мультимодальних та відео тестах вона також займає лідируючі позиції над обома згаданими моделями. Bloomberg повідомляє, що у деяких рейтингах Arena, Qwen3.8-Max поступається лише розробкам від Anthropic.
Таким чином, ситуація на ринку відкритих моделей трансформувалася менш ніж за три тижні: Kimi K3 недовго утримувала першість, і Qwen3.8-Max перехопила естафету лідера серед відкритих систем.
Слід зазначити, що власні оцінки Alibaba, які позиціонують модель як “другу після Fable 5”, наразі базуються переважно на внутрішніх тестах компанії та спостереженнях спільноти на відкритих лідербордах. Незалежні дослідницькі групи ще не встигли провести тестування як хмарної версії, так і майбутніх відкритих версій моделі.
Автономне кодування як ключовий доказ
Alibaba зосередилася не тільки на бенчмарках, але й продемонструвала здатність до тривалої автономної роботи. Компанія стверджує, що Qwen3.8-Max протягом 16 днів самостійно займалася розробкою та підтримкою проєкту кодового агента під назвою oh-my-cli. Завдання надходили через GitHub issues, агенти брали їх у роботу, а внесені зміни проходили процес тестування та перевірки пул-реквестів. Станом на 30 липня проєкт мав 265 комітів, 127 пул-реквестів та 151 issue; до 3 серпня кількість комітів зросла до 424.
В іншому експерименті модель змогла відтворити результати наукової праці, присвяченої відбору даних для навчання, а потім спробувала вдосконалити запропонований метод. Процес тривав приблизно 125 годин, було згенеровано близько 7600 рядків коду, виконано понад 1100 дій та проведено 33 цикли навчання GPU без будь-якого людського втручання.
Ціноутворення
Вартість використання Qwen3.8-Max на платформі QwenCloud складає $2 за мільйон вхідних токенів та $6 за мільйон вихідних. Передбачені нижчі тарифи для кешованих вхідних даних. Це значно нижче, ніж ціни на флагманські моделі від Anthropic та OpenAI. За попередніми даними, Claude Fable 5 коштує близько 10 доларів за вхідні та 50 доларів за вихідні мільйон токенів. Для порівняння, попередня версія моделі, Qwen3.7-Max, мала ціни $2,50 та $7,50 відповідно. Це означає, що нова флагманська модель стала навіть дещо доступнішою, попри суттєве збільшення кількості параметрів.
Приваблива ціна в поєднанні з заявленою продуктивністю, що наближається до рівня Fable 5 та GPT-5.6 Sol, є головним конкурентним козирем Alibaba для розробників. Компанія розраховує, що доступ через API залучить платний трафік до хмари QwenCloud ще до того, як стане доступним стабільний реліз для самостійного розгортання.
Кон
Випуск Qwen3.8-Max відбувається на тлі активної діяльності китайських технологічних компаній. Минулого тижня DeepSeek розширила доступ до своєї моделі V4 Flash, а Moonshot AI ще в середині липня представила Kimi K3. Акції Alibaba на біржі Гонконгу продемонстрували зростання понад 6% після оголошення, що свідчить про оптимізм інвесторів щодо комерційного потенціалу моделі в хмарному бізнесі компанії.
Зростаючий вплив китайських LLM може спонукати OpenAI та Anthropic до перегляду своєї цінової політики та надання розробникам більш гнучких опцій розгортання.
Нагадаємо, що OpenAI готується до значного зниження цін на токени, щоб зберегти конкурентоспроможність з Anthropic у боротьбі за користувачів.
Головна > Новини > Qwen3.8-Max — новий лідер серед відкритих LLM. На тестах модель 16 днів автономно писала код
