Mistral Large 4 поступилася китайським відкритим моделям у незалежному рейтингу

Mistral Large 4 поступилася китайським відкритим моделям у незалежному рейтингу

Mistral Large 4 набрала 38 балів у рейтингу Artificial Analysis, але поступилася п’яти китайським моделям із відкритими вагами.

Французька компанія Mistral представила мовну модель Large 4 із понад трильйоном параметрів, яка набрала 38 балів в індексі Intelligence Index незалежної платформи Artificial Analysis. Це найвищий результат серед моделей, створених поза США та Китаєм, однак щонайменше п’ять китайських моделей із відкритими вагами випередили її за загальним показником, повідомляє Tom's Hardware.

 

Результати індексу

 

У тестуванні Artificial Analysis модель Mistral Large 4 Preview отримала 38 балів. Вищі результати показали DeepSeek V4.1 Flash із 39 балами, GLM-5.3-Flash від Z.ai — 42, Kimi K3 від Moonshot — 44, GLM-5.3 — 45 та MiMo-V2.6-Pro від Xiaomi — 46 балів. Large 4 є моделлю типу mixture-of-experts: із 1,05 трлн загальних параметрів активними є від 49 млрд до 52 млрд.

Ваги Mistral Large 4 поки не оприлюднені: компанія планує випустити їх до кінця жовтня. Модель доступна у форматі Research Public Preview через API Mistral. Вона працює з текстовими та графічними вхідними даними, генерує текст і має контекстне вікно обсягом 512 тис. токенів.

 

Кібербезпека та вартість

 

Найсильнішим результатом Large 4 став тест CyberGym-E2E-AA, у якому модель набрала 82%. Це більше, ніж 79% у MiMo-V2.6-Pro, 78% у GPT-6 Luna та 74% у GLM-5.3-Flash. Водночас у зведеному Cyber Index результат Mistral Large 4 становить 50 балів — стільки ж, як у GLM-5.3-Flash, і менше за 56 балів MiMo-V2.6-Pro. У тестах DeepsecBench-AA та CWE-Bench-AA французька модель набрала відповідно 16% і 51%.

За стандартними тарифами використання Large 4 коштує 1,36 долара за мільйон вхідних токенів і 4,18 долара за мільйон вихідних. Artificial Analysis оцінює вартість одного завдання свого індексу в 1,13 долара, або 0,57 долара протягом перших двох тижнів із запусковою знижкою 50%. Для порівняння, MiMo-V2.6-Pro має показник 0,13 долара за завдання, а GLM-5.3-Flash — 0,25 долара.