Mistral AI випустила наймогутнішу європейську ШІ-модель на трильйон параметрів

Французька компанія представила Mistral Large 4 - систему з трильйоном параметрів для коду, аналізу та кібербезпеки

Mistral Large 4
Mistral представила ШІ-модель Large 4

Французька компанія Mistral AI 7 жовтня випустила у відкритий попередній доступ мультимодальну модель Mistral Large 4 з трильйоном параметрів - розробник називає її найпотужнішою ШІ-системою, створеною в Європі. Система активує лише частину своїх параметрів під час обробки запитів, що робить роботу значно економнішою. Ваги моделі компанія планує оприлюднити наприкінці жовтня. 

За даними видання Techzine, модель побудована на архітектурі Mixture-of-Experts, що дозволяє залучати лише частину параметрів під час виконання конкретного завдання. З повного трильйона параметрів одночасно залученими залишаються лише 49 млрд, що покликано забезпечити ефективніше використання обчислювальних потужностей. Систему вже можна тестувати через API компанії, і вона розрахована на написання коду, аналіз інформації та роботу ШІ-агентів із багатокроковими завданнями.

Навчання моделі провели з нуля на 3800 графічних процесорах Nvidia Grace Blackwell у європейських датацентрах Mistral. Головний етап навчання зайняв близько двох місяців, причому залучена обчислювальна інфраструктура споживала приблизно 10 МВт електроенергії. Компанія визнає, що поточні результати ще не остаточні - показники можуть покращитися до моменту публікації ваг наприкінці жовтня, адже розробники продовжують навчання моделі з підкріпленням.

Зробили ставку на кібербезпеку

Mistral окремо виділила напрям кібербезпеки як ключову перевагу нової моделі. Компанія наголошує, що закриті моделі штучного інтелекту нерідко мають обмеження, які перешкоджають не лише потенційно небезпечним діям, а й легітимним дослідженням програмних вразливостей. На думку розробника, можливість самостійного розгортання системи дозволить організаціям встановлювати власні правила використання відповідно до внутрішніх політик безпеки.

У спеціалізованих тестах модель показала неоднозначні результати. У випробуванні, що передбачає відтворення відомої вразливості програмного забезпечення з відкритим кодом і її подальше усунення, ML4 набрала 82%, а в тесті Cybench із 40 завдань із кібербезпеки показала результат 93%. Натомість у завданнях юридичного спрямування результат виявився значно скромнішим - ML4 набрала 15%, обійшовши Kimi K3 із 13% та GPT-6 Astra з 5%. Це означає, що навіть найсучасніші ШІ-системи поки не здатні повністю самостійно виконувати складну юридичну роботу без контролю фахівців.

Чому це важливо для Європи

Розробник наголошує на незалежності нової моделі від американських хмарних постачальників. Коли ваги стануть відкритими, організації зможуть самі розгортати модель у власних дата-центрах чи приватних хмарах - таке рішення особливо важливе для держустанов, фінансових компаній та підприємств, що мають справу з конфіденційними даними. До публікації ваг 27 жовтня компанія продовжує додаткове тестування за участю фахівців із кібербезпеки та державних установ.

Для європейського ринку така розробка - крок до зменшення залежності від американських і китайських технологічних гігантів, які поки домінують у сфері великих мовних моделей. Якщо заявлені показники підтвердяться після повного відкриття ваг, Mistral Large 4 може стати альтернативою для урядових і фінансових структур, яким критично важливо зберігати контроль над даними.

Раніше Інформатор повідомляв, що Ілон Маск представив модель Grok 4.7, яка, за заявами компанії, перевершує конкурентів за потужністю, але коштує дешевше у використанні. Також ми писали, що у Китаї розробили ШІ-систему mHolmes, яка здатна визначати час смерті людини з похибкою всього у два дні - ще один приклад того, як вузькоспеціалізовані моделі штучного інтелекту досягають високої точності у специфічних галузях.

Слідкуйте за нами у Telegram

Image
Оперативні новини та разбори: Україна, світ, війна

ЧИТАЙТЕ ТАКОЖ:

Головна Актуально Україна на часі Youtube
Інформатор у
телефоні 👉
Завантажити