За пределами двух сильнейших игроков — США и Китая — Европа наконец представила достойный результат в сфере ИИ. Французская ИИ-компания Mistral выпустила публичную предварительную версию своей флагманской модели Mistral Large 4. Сообщество прозвало её «Le Chonk», то есть «большой увалень».
Этот «увалень» и правда огромен: общее число параметров составляет около 1 трлн. Модель использует архитектуру смеси экспертов, и при каждом выводе фактически активируется около 49 млрд параметров. Её обучили с нуля на 3800 графических процессорах NVIDIA, причём обучение целиком проходило в дата-центрах Mistral в Европе. Согласно сторонним бенчмаркам, это модель с наивысшими показателями среди тех, что созданы за пределами США и Китая. Особенно хорошо она справляется с задачами в области кибербезопасности, финансов и права, поддерживает ввод текста и изображений, а размер её контекстного окна составляет от 512 тысяч до 1 миллиона токенов.
Текущая модель уже доступна через API по льготной цене, а план по открытию весов будет опубликован до конца октября. Это очень важно: открытые веса означают, что компании могут развертывать модель на своих собственных серверах, а данные не выходят за пределы локальной инфраструктуры. Это особенно привлекательно для европейских правительств и компаний, которые ценят суверенитет данных и соблюдение требований.
Почему стоит обратить на это внимание? За последние два года передовые большие модели в основном контролировались американскими компаниями, а сильные игроки в открытом исходном коде в основном приходили из Китая. Европа постоянно опасалась отставания в эпоху ИИ. На этот раз Mistral, используя относительно ограниченные вычислительные мощности, создала модель уровня триллион параметров, тем самым доказывая, что Европа по-прежнему сохраняет конкурентоспособность в ИИ, и предоставляя конкретный пример для концепции «суверенного ИИ».
Моё мнение: для инвесторов в этом есть два смысла. Во-первых, все страны строят собственный суверенный ИИ, и это будет продолжать стимулировать мировой спрос на вычислительные мощности — очевидными бенефициарами являются чипмейкеры вроде Nvidia. Во-вторых, открытые модели становятся всё сильнее, что будет постепенно снижать цены на вызов моделей. Это давление для компаний, которые зарабатывают на продаже API моделей, и при этом для компаний, разрабатывающих приложения, это хорошая новость с точки зрения снижения затрат. Чем ожесточённее конкуренция на уровне моделей, тем выше вероятность того, что ценность будет смещаться к сторонам вычислительных мощностей и прикладных решений.
Приведённая выше информация носит справочный характер и не является инвестиционной рекомендацией.