Источник перепечатки статьи: AIcore

Первоисточник: Открытое сообщество AIGC.

Источник изображения: Создано Unbounded AI‌

В прошлый вторник «Открытое сообщество AIGC» представило Writer, генеративную платформу искусственного интеллекта, которая собрала 100 миллионов долларов США. Способность компании получить общий объем финансирования в размере 126 миллионов долларов США всего за три года и стать одним из основных конкурентов ChatGPT неотделима от ее превосходной технологии. Это также полностью доказывает, что ее модель имеет успешные примеры применения и признана капиталом и пользователями.

В настоящее время Writer открыл исходный код большой языковой модели Palmyra, которую он использует на HuggingFace. Существует 8 моделей, включая small, base, 20b-chat, Instruct-20b, med-20b и т. д., которые коммерчески доступны и поддерживают точные данные. тюнинг.

Адрес с открытым исходным кодом: https://huggingface.co/Writer‌

Адрес бесплатной пробной онлайн-версии: https://app.writer.com/organization/‌

К техническим преимуществам Palmyra относятся: небольшие параметры и мощные функции, которые очень полезны для малых и средних предприятий и индивидуальных разработчиков, не имеющих вычислительных ресурсов; она прошла обучение по написанию деловых и маркетинговых данных, в основном для корпоративных пользователей; , со встроенными несколькими ограждениями безопасности;

Помимо генерации текста, он также может извлекать сводки контента из видео, PDF-файлов и аудио; он поддерживает точную настройку данных, а предприятия могут создать своего собственного помощника «ChatGPT» и т. д.

Следующее «Открытое сообщество AIGC» представляет несколько специальных моделей Пальмиры:

Инструктировать Пальмира-20б

Это модель настройки инструкций, созданная на основе базовой модели Palmyra-20b и поддерживающая расширенную обработку естественного языка и индивидуальные потребности.

Модель InstructPalmyra-20b была тщательно обучена на обширном наборе данных, содержащем около 70 000 записей команд-ответов. Эти записи создаются профессиональной технической командой Writer по языковому моделированию и точной настройке.

InstructPalmyra-20b обладает превосходной способностью обрабатывать сложные инструкции и генерировать точные, контекстуальные ответы. Это делает его идеальной моделью для разработки широкого спектра приложений, таких как виртуальные помощники, поддержка клиентов, создание контента и многое другое.

Кроме того, комплексное обучение модели позволяет ей адаптироваться и хорошо работать в различных условиях и контекстах, что еще больше расширяет потенциальные варианты ее использования.

Пальмира-с-20б

Palmyra-Med — это модель Writer, созданная специально для нужд отрасли здравоохранения, с инструкциями, точно настроенными на основе медицинских данных.

Palmyra-Med получила наивысший балл в тестировании на основные биомедицинские вопросы, отвечая на PubMedQA, с уровнем точности 81,1%, опередив GPT-4 и людей, прошедших медицинскую подготовку.

Он может выполнять такие функции, как перевод профессиональной медицинской терминологии, извлечение сводных медицинских записей, анализ огромных медицинских данных и автоматическое генерирование медицинских заключений.

Пальмира Большая 20Б

Palmyra-Large — это модель причинного декодера, созданная Writer, дополненная Palmyra-Index-Data и обученная на 800 миллиардах данных в высококачественном корпусе.

Palmyra Large использует цель моделирования причинного языка (CLM) во время предварительного обучения модели. Таким образом, подобно GPT-3, он предварительно обучается с целью самостоятельного моделирования причинного языка.

Эта модель работает очень быстро и потребляет очень мало ресурсов. Она подходит для таких бизнес-сценариев, как здравоохранение, маркетинг, маркетинг, ИТ, дизайн и человеческие ресурсы, для создания индивидуальных помощников ИИ.

Оценка эффективности

Palmyra получила высший балл на Stanford HELM, превзойдя известные модели с открытым исходным кодом, такие как Falcon 40B и LLaMA-30B. HELM — очень известная платформа эталонного тестирования от Центра фундаментальных исследований моделей Стэнфордского университета.

Palmyra заняла первое место в нескольких важных тестах, набрав 60,9% по Массивному многозадачному пониманию языка (MMLU), 89,6% по BoolQ и 79,0% по NaturalQuestions.

Palmyra заняла второе место в двух других ключевых тестах с оценкой контекстных вопросов и ответов 49,7% и оценкой TruthfulQA 61,6%. Общие показатели очень высокие.

Короче говоря, Palmyra очень подходит для разработчиков, которые хотят коммерциализировать большие языковые модели, чтобы изучить архитектуру и функции ее модели и перенять ее успешный опыт.