Сегодня 06 октября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи из AI2 вместе c AMD и другими создадут научную нейросеть

Институт искусственного интеллекта Пола Аллен (AI2) в 2024 году планирует выпустить большую языковую модель Open Language Model (OLMo), ориентированную на научные изыскания. OLMo разрабатывается в сотрудничестве с AMD, консорциумом Large Unified Modern Infrastructure, который предоставляет суперкомпьютерные мощности для обучения и образования, а также Surge AI и MosaicML, которые предоставляют данные и обучающий код.

 Источник изображения: pixabay

Источник изображения: pixabay

Ханна Хаджиширзи (Hanna Hajishirzi), старший директор по нейролингвистическим исследованиям (НЛП) в AI2, заявила, что «исследовательским и технологическим сообществам нужен доступ к открытым языковым моделям для продвижения науки. С OLMo мы работаем над устранением разрыва между государственными и частными исследовательскими возможностями и знаниями путём создания конкурентоспособной языковой модели». По мнению Хаджиширзи, несмотря на то, что многие модели с открытым исходным кодом на сегодняшний день привнесли новый опыт и даже «раздвинули границы», они не были специфично ориентированы.

AI2 рассматривает OLMo как платформу, а не просто очередную ИИ-модель и по словам Хаджиширзи, всё, что AI2 делает для OLMo, будет общедоступно, включая датасет и API. Другое отличие OLMo, по словам Ноа Смита (Noah Smith), старшего директора по исследованиям НЛП в AI2, заключается в том, чтобы позволить модели лучше использовать и понимать учебники и академические статьи. Заметим, что это не первая попытка сделать научную нейросеть. Например, печально известная модель Galactica от Meta. Однако Хаджиширзи считает, что обучение AI2 в академических кругах и инструменты, разработанные учёными для исследований, такие как Semantic Scholar, помогут сделать OLMo «уникально подходящей» для научных и академических приложений.

Обучение должно начаться в ближайшие месяцы на суперкомпьютере LUMI в Финляндии — самом быстром суперкомпьютере в Европе по состоянию на январь. AI2 приглашает сотрудников помочь внести свой вклад и критически оценить процесс разработки модели. Желающие могут связаться с организаторами на странице проекта OLMo.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Gamesblender № 694: глобальный сбой в PSN, релиз Unreal Engine 5.5 и новый шутер по StarCraft 32 мин.
СМИ сообщают о грядущей ликвидации одной из российских альтернатив «Википедии» 3 ч.
В обновлённом Telegram появились подарки, подтверждение телефонов, улучшенные жалобы и RTMP-трансляции 6 ч.
Accenture сформировала подразделение NVIDIA Business Group и обучит 30 тысяч сотрудников полному стеку ИИ-технологий NVIDIA 10 ч.
Linux-вирус Perfctl заразил с 2021 года тысячи серверов и скрытно майнит на них криптовалюту 11 ч.
Началось открытое бета-тестирование браузера Arc для Android — он умеет ходить по сайтам за пользователя 13 ч.
Обновление Samsung привело к поломке смартфонов Galaxy S10 и Note 10 по всему миру 18 ч.
Минцифры опубликовало правила регистрации блогеров-десятитысячников в реестре Роскомнадзора 24 ч.
Telegram объяснил недавние сбои событиями на Ближнем Востоке 05-10 00:23
Надёжный инсайдер: ремейк Assassin’s Creed IV: Black Flag выйдет раньше, чем можно было представить 05-10 00:19