Сегодня 26 декабря 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Аппаратные требования больших языковых моделей ИИ сокращаются вдвое каждые восемь месяцев

Большие языковые модели, лежащие в основе чат-ботов с искусственным интеллектом, развиваются настолько быстро, что всего за восемь месяцев необходимые им для работы аппаратные ресурсы сокращаются вдвое — сами чипы демонстрируют намного более скромный прогресс.

 Источник изображения: Gerd Altmann / pixabay.com

Источник изображения: Gerd Altmann / pixabay.com

Существуют два способа повысить производительность систем ИИ, обращает внимание исследователь из Массачусетского технологического института Тамай Бесироглу (Tamay Besiroglu): увеличить размеры больших языковых моделей, что потребует соразмерного увеличения вычислительной мощности, хотя оборудование для ИИ сегодня находится в дефиците; или оптимизировать базовые алгоритмы, чтобы более эффективно применять существующее оборудование. Похоже, нынешние разработчики больших языковых моделей предпочли второй подход.

Учёные проанализировали показатели производительности 231 большой языковой модели, разработанных в период с 2012 по 2023 гг., и обнаружили, что вычислительная мощность, необходимая для их работы, сокращалась в среднем вдвое каждые восемь месяцев. Это значительно быстрее, чем предполагает эмпирический закон Мура, согласно которому число транзисторов на кристалле (мера его производительности) удваивается каждые 18–24 месяца. Исследователи отмечают, что такой рост производительности систем ИИ отчасти связан с оптимизацией кода, хотя точно определить это не получается, потому что алгоритмы ИИ часто не поддаются анализу. Свою роль, конечно, сыграло и развитие аппаратных компонентов.

Разница в темпах развития является показателем того, насколько эффективно разработчики больших языковых моделей используют доступные им ресурсы. Бесконечно оптимизировать алгоритмы не получится, считает Бесироглу, и нет ясности, сохранится ли такой темп развития в долгосрочной перспективе. Существуют и опасения, что повышение эффективности моделей может, напротив, увеличить потребление энергии отраслью ИИ, поэтому нельзя заниматься только одним аспектом, игнорируя остальные, предостерегают учёные.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Платформер Restitched отправит исследовать и создавать красочные миры — геймплейный трейлер духовного наследника LittleBigPlanet 4 мин.
Apple объяснила, почему не хочет создавать собственный поисковик на замену Google 35 мин.
«Не думаю, что Nintendo это стерпит, но я очень рад»: разработчик Star Fox 64 одобрил фанатский порт культовой игры на ПК 11 ч.
Корейцы натравят ИИ на пиратские кинотеатры по всему миру 12 ч.
В Epic Games Store стартовала новая раздача Control — для тех, кто дважды не успел забрать в 2021 году 15 ч.
За 2024 год в Steam вышло на 30 % больше игр, чем за прошлый — это новый рекорд 16 ч.
«Яндекс» закрыл почти все международные стартапы в сфере ИИ 16 ч.
Создатели Escape from Tarkov приступили к тестированию временного решения проблем с подключением у игроков из России — некоторым уже помогло 17 ч.
Веб-поиск ChatGPT оказался беззащитен перед манипуляциями и обманом 18 ч.
Инвесторы готовы потратить $60 млрд на развитие ИИ в Юго-Восточной Азии, но местным стартапам достанутся крохи от общего пирога 19 ч.
Во флагманских смартфонах Huawei Mate 70 нашли память SK hynix, которой там быть не должно 49 мин.
Чтобы решить проблемы с выпуском HBM, компания Samsung занялась перестройкой цепочек поставок материалов и оборудования 4 ч.
Новая статья: Обзор и тест материнской платы Colorful iGame Z790D5 Ultra V20 9 ч.
Новая статья: NGFW по-русски: знакомство с межсетевым экраном UserGate C150 11 ч.
Криптоиндустрия замерла в ожидании от Трампа выполнения предвыборных обещаний 11 ч.
Открыт метастабильный материал для будущих систем хранения данных — он меняет магнитные свойства под действием света 13 ч.
Новый год россияне встретят под «чёрной» Луной — эзотерика ни при чём 16 ч.
ASRock выпустит 14 моделей Socket AM5-материнских плат на чипсете AMD B850 16 ч.
Опубликованы снимки печатной платы Nvidia GeForce RTX 5090 с большим чипом GB202 18 ч.
От дна океана до космоса: проект НАТО HEIST занялся созданием резервного космического интернета 18 ч.