Сегодня 11 октября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → mi350

AMD представила ИИ-ускоритель Instinct MI325X для конкуренции с Nvidia Blackwell и рассказала о ещё более мощном Instinct MI355X

Компания AMD официально представила флагманский ускоритель вычислений Instinct MI325X, который станет конкурентом для Nvidia Blackwell и уже поступил в производство. Вместе с тем производитель раскрыл подробности об ускорителе следующего поколения — Instinct MI355X на архитектуре CDNA4.

 Источник изображения: AMD

Источник изображений: AMD

В последние годы AMD отмечает значительный рост спроса на свои ИИ-ускорители. При этом серия MI300 пользуется особой популярностью. Однако, как пишет издание Tom's Hardware, MI355X вызывает определённые вопросы по части брендирования, поскольку архитектура CDNA использовалась в MI100, CDNA2 — в MI200, а CDNA3 — в серии MI300. Логично было бы увидеть CDNA4 в ускорителях MI400, но они получат архитектуру следующего поколения.

 Источник изображения: AMD

Как бы от ни было, CDNA4 — это новая архитектура, которая представляет собой значительное обновление прежней CDNA3. AMD описала её как «переосмысление с нуля», хотя, по мнению экспертов, это может быть и некоторым преувеличением.

Ускоритель MI355X будет производиться по новому 3-нм техпроцессу N3 от TSMC, потребовав серьёзных изменений по сравнению с N5, но основные элементы дизайна могут остаться схожими с CDNA3. Объём памяти HBM3e достигнет 288 Гбайт. Ускоритель будет оснащён 10 вычислительными элементами на один GPU, а производительность достигнет 2,3 петафлопса вычислительной мощности для операций FP16 и 4,6 петафлопса для FP8, что на 77 % больше по сравнению с ускорителем предыдущего поколения.

 Источник изображения: AMD

Одним из ключевых нововведений MI355X станет поддержка чисел с плавающей запятой FP4 и FP6, которые удвоят вычислительную мощность по сравнению с FP8, позволив достигнуть 9,2 петафлопса производительности в FP4. Для сравнения, Nvidia Blackwell B200 предлагает до 9 Пфлопс производительности в FP4, а более мощная версия GB200 — 10 Пфлопс. Таким образом, AMD Instinct MI355X может стать серьёзным конкурентом для будущих продуктов Nvidia, в том числе благодаря 288 Гбайт памяти HBM3E — это на 50 % больше, чем у Nvidia Blackwell. При этом оба устройства будут иметь пропускную способность памяти до 8 Тбайт/с на GPU.

 Источник изображения: AMD

Как отмечают эксперты, вычислительная мощность и объём памяти — это не единственные ключевые параметры для ИИ-ускорителей. Важным фактором становится масштабируемость систем при использовании большого числа GPU. Пока AMD не раскрыла подробности о возможных изменениях в системе интерконнекта между GPU, что может оказаться важным аспектом в сравнении с Blackwell от Nvidia.

Вместе с анонсом Instinct MI355X компания AMD подтвердила, что ускоритель Instinct MI325X официально запущен в производство и поступит в продажу в этом квартале. Основным отличием MI325X от предыдущей модели MI300X стало увеличение объёма памяти со 192 до 256 Гбайт. Что интересно, изначально планировалось оснастить ускоритель 288 Гбайт памяти, но видимо AMD решили ограничиться приростом в 33 % вместо 50 %. Память HBM3E в новинке обеспечивает пропускную способность более 6 Тбайт/с, что на 13 % больше, чем 5,3 Тбайт/с у MI300X.

 Источник изображения: AMD

AMD провела сравнительный анализ производительности Instinct MI325X и Nvidia H200. Ускоритель AMD оказался на 20-40 % быстрее конкурента в запуске уже обученных больших языковых моделей, а в обучении нейросетей показал паритет производительности.

AMD не раскрыла стоимость своих ИИ-ускорителей, но представители компании заявили, что одной из целей является предоставление преимущества по совокупной стоимости владения (TCO). Это может быть достигнуто либо за счёт лучшей производительности при той же цене, либо за счёт более низкой цены при одинаковой производительности. Как отметил представитель AMD: «Мы являемся деловыми людьми и будем принимать ответственные решения относительно ценообразования». Instinct MI355X планируется к поставкам во второй половине 2025 года.

Samsung заключила контракт с AMD на поставку HBM3E на сумму $3 млрд

Успех SK hynix в качестве главного поставщика памяти типа HBM был накануне подтверждён финансовой отчётностью компании, тогда как более крупный конкурент в лице Samsung Electronics в этом сегменте рынка остаётся на вторых ролях. Впрочем, это не помешало ему заключить контракт на поставку HBM3E с компанией AMD на сумму $3 млрд.

 Источник изображения: Samsung Electronics

Источник изображения: Samsung Electronics

Об этой сделке сообщает TrendForce со ссылкой на южнокорейские СМИ. По их данным, во второй половине текущего года AMD рассчитывает выпустить ускорители вычислений Instinct MI350, и Samsung будет снабжать их своими 12-ярусными микросхемами памяти типа HBM3E. Сообщается, что сделка предполагает своего рода «бартер»: часть микросхем памяти будет обменяна на ускорители AMD. Выпускать непосредственно чипы ускорителей Instinct MI350 будет компания TSMC по 4-нм технологии. Кроме того, AMD ведёт переговоры с Samsung на тему контрактного производства своих чипов, но указанный контракт на поставку HBM3E никак к данной теме не относится.

Ещё в октябре 2023 года компания Samsung представила микросхемы HBM3E семейства Shinebolt, а в феврале текущего продемонстрировала их в 12-ярусном исполнении, позволяющем формировать в одном стеке до 36 Гбайт памяти этого типа. Массовое производство подобных чипов начнётся во второй половине 2024 года. Они в полтора раза увеличивают пропускную способность, до 1280 Гбайт/с. Высота 12-ярусных чипов за счёт использования более прогрессивной технологии упаковки остаётся на уровне 8-ярусных чипов прежнего поколения. Двенадцатиярусные стеки памяти поднимают быстродействие в задачах искусственного интеллекта на 34 % в среднем по сравнению с 8-ярусными.


window-new
Soft
Hard
Тренды 🔥
«Близок к статусу гроссмейстера»: Марк Цукерберг наиграл в Civilization больше тысячи часов и считает, что победит любого 22 мин.
Роботы-пылесосы в США начали преследовать собак и выкрикивать расистские оскорбления — это дело рук хакеров 44 мин.
Возвращение джедая: забытый экшен Star Wars Episode I: Jedi Power Battles с PS1 спустя 25 лет получит переиздание на ПК и консолях 2 ч.
Журналисты пролили свет на затаившийся в тени ремейк Splinter Cell 4 ч.
«Википедию» заполонили белиберда и фейки, сгенерированные ИИ 5 ч.
Павел Дуров рассказал, как 18 лет назад с нуля создал соцсеть «ВКонтакте» 5 ч.
Нелинейный детектив The Rise of the Golden Idol получил дату выхода и расширенную демоверсию в Steam 14 ч.
Новая компания сооснователя Blizzard анонсировала Sunderfolk — кооперативное тактическое приключение, которое воссоздаёт опыт настольных RPG 15 ч.
Selectel и Arenadata запустят аналитическую СУБД на выделенных серверах 15 ч.
Почти 30 % детей в России играют в игры, которые не подходят им по возрасту 18 ч.
Французская Федерация лифтов призывает отложить отключение в стране сетей 2G и 3G 21 мин.
Скоро в продажу поступит сверхпрочный смартфон Cubot KingKong Power 3 с динамиком на 123 дБ и батареей на 10200 мА·ч 22 мин.
Вьетнам решил стать крупным производителем чипов — страна построит шесть полупроводников заводов до 2050 года 39 мин.
Дочка «Газпрома» и «ГЛОНАСС» договорились создать конкурента Starlink 51 мин.
Квартальные поставки HDD превысили 325 Эбайт 52 мин.
Проект спутникового интернета от Amazon под угрозой срыва — запуск первых аппаратов Kuiper отложили до 2025 года 2 ч.
DPU + UEC: AMD представила 400G-адаптеры Pensando Salina и Pollara 2 ч.
Tesla показала толпу роботов Optimus — их уже научили мыть посуду, убираться и даже наливать пиво 2 ч.
Tesla внезапно представила беспилотную маршрутку Robovan 3 ч.
Tesla представила Cybercab — двухместный электромобиль без руля и педалей за $30 тысяч 3 ч.