Сегодня 11 октября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → mi350

AMD представила ИИ-ускоритель Instinct MI325X для конкуренции с Nvidia Blackwell и рассказала о ещё более мощном Instinct MI355X

Компания AMD официально представила флагманский ускоритель вычислений Instinct MI325X, который станет конкурентом для Nvidia Blackwell и уже поступил в производство. Вместе с тем производитель раскрыл подробности об ускорителе следующего поколения — Instinct MI355X на архитектуре CDNA4.

 Источник изображения: AMD

Источник изображений: AMD

В последние годы AMD отмечает значительный рост спроса на свои ИИ-ускорители. При этом серия MI300 пользуется особой популярностью. Однако, как пишет издание Tom's Hardware, MI355X вызывает определённые вопросы по части брендирования, поскольку архитектура CDNA использовалась в MI100, CDNA2 — в MI200, а CDNA3 — в серии MI300. Логично было бы увидеть CDNA4 в ускорителях MI400, но они получат архитектуру следующего поколения.

 Источник изображения: AMD

Как бы от ни было, CDNA4 — это новая архитектура, которая представляет собой значительное обновление прежней CDNA3. AMD описала её как «переосмысление с нуля», хотя, по мнению экспертов, это может быть и некоторым преувеличением.

Ускоритель MI355X будет производиться по новому 3-нм техпроцессу N3 от TSMC, потребовав серьёзных изменений по сравнению с N5, но основные элементы дизайна могут остаться схожими с CDNA3. Объём памяти HBM3e достигнет 288 Гбайт. Ускоритель будет оснащён 10 вычислительными элементами на один GPU, а производительность достигнет 2,3 петафлопса вычислительной мощности для операций FP16 и 4,6 петафлопса для FP8, что на 77 % больше по сравнению с ускорителем предыдущего поколения.

 Источник изображения: AMD

Одним из ключевых нововведений MI355X станет поддержка чисел с плавающей запятой FP4 и FP6, которые удвоят вычислительную мощность по сравнению с FP8, позволив достигнуть 9,2 петафлопса производительности в FP4. Для сравнения, Nvidia Blackwell B200 предлагает до 9 Пфлопс производительности в FP4, а более мощная версия GB200 — 10 Пфлопс. Таким образом, AMD Instinct MI355X может стать серьёзным конкурентом для будущих продуктов Nvidia, в том числе благодаря 288 Гбайт памяти HBM3E — это на 50 % больше, чем у Nvidia Blackwell. При этом оба устройства будут иметь пропускную способность памяти до 8 Тбайт/с на GPU.

 Источник изображения: AMD

Как отмечают эксперты, вычислительная мощность и объём памяти — это не единственные ключевые параметры для ИИ-ускорителей. Важным фактором становится масштабируемость систем при использовании большого числа GPU. Пока AMD не раскрыла подробности о возможных изменениях в системе интерконнекта между GPU, что может оказаться важным аспектом в сравнении с Blackwell от Nvidia.

Вместе с анонсом Instinct MI355X компания AMD подтвердила, что ускоритель Instinct MI325X официально запущен в производство и поступит в продажу в этом квартале. Основным отличием MI325X от предыдущей модели MI300X стало увеличение объёма памяти со 192 до 256 Гбайт. Что интересно, изначально планировалось оснастить ускоритель 288 Гбайт памяти, но видимо AMD решили ограничиться приростом в 33 % вместо 50 %. Память HBM3E в новинке обеспечивает пропускную способность более 6 Тбайт/с, что на 13 % больше, чем 5,3 Тбайт/с у MI300X.

 Источник изображения: AMD

AMD провела сравнительный анализ производительности Instinct MI325X и Nvidia H200. Ускоритель AMD оказался на 20-40 % быстрее конкурента в запуске уже обученных больших языковых моделей, а в обучении нейросетей показал паритет производительности.

AMD не раскрыла стоимость своих ИИ-ускорителей, но представители компании заявили, что одной из целей является предоставление преимущества по совокупной стоимости владения (TCO). Это может быть достигнуто либо за счёт лучшей производительности при той же цене, либо за счёт более низкой цены при одинаковой производительности. Как отметил представитель AMD: «Мы являемся деловыми людьми и будем принимать ответственные решения относительно ценообразования». Instinct MI355X планируется к поставкам во второй половине 2025 года.

Samsung заключила контракт с AMD на поставку HBM3E на сумму $3 млрд

Успех SK hynix в качестве главного поставщика памяти типа HBM был накануне подтверждён финансовой отчётностью компании, тогда как более крупный конкурент в лице Samsung Electronics в этом сегменте рынка остаётся на вторых ролях. Впрочем, это не помешало ему заключить контракт на поставку HBM3E с компанией AMD на сумму $3 млрд.

 Источник изображения: Samsung Electronics

Источник изображения: Samsung Electronics

Об этой сделке сообщает TrendForce со ссылкой на южнокорейские СМИ. По их данным, во второй половине текущего года AMD рассчитывает выпустить ускорители вычислений Instinct MI350, и Samsung будет снабжать их своими 12-ярусными микросхемами памяти типа HBM3E. Сообщается, что сделка предполагает своего рода «бартер»: часть микросхем памяти будет обменяна на ускорители AMD. Выпускать непосредственно чипы ускорителей Instinct MI350 будет компания TSMC по 4-нм технологии. Кроме того, AMD ведёт переговоры с Samsung на тему контрактного производства своих чипов, но указанный контракт на поставку HBM3E никак к данной теме не относится.

Ещё в октябре 2023 года компания Samsung представила микросхемы HBM3E семейства Shinebolt, а в феврале текущего продемонстрировала их в 12-ярусном исполнении, позволяющем формировать в одном стеке до 36 Гбайт памяти этого типа. Массовое производство подобных чипов начнётся во второй половине 2024 года. Они в полтора раза увеличивают пропускную способность, до 1280 Гбайт/с. Высота 12-ярусных чипов за счёт использования более прогрессивной технологии упаковки остаётся на уровне 8-ярусных чипов прежнего поколения. Двенадцатиярусные стеки памяти поднимают быстродействие в задачах искусственного интеллекта на 34 % в среднем по сравнению с 8-ярусными.


window-new
Soft
Hard
Тренды 🔥
Студия-разработчик игр «Мир танков», «Мир кораблей» и Tanks Blitz вновь стала полностью российской 5 мин.
Microsoft скоро начнёт продавать игры через приложение Xbox на Android 2 ч.
Google поборется за контроль над Android — компания обжалует вердикт по делу Epic Games 2 ч.
Google начал показывать полные рецепты блюд прямо в результатах поиска 2 ч.
«Близок к статусу гроссмейстера»: Марк Цукерберг наиграл в Civilization больше тысячи часов и считает, что победит любого 3 ч.
Возвращение джедая: забытый экшен Star Wars Episode I: Jedi Power Battles с PS1 спустя 25 лет получит переиздание на ПК и консолях 4 ч.
Журналисты пролили свет на затаившийся в тени ремейк Splinter Cell 6 ч.
«Википедию» заполонили белиберда и фейки, сгенерированные ИИ 7 ч.
Павел Дуров рассказал, как 18 лет назад с нуля создал соцсеть «ВКонтакте» 7 ч.
Нелинейный детектив The Rise of the Golden Idol получил дату выхода и расширенную демоверсию в Steam 16 ч.
AMD пообещала ускорить ИИ-кластеры до шести раз с первой в мире сетевой картой Ultra Ethernet 2 ч.
Астрономы засекли 55 убегающих звёзд в окрестностях нашей галактики — такие объекты сильно влияют на эволюцию Вселенной 2 ч.
Французская Федерация лифтов призывает отложить отключение в стране сетей 2G и 3G 3 ч.
Скоро в продажу поступит сверхпрочный смартфон Cubot KingKong Power 3 с динамиком на 123 дБ и батареей на 10200 мА·ч 3 ч.
Вьетнам решил стать крупным производителем чипов — страна построит шесть полупроводников заводов до 2050 года 3 ч.
Роботы-пылесосы в США начали преследовать собак и выкрикивать расистские оскорбления — это дело рук хакеров 3 ч.
Дочка «Газпрома» и «ГЛОНАСС» договорились создать конкурента Starlink 3 ч.
Квартальные поставки HDD превысили 325 Эбайт 3 ч.
Проект спутникового интернета от Amazon под угрозой срыва — запуск первых аппаратов Kuiper отложили до 2025 года 4 ч.
DPU + UEC: AMD представила 400G-адаптеры Pensando Salina и Pollara 4 ч.