Перейти к публикации

Сопроцессоры и GPU для вычислений


Рекомендованные сообщения

Intel Xeon Phi уже достаточно активно продается в России

С одной стороны, не дешево, от 135000 р

С другой, ценник на i7 близок... и мне вот интересно, есть ли выигрыш в скорости счета,  если сравнивать вычислительные единицы одинаковой стоимости:

а) Один ПК с такой картой б) Несколько ПК на i7 + Гиг-лан в) Один многопроцессорный сервер

 

Интересно, есть уже реальные пользователи такого девайса для CAE и в частности для CFD?

 

Память в устройстве своя, GDDR 6 Гиг всего. Т.е. оно применимо только для задач небольшой размерности? (~1млн ячеек)

Ссылка на сообщение
Поделиться на других сайтах


Intel Xeon Phi уже достаточно активно продается в России

С одной стороны, не дешево, от 135000 р

С другой, ценник на i7 близок... и мне вот интересно, есть ли выигрыш в скорости счета,  если сравнивать вычислительные единицы одинаковой стоимости:

а) Один ПК с такой картой б) Несколько ПК на i7 + Гиг-лан в) Один многопроцессорный сервер

 

Интересно, есть уже реальные пользователи такого девайса для CAE и в частности для CFD?

 

Память в устройстве своя, GDDR 6 Гиг всего. Т.е. оно применимо только для задач небольшой размерности? (~1млн ячеек)

in-house CFD код на MIC уже считают, про промышленные (коммерческие) CFD не слышал (но и особо не интересовался)

Все как обычно упирается в код. Из плюсов _теоретически_ переделка обычного MPI/OpenMP кода минимальна (обычно просто перекомпиляция)

 

Вообще же GPU будет и быстрее (за те-же деньги) и CFD коды под него уже есть и коммерческие(Fluent) и опенсорс(OpenFOAM,PyFR,HiFiLES), но переделка существующего кода под ту же CUDA сильно сложнее будет.

Ссылка на сообщение
Поделиться на других сайтах

Какова роль собственной памяти такого девайса? Правильно ли считать, что размерность задачи на неё завязана?

Ссылка на сообщение
Поделиться на других сайтах
Вообще же GPU будет и быстрее (за те-же деньги) и CFD коды под него уже есть и коммерческие(Fluent) и опенсорс(OpenFOAM,PyFR,HiFiLES), но переделка существующего кода под ту же CUDA сильно сложнее будет.

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Ссылка на сообщение
Поделиться на других сайтах

Какова роль собственной памяти такого девайса? Правильно ли считать, что размерность задачи на неё завязана?

По сути это компьютер внутри компьютера. Массив ядер MIC/GPU имеет доступ только к внутренней памяти. Данные во внутреннюю память копируются из памяти хоста и обратно.

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Ну я как бы не обсуждал :) Я просто код писал под GPU. Насчет "скорость хуже" это мягко говоря не так :) Проблема в том что приходится гонять данные между хостом и девайсом и обратно, но скорость такой перекачки вполне приличная (если не злоупотреблять). "Хуже" имеется ввиду другое. CPU выигрывает у GPU в достижении "теоретического пика производительности в %" но проигрывает по абсолютному значению если сравнивать 1 GPU vs 1 CPU

Ссылка на сообщение
Поделиться на других сайтах

Чтобы 2 раза не бегать  :smile:

 

Чем меньше сетка тем меньше выигрыш GPU (для достижения пиковых значений в GPU желательно как можно сильнее заполнять локальную память ускорителя)

post-34943-0-62307600-1456847668.png

post-34943-0-79796700-1456847760.gif

Изменено пользователем HFL
Ссылка на сообщение
Поделиться на других сайтах
  • 4 месяца спустя...

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Тадам! Встречайте Radeon Pro SSG - всего за 10000$

http://www.ixbt.com/news/2016/07/26/3d-amd-radeon-pro-ssg-ssd.html

Производитель показал образец Radeon Pro SSG с двумя SSD накопителями Samsung 950 Pro объемом по 512 ГБ каждый.

Для повышения скорости передачи данных они были объединены в массив RAID 0. 

 

Я себе представлял это чуть по-другому - как возможность к GPU в будущем подключать доп.планки памяти, но производитель пошел другим путем...

 

Что скажут профи? Поможет ли SSD решить затык?

Ссылка на сообщение
Поделиться на других сайтах

Тадам! Встречайте Radeon Pro SSG - всего за 10000$

http://www.ixbt.com/news/2016/07/26/3d-amd-radeon-pro-ssg-ssd.html

Производитель показал образец Radeon Pro SSG с двумя SSD накопителями Samsung 950 Pro объемом по 512 ГБ каждый.

Для повышения скорости передачи данных они были объединены в массив RAID 0. 

 

Я себе представлял это чуть по-другому - как возможность к GPU в будущем подключать доп.планки памяти, но производитель пошел другим путем...

 

Что скажут профи? Поможет ли SSD решить затык?

 

 

Это очень специфичный девайс:

 

SSD имеет прямой интерфейс к GPU через PCI-E мост

 

Один из минусов это отсутствие стандарта (чтобы это заюзать нужен будет вендор-специфичный API)

 

Ну и вообще задача где требуется быстрый I/O в паре с GPU тоже весьма специфичная.

 

Например это обработка сейсмоданных в нефтянке.

Ссылка на сообщение
Поделиться на других сайтах
  • 2 месяца спустя...

Это очень специфичный девайс:

 

Вот апгрейд:

https://hi-tech.mail.ru/news/amd-dracarys/?frommail=1

 

Инсайдеры утверждают, что новая видеокарта будет построена на базе 14-нанометрового процессора Vega 10 производительностью 20 ТФЛОПС – возможно, чипов будет установлено несколько. Объем локальной видеопамяти составит 1 ТБ. При этом 16 ГБ памяти будут собраны из многослойных модулей HBM2, остальной же объем, вероятно, составят NAND-чипы.

 

Ссылка на сообщение
Поделиться на других сайтах

По моему последние Интеловские многоядерники столько же флопсов имеют, а стоимость куда ниже будет.

Ссылка на сообщение
Поделиться на других сайтах
стоимость куда ниже будет.

купил hp z800  

xeonx2 5630 2.6ггц 

2Х8гб

70 тыс рублей :) сегодня,

буду тестить и думать что и как..

думаю как лучше памити докупить или райд на ssd поставить? 

у меня 4 hdd samsung eva 850 pro.. скорость супер они в память закидывают и через нее пишут.

 

если надо такое или похожее заказывайте в личку..

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах

нет отпечатки. посмотрел еес память 8 гб стоит 1500руб в среднем на авите. но 5-6 рублей купил ssd 512 gb.

винда сбросит в вирт памТь на диск если много займет. вот и делема вирт память сделать быстрой или увеличить оперативуу. у памяти пропускная скорость 10 гб /сек  !

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах

две разнонаправленные.. первое  расчет симуляция , магнитные поля, вентиляция работа в Солиде и симулейшене.

вторая и основная-архив файлов около 1 миллиона файлов 4-10 Тб и поиск данных по ним. систему не выбрал еще .. пока Тоталом ищу данные по pdf,doc, dvj, . распознавание текстов и тд.

встал вопросс вернуть пару процов 2.6ггц и поставить один 3.2 ггц. что лучше? потом по требованию и нехватки поставить второй топовый. х5690 ,щас стоит 5640х2

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах
  • 1 месяц спустя...
В 25.10.2016 в 17:09, Maik812 сказал:

х5690

а вы не считали сколько будут потреблять електро мощности два таких проца совместно с памятью и видеокартой?

Ссылка на сообщение
Поделиться на других сайтах
В 25.10.2016 в 03:50, Maik812 сказал:

купил hp z800  

xeonx2 5630 2.6ггц 

2Х8гб

70 тыс рублей :) сегодня,

буду тестить и думать что и как..

думаю как лучше памити докупить или райд на ssd поставить? 

у меня 4 hdd samsung eva 850 pro.. скорость супер они в память закидывают и через нее пишут.

 

если надо такое или похожее заказывайте в личку..

А вот Квадры топовые по полляма стоят. Вот и думайте.

Ссылка на сообщение
Поделиться на других сайтах
12 часа назад, a_schelyaev сказал:

А вот Квадры топовые по полляма стоят. Вот и думайте

HP Z800 тоже стоит под пол лям.. смотря какой конфиг , щас райд делаю по 6 ТБ дисков купил 8 штук.(Биг дат по науки и техники делать буду) Чем данные накрыть и какую систему ставить?!   Как покупать или у кого от этого цена.

На ебее или авите Nvideo K2  65тыс рублей, а так 200-300 тыс. И главное так как поддерживает софт эти GPU ?

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах
12 часа назад, Maik812 сказал:

HP Z800 тоже стоит под пол лям.. смотря какой конфиг , щас райд делаю по 6 ТБ дисков купил 8 штук.(Биг дат по науки и техники делать буду) Чем данные накрыть и какую систему ставить?!   Как покупать или у кого от этого цена.

На ебее или авите Nvideo K2  65тыс рублей, а так 200-300 тыс. И главное так как поддерживает софт эти GPU ?

 

Вам чтобы Квадрик поставить по любому нужно иметь обвязку - ЦП, мать, жесткий диск. Если РЗЯ800 без топового квадрика много стоит, то с ним он будет стоить еще больше. А рельный выхлоп?

Ссылка на сообщение
Поделиться на других сайтах

Присоединяйтесь к обсуждению

Вы можете опубликовать сообщение сейчас, а зарегистрироваться позже. Если у вас есть аккаунт, войдите в него для написания от своего имени.
Примечание: вашему сообщению потребуется утверждение модератора, прежде чем оно станет доступным.

Гость
Ответить в тему...

×   Вставлено в виде отформатированного текста.   Вставить в виде обычного текста

  Разрешено не более 75 эмодзи.

×   Ваша ссылка была автоматически встроена.   Отобразить как ссылку

×   Ваш предыдущий контент был восстановлен.   Очистить редактор

×   Вы не можете вставить изображения напрямую. Загрузите или вставьте изображения по ссылке.

  • Сейчас на странице   0 пользователей

    Нет пользователей, просматривающих эту страницу.




  • Сообщения

    • gudstartup
      текнология это вам не группа из 90-х
    • Клиент
      @Viktor2004 , почему второй станок делает лучше можно разбираться. Но здесь реально большой вылет фрезы, слышно как звенит. Может быть, стоит с оборотами поиграть (уменьшить или увеличить. Может быть нагрузку (съём) на фрезу больше дать. Режимы явно нетехнологичны. Судя по всему серия, над технологией поработать нужно, поставьте такую фрезу, она не дорогая:  
    • gudstartup
      @Viktor2004 вопросы к технологам при такой обработке рябь обеспечена это сильно сказано прям таки зеркало? да и ряби на фото не видно @Viktor2004 это вы рябью называете это какое-то дробление материала а не рябь притом только сверху вижу поставите это зеркало на ваш с рябью и сделайте небольшой съем и посмотрите чего зарябит и вообще чего нельзя стол повернуть и фаску продольно снять что за дикий метод
    • Viktor2004
      мне в пример приводят соседний станок. Там все то же самое, такой же вылет, такие же режимы. Но там дает зеркало
    • Leksunkin
      Вылет великоват, сделать припуск поменьше на фаску, как вариант пройти предварительно ступеньками предыдущим инструментом. Фреза похожа на сферическую, если да то лучше по кругу послойно закатать. Станок не виноват.
    • gudstartup
      ну пока еще мы вам никак не помогли но возможно удастся после изучения бэкапа
    • Viktor2004
      Товарищи, подскажите пожалуйста что можно поднастроить При снятии фаски получается рябь. SERVO ERROR в пределах 5 микрон Series31i Model B   VID_20240420_145644.mp4 CNCIDNUM.TXT CNC-PARA.TXT
    • Maik812
      все работает.. привязывать правильно нужно.
    • maxx2000
      @Павлуха так и я о том же.
    • Bot
      Продукт предназначен для работы с графиками и эффективного контроля сроков как проектных, так и строительных работ. Новое решение станет важным дополнением экосистемы Sarex, расширяющим возможности управления проектами в областях гражданского и промышленного строительства. Регистрация на трансляцию запуска продукта Платформа Sarex — комплексное решение для цифровизации строительных проектов. В ее составе — цифровой мониторинг, предназначенный для контроля и анализа происходящих на строительной площадке процессов, а также среда общих данных для совместной работы над проектами архитекторов, проектировщиков, инженеров и строителей. Новое решение дополняет платформу, позволяя специалистам работать с четвертым измерением, интегрируя в свои проекты планы и графики. График — основная сущность в строительстве, которая часто понимается и используется по-разному для разных задач, а его соответствие факту контролируется неочевидными способами. Sarex решили облегчить [...] View the full article
×
×
  • Создать...