Перейти к публикации

Сопроцессоры и GPU для вычислений


Рекомендованные сообщения

Intel Xeon Phi уже достаточно активно продается в России

С одной стороны, не дешево, от 135000 р

С другой, ценник на i7 близок... и мне вот интересно, есть ли выигрыш в скорости счета,  если сравнивать вычислительные единицы одинаковой стоимости:

а) Один ПК с такой картой б) Несколько ПК на i7 + Гиг-лан в) Один многопроцессорный сервер

 

Интересно, есть уже реальные пользователи такого девайса для CAE и в частности для CFD?

 

Память в устройстве своя, GDDR 6 Гиг всего. Т.е. оно применимо только для задач небольшой размерности? (~1млн ячеек)

Ссылка на сообщение
Поделиться на других сайтах


Intel Xeon Phi уже достаточно активно продается в России

С одной стороны, не дешево, от 135000 р

С другой, ценник на i7 близок... и мне вот интересно, есть ли выигрыш в скорости счета,  если сравнивать вычислительные единицы одинаковой стоимости:

а) Один ПК с такой картой б) Несколько ПК на i7 + Гиг-лан в) Один многопроцессорный сервер

 

Интересно, есть уже реальные пользователи такого девайса для CAE и в частности для CFD?

 

Память в устройстве своя, GDDR 6 Гиг всего. Т.е. оно применимо только для задач небольшой размерности? (~1млн ячеек)

in-house CFD код на MIC уже считают, про промышленные (коммерческие) CFD не слышал (но и особо не интересовался)

Все как обычно упирается в код. Из плюсов _теоретически_ переделка обычного MPI/OpenMP кода минимальна (обычно просто перекомпиляция)

 

Вообще же GPU будет и быстрее (за те-же деньги) и CFD коды под него уже есть и коммерческие(Fluent) и опенсорс(OpenFOAM,PyFR,HiFiLES), но переделка существующего кода под ту же CUDA сильно сложнее будет.

Ссылка на сообщение
Поделиться на других сайтах

Какова роль собственной памяти такого девайса? Правильно ли считать, что размерность задачи на неё завязана?

Ссылка на сообщение
Поделиться на других сайтах
Вообще же GPU будет и быстрее (за те-же деньги) и CFD коды под него уже есть и коммерческие(Fluent) и опенсорс(OpenFOAM,PyFR,HiFiLES), но переделка существующего кода под ту же CUDA сильно сложнее будет.

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Ссылка на сообщение
Поделиться на других сайтах

Какова роль собственной памяти такого девайса? Правильно ли считать, что размерность задачи на неё завязана?

По сути это компьютер внутри компьютера. Массив ядер MIC/GPU имеет доступ только к внутренней памяти. Данные во внутреннюю память копируются из памяти хоста и обратно.

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Ну я как бы не обсуждал :) Я просто код писал под GPU. Насчет "скорость хуже" это мягко говоря не так :) Проблема в том что приходится гонять данные между хостом и девайсом и обратно, но скорость такой перекачки вполне приличная (если не злоупотреблять). "Хуже" имеется ввиду другое. CPU выигрывает у GPU в достижении "теоретического пика производительности в %" но проигрывает по абсолютному значению если сравнивать 1 GPU vs 1 CPU

Ссылка на сообщение
Поделиться на других сайтах

Чтобы 2 раза не бегать  :smile:

 

Чем меньше сетка тем меньше выигрыш GPU (для достижения пиковых значений в GPU желательно как можно сильнее заполнять локальную память ускорителя)

post-34943-0-62307600-1456847668.png

post-34943-0-79796700-1456847760.gif

Изменено пользователем HFL
Ссылка на сообщение
Поделиться на других сайтах
  • 4 месяца спустя...

обсуждалась уже на форуме переделка под GPU

вроде как затык идет в передаче данных - идут большие потери на передачу и итоговая скорость хуже, чем на многоядерном CPU 

Тадам! Встречайте Radeon Pro SSG - всего за 10000$

http://www.ixbt.com/news/2016/07/26/3d-amd-radeon-pro-ssg-ssd.html

Производитель показал образец Radeon Pro SSG с двумя SSD накопителями Samsung 950 Pro объемом по 512 ГБ каждый.

Для повышения скорости передачи данных они были объединены в массив RAID 0. 

 

Я себе представлял это чуть по-другому - как возможность к GPU в будущем подключать доп.планки памяти, но производитель пошел другим путем...

 

Что скажут профи? Поможет ли SSD решить затык?

Ссылка на сообщение
Поделиться на других сайтах

Тадам! Встречайте Radeon Pro SSG - всего за 10000$

http://www.ixbt.com/news/2016/07/26/3d-amd-radeon-pro-ssg-ssd.html

Производитель показал образец Radeon Pro SSG с двумя SSD накопителями Samsung 950 Pro объемом по 512 ГБ каждый.

Для повышения скорости передачи данных они были объединены в массив RAID 0. 

 

Я себе представлял это чуть по-другому - как возможность к GPU в будущем подключать доп.планки памяти, но производитель пошел другим путем...

 

Что скажут профи? Поможет ли SSD решить затык?

 

 

Это очень специфичный девайс:

 

SSD имеет прямой интерфейс к GPU через PCI-E мост

 

Один из минусов это отсутствие стандарта (чтобы это заюзать нужен будет вендор-специфичный API)

 

Ну и вообще задача где требуется быстрый I/O в паре с GPU тоже весьма специфичная.

 

Например это обработка сейсмоданных в нефтянке.

Ссылка на сообщение
Поделиться на других сайтах
  • 2 месяца спустя...

Это очень специфичный девайс:

 

Вот апгрейд:

https://hi-tech.mail.ru/news/amd-dracarys/?frommail=1

 

Инсайдеры утверждают, что новая видеокарта будет построена на базе 14-нанометрового процессора Vega 10 производительностью 20 ТФЛОПС – возможно, чипов будет установлено несколько. Объем локальной видеопамяти составит 1 ТБ. При этом 16 ГБ памяти будут собраны из многослойных модулей HBM2, остальной же объем, вероятно, составят NAND-чипы.

 

Ссылка на сообщение
Поделиться на других сайтах

По моему последние Интеловские многоядерники столько же флопсов имеют, а стоимость куда ниже будет.

Ссылка на сообщение
Поделиться на других сайтах
стоимость куда ниже будет.

купил hp z800  

xeonx2 5630 2.6ггц 

2Х8гб

70 тыс рублей :) сегодня,

буду тестить и думать что и как..

думаю как лучше памити докупить или райд на ssd поставить? 

у меня 4 hdd samsung eva 850 pro.. скорость супер они в память закидывают и через нее пишут.

 

если надо такое или похожее заказывайте в личку..

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах

нет отпечатки. посмотрел еес память 8 гб стоит 1500руб в среднем на авите. но 5-6 рублей купил ssd 512 gb.

винда сбросит в вирт памТь на диск если много займет. вот и делема вирт память сделать быстрой или увеличить оперативуу. у памяти пропускная скорость 10 гб /сек  !

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах

две разнонаправленные.. первое  расчет симуляция , магнитные поля, вентиляция работа в Солиде и симулейшене.

вторая и основная-архив файлов около 1 миллиона файлов 4-10 Тб и поиск данных по ним. систему не выбрал еще .. пока Тоталом ищу данные по pdf,doc, dvj, . распознавание текстов и тд.

встал вопросс вернуть пару процов 2.6ггц и поставить один 3.2 ггц. что лучше? потом по требованию и нехватки поставить второй топовый. х5690 ,щас стоит 5640х2

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах
  • 1 месяц спустя...
В 25.10.2016 в 17:09, Maik812 сказал:

х5690

а вы не считали сколько будут потреблять електро мощности два таких проца совместно с памятью и видеокартой?

Ссылка на сообщение
Поделиться на других сайтах
В 25.10.2016 в 03:50, Maik812 сказал:

купил hp z800  

xeonx2 5630 2.6ггц 

2Х8гб

70 тыс рублей :) сегодня,

буду тестить и думать что и как..

думаю как лучше памити докупить или райд на ssd поставить? 

у меня 4 hdd samsung eva 850 pro.. скорость супер они в память закидывают и через нее пишут.

 

если надо такое или похожее заказывайте в личку..

А вот Квадры топовые по полляма стоят. Вот и думайте.

Ссылка на сообщение
Поделиться на других сайтах
12 часа назад, a_schelyaev сказал:

А вот Квадры топовые по полляма стоят. Вот и думайте

HP Z800 тоже стоит под пол лям.. смотря какой конфиг , щас райд делаю по 6 ТБ дисков купил 8 штук.(Биг дат по науки и техники делать буду) Чем данные накрыть и какую систему ставить?!   Как покупать или у кого от этого цена.

На ебее или авите Nvideo K2  65тыс рублей, а так 200-300 тыс. И главное так как поддерживает софт эти GPU ?

Изменено пользователем Maik812
Ссылка на сообщение
Поделиться на других сайтах
12 часа назад, Maik812 сказал:

HP Z800 тоже стоит под пол лям.. смотря какой конфиг , щас райд делаю по 6 ТБ дисков купил 8 штук.(Биг дат по науки и техники делать буду) Чем данные накрыть и какую систему ставить?!   Как покупать или у кого от этого цена.

На ебее или авите Nvideo K2  65тыс рублей, а так 200-300 тыс. И главное так как поддерживает софт эти GPU ?

 

Вам чтобы Квадрик поставить по любому нужно иметь обвязку - ЦП, мать, жесткий диск. Если РЗЯ800 без топового квадрика много стоит, то с ним он будет стоить еще больше. А рельный выхлоп?

Ссылка на сообщение
Поделиться на других сайтах

Присоединяйтесь к обсуждению

Вы можете опубликовать сообщение сейчас, а зарегистрироваться позже. Если у вас есть аккаунт, войдите в него для написания от своего имени.
Примечание: вашему сообщению потребуется утверждение модератора, прежде чем оно станет доступным.

Гость
Ответить в тему...

×   Вставлено в виде отформатированного текста.   Вставить в виде обычного текста

  Разрешено не более 75 эмодзи.

×   Ваша ссылка была автоматически встроена.   Отобразить как ссылку

×   Ваш предыдущий контент был восстановлен.   Очистить редактор

×   Вы не можете вставить изображения напрямую. Загрузите или вставьте изображения по ссылке.

  • Сейчас на странице   0 пользователей

    Нет пользователей, просматривающих эту страницу.




  • Сообщения

    • Алексей 1977
      Кто знает подскажите как отключить этот ненужный набор букв и символов в готовой УП? Я так думаю надо редактировать постпроцессор? Заранее спасибо ( Общая длина: 130.0) ( Заготовка:) ( MIN X: -10.970) ( MIN Y: -10.970) ( MIN Z: -6.500) ( MAX X: 10.970) ( MAX Y: 10.970) ( MAX Z: 0.000) ( COORDINATE SYSTEM: Глобальная СК) ( Кончик инструмента:) (   X: -0.000) (   Y: 0.000) (   Z: 10.000) ( Рекомендованная длина: 50.000) ( Количество кромок: 4) ( Инструмент:   Концевая фреза) ( DIAMETER: 10.000) ( Безопасность:) ( Рабочие ходы инструмента: Безопасная БЕЗ зарезов) ( Подводы инструмента: Безопасная БЕЗ зарезов) ( Переходы инструмента: Безопасная БЕЗ зарезов) ( Рабочие ходы патрона: Столкновения НЕ проверялись) ( Подводы патрона: Столкновения НЕ проверялись) ( Переходы патрона: Столкновения НЕ проверялись) ( Траектория: Шаблон) ( STEPOVER: 5.000) ( ДОПУСК:0.100) ( THICKNESS:0.000) ( Статистика:) ( LENGTH: 95.318)( LIFTS: ( TIME: 0/00/05) 1) G0X0Y0 G43Z10.H13 X4.75Y-8.227 Z5. G1Z0F500 X9.5Y-5.485F1000 Y5.485 X0Y10.97 X-9.5Y5.485 Y-5.485 X0Y-10.97 X4.75Y-8.227 G0Z10.
    • gudstartup
      считывание происходит при помощи вх\вых сигналов контроллера plc 
    • gudstartup
      @Maks Horhe так все таки скиньте бэкап эмулируем ваше чпу в cncguide и посмотрим куда поедет?  можете снять видео с фиксацией координатных позиций после каждого кадра. Выложу вашу программу пусть программисты посмотрят все ли в ней ок. %O0002 G40 G17 G94 G90 G49 G80 N1 G91 G28 Z0.0 N2 G91 G28 X0.0 Y0.0 N3 G91 G28 B0.0 C0.0 N4 M03 S200 N5 G90 G0 G53 B0.0 C0.0 N6 G54 N7 X0.0 Y0.0 N8 G90 G43 H01 N9 G90 G0 X0.0 Y0.0 N10 G90 G0 Z200.0 N11 G01 Z10.0 F1500. N12 M00 N13 G00 Z200.0 N14 G40 G49 G69 N15 G00 G53 Z0.0 N16 G00 G54 B0.0 C0.0 N17 G68.2 X0.0 Y0.0 Z0.0 1135. J39.2044 K-129.2315 N18 G53.1 N19 G01 X0.0 Y0.0 F1500 N20 G90 G43 H01 N21 G90 G01 X0.0 Y0.0 F1500 N22 G90 G01 Z200. F1500 N24 M00 N25 G00 Z200. N26 G40 G49 G69 N27 G91 G28 Z0.0 N28 G28 X0.0 Y0.0 N29 G91 G28 B0.0 C0.0 N30 M5 N31 M30
    • gudstartup
      @karlf 530 считывает ключ по специальному протоколу при помощи plc и получает его серийный номер а из него определяет возможные режимы доступа. там нет драйвера а есть plc модуль или несколько эти модули написаны на питоне  надпись smartkey исчезает с экрана при запуске чпу??
    • ДОБРЯК
      Для того, чтобы получить правильные высшие) формы при виртуальном эксперименте, нужно сделать грамотную КЭ модель. От разговора на эту тему вы постоянно уклоняетесь.  То нет компьютера под рукой, сделать простейший тест, то теряете интерес. :=) Сходимости энергии деформации при расчетах статики, недостаточно для точного определения высших собственных форм и частот.  Для того, чтобы грамотно использовать метод конечных элементов, нужно сделать много-много тестов в статике, динамике и ... Одной кнопки и двух конечных элементов в 3Д программе недостаточно для определения высших собственных форм...  У вас в качестве инструмента всего два конечных элемента, шести узловая несовместная оболочка Тимошенко и десяти узловой тетраэдр. И еще контакты при решении задачи на собственные числа. Вам ли говорить про правильность определения высших собственных форм для сложных изделий... :=)    
    • vad0000
      Покажите схему с разрешением на движение
    • vad0000
      Вход, а не выход Вытащить Аналоговый вход и все, как будто туда ничего не подключено И если мы подключим сигнал к энкодеру оси Х, то он стнтет одинаковый с аналоговым входом, который не подключен?
    • Snake 60
      @waze4534  Посмотрите вверх и прочитайте текст на красной полоске...
    • kkk
      Я так понимаю, что предупреждение про "касательные" не просто так выскакивает. Если скруглить прямую стыковку отрезков эскиза (минимальным радиусом) то все работает даже без объединенной кривой, достаточно эскиза.
    • karlf
      Подскажите пожалуйста, может кто сталкивался. Станок DMU-50 на стойке TNC 530, перестал определяться ключ доступа. Сам ключ вроде работает, если переключать на нём режимы, то в шкафу на соответствующих блоках лампочки тоже переключаются. Но изначально был уровень доступа 4, а теперь уровни доступа не активны. Ключ только один, запасных нет. Есть какой-то старый бэкап, пробовал его накатить, но какой-то он непонятный - станок грузится, но почти в конце загрузки выдаёт какую-то ошибку по параметрам. Может кто знает в каком из разделов и в какой папке искать установленные драйверы ключа?
×
×
  • Создать...