<?xml version='1.0' encoding="utf-8"?>
      <rss version='2.0'>
      <channel>
      <title>Форум на Исходниках.RU</title>
      <link>https://forum.sources.ru</link>
      <description>Форум на Исходниках.RU</description>
      <generator>Форум на Исходниках.RU</generator>
  	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818608</guid>
        <pubDate>Fri, 17 Jan 2020 08:17:52 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818608</link>
        <description><![CDATA[JoeUser: <strong class='tag-b'>Pavia</strong>, еще раз - пасиба за инфу&#33; Бум разбираться.]]></description>
        <author>JoeUser</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818568</guid>
        <pubDate>Fri, 17 Jan 2020 04:22:04 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818568</link>
        <description><![CDATA[Pavia: <div class='tag-code'><span class='pre_code'></span><div class='code  code_collapsed ' title='Подсветка синтаксиса доступна зарегистрированным участникам Форума.' style=''><div><div><ol type="1"><div class="code_line">&nbsp;// OpenCL Kernel Function for element by element vector addition</div><div class="code_line">__kernel void VectorAdd(__global const float* a, __global const float* b, __global float* c, int iNumElements)</div><div class="code_line">{</div><div class="code_line">&nbsp;&nbsp; &nbsp;// get index into global data array</div><div class="code_line">&nbsp;&nbsp; &nbsp;int iGID = get_global_id(0);</div><div class="code_line">&nbsp;&nbsp; &nbsp;// bound check (equivalent to the limit on a &#39;for&#39; loop for standard/serial C code</div><div class="code_line">&nbsp;&nbsp; &nbsp;if (iGID &#62;= iNumElements) &nbsp;{return;} &nbsp; &nbsp;</div><div class="code_line">&nbsp;&nbsp; &nbsp;// add the vector elements</div><div class="code_line">&nbsp;&nbsp; &nbsp;c[iGID] = a[iGID] + b[iGID];</div><div class="code_line">}</div></ol></div></div></div></div><script>preloadCodeButtons('1');</script><br>
На форуме подсветки синтаксиса ocl нету поэтому поставил cpp.<br>
<br>
Что-бы этот код заработал его и данные нужно загрузить в GPU пример загрузки oclVectorAdd.cpp лежит на на git&#39;е, так как там много строк тут не привожу.]]></description>
        <author>Pavia</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818567</guid>
        <pubDate>Fri, 17 Jan 2020 04:15:21 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818567</link>
        <description><![CDATA[Pavia: Если у Вас видеокарта AMD то ставите APP SDK 3 <a class='tag-url' href='https://community.amd.com/thread/220978' target='_blank'>https://community.amd.com/thread/220978</a><br>
Если у Вас видеокарта NVidia то ставите CUDA Toolkit  <a class='tag-url' href='https://developer.nvidia.com/cuda-downloads' target='_blank'>https://developer.nvidia.com/cuda-downloads</a><br>
<br>
Примеры лучше брать у NVidia. <br>
<br>
Вот вам сложение векторов это как раз Ваш GPU-Хело-Ворлд<br>
<a class='tag-url' href='https://github.com/sschaetz/nvidia-opencl-examples/tree/master/OpenCL/src/oclVectorAdd' target='_blank'>https://github.com/sschaetz/nvidia-opencl-e...rc/oclVectorAdd</a>]]></description>
        <author>Pavia</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818517</guid>
        <pubDate>Thu, 16 Jan 2020 17:23:18 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818517</link>
        <description><![CDATA[JoeUser: <strong class='tag-b'>Pavia</strong>, кросава&#33;<br>
<br>
А теперь прошу привести исходный текст для примера. Типа GPU-Хело-Ворлд :) Просто для ознакомления.]]></description>
        <author>JoeUser</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818496</guid>
        <pubDate>Thu, 16 Jan 2020 15:13:35 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818496</link>
        <description><![CDATA[Pavia: АЛУ - блок непосредственно занимающийся вычислениями: сложениями, умножениями, сдвигами, булевыми операциями и др.<br>В ГПУ колличество блоков АЛУ больше чем в ЦПУ. Причём кратно больше 2, 4, 8, 16, 32 раза. <br>За счёт этого прирост в скорости. Он за секунду делает больше операций. Минус больше энергопотребление. Средний ЦПУ 75-150 средний ГПУ 75-450 кВт. Тут разница в 5 рааз.<br><br>А далее частные ускорения. Одно время NVidia лидировала на числах Double что нужно для научных рассчётов. Сейчас напротив для ИИ чем числа меньше тем быстрее. переход от single к Half Single. даёт 5 кратный прирост скорости. <br><br>Совмещение умножения со сложение в одной команде MulAdd, в ЦПУ добавили чуть позже чем в ГПУ поэтому  ATI-AMD ГПУ был быстрее конкурентов.<br><br>Первые GpGPU занимались решением матричных уравнений ещё 2000 них годах.. ЦПУ&#39;шная библиотека BLAS была переписана на Cuda получилась cuBlas. А так же БПФ (cuFFT)- это фильтрация, томография, радары, радио обработка звука. <br>Потом начали делать сортировку. За счёт шины памяти у видео карты 128 до 720 более высокая производительность памяти чем у ЦПУ. Поэтому после БПФ сделали быструю сортировку чисел. <br>Поэтому некоторые умельцы мастерили сервера для защиты от DDoS атак на ГПУ. Так как быстрее можно расшифровать текст и быстрее его проверить. <br><br>Потом графы. Затем оптимизировать декодирования видео. Затем ускорили рендеринг в 3D-CAD и САПРах (к примеру Cyclea). А потом рендеринг текста (). Потом OpenCV перевели на Gpu. Затем ИИ TensorFlow.<br><br>Обработку текста на GPU пока не додумались перевести. Но это от того что линейные циклы и рекурсию надо заменять пирамидальной обработкой.]]></description>
        <author>Pavia</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818491</guid>
        <pubDate>Thu, 16 Jan 2020 14:25:50 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818491</link>
        <description><![CDATA[shm: Например, нейросети на GPU намного быстрее работают. <a class='tag-url' href='https://ru.wikipedia.org/wiki/Caffe' target='_blank'>https://ru.wikipedia.org/wiki/Caffe</a>]]></description>
        <author>shm</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818486</guid>
        <pubDate>Thu, 16 Jan 2020 13:13:21 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818486</link>
        <description><![CDATA[JoeUser: <strong class='tag-b'>Pavia</strong>, понимаю. Но какие преобразования и чего делают профит в задействовании GPU? <br>
Инкремент и декремент регистра, к примеру, я и на CPU произведу мастерски&#33;  :)]]></description>
        <author>JoeUser</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818449</guid>
        <pubDate>Thu, 16 Jan 2020 10:37:30 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818449</link>
        <description><![CDATA[Pavia: <strong class='tag-b'>JoeUser</strong><br>
GPU можно запрячь всем. Желательно там где у вас есть однородные данные(массивы, вектора, шаблоны, графы, <span class='tag-u'><strong class='tag-b'>строки</strong></span>, звук, изображение). Единственно что не имеем смысл перекладывать отдельные функции, на пересылке данных больше времени потеряете.]]></description>
        <author>Pavia</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818431</guid>
        <pubDate>Thu, 16 Jan 2020 09:07:21 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818431</link>
        <description><![CDATA[JoeUser: <strong class='tag-b'>^D^ima</strong>, зачет&#33;&#33;&#33;<br>
Теперь нужно ограничить области применение. Про майнинг я ниче не знаю, а вот использование в видео-кодинге и программном сжатии - видел и наблюдал в диспетчере задач. Давай определимся, чем можно (и как) запрячь GPU?]]></description>
        <author>JoeUser</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818428</guid>
        <pubDate>Thu, 16 Jan 2020 08:56:11 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818428</link>
        <description><![CDATA[^D^ima: Погугли OpenCL]]></description>
        <author>^D^ima</author>
        <category>C/C++: Прочее</category>
      </item>
	
      <item>
        <guid isPermaLink='true'>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818411</guid>
        <pubDate>Thu, 16 Jan 2020 07:06:01 +0000</pubDate>
        <title>Тема про GPU</title>
        <link>https://forum.sources.ru/index.php?showtopic=416531&amp;view=findpost&amp;p=3818411</link>
        <description><![CDATA[JoeUser: Буэнос диас, амигос&#33;<br><br>Тема простая. Всем известно что в некоторых случаях вычисления на GPU дают ощутимый профит.<br>Например, на сколько я знаю, при майнинге криптовалюты. Поэтому два вопроса:<br><br>1) Есть ли библиотеки свободного доступа на С/C++, которые реализуют вычисления на GPU (Nvidia, Radeon)?<br>2) Самый важный вопрос - какие алгоритмы/вычисления желательно переложить на GPU чтобы получить профит по скорости?]]></description>
        <author>JoeUser</author>
        <category>C/C++: Прочее</category>
      </item>
	
      </channel>
      </rss>
	