|
3 / 3 / 1
Регистрация: 15.01.2025
Сообщений: 52
|
|
Чтение данных видеокартой с диска nvme ssd31.08.2025, 19:29. Показов 3074. Ответов 59
Метки нет (Все метки)
Здравствуйте.
Есть математика, которая успешно считается на видеокарте, но для дальнейшего хода расчетов необходимо получить пару байт с диска. Сейчас есть убогая реализация через процессор, которая серьезно тормозит скорость расчета. Есть ли возможность видеокарте самой читать данные с nvme ssd? Читал про GPUDirect Storage, но как понял, это тоже чтение с помощью процессора...
0
|
|
| 31.08.2025, 19:29 | |
|
Ответы с готовыми решениями:
59
CUDA k-means ошибка чтения Маленький супер-компьютер для вычислений с помощью видеокарт NVIDIA с применением технологии CUDA. #Вычисления на GPU (GPGPU - вычислений на видеокартах): CUDA, OpenCL, AMD APP и DirectCompute |
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
||
| 02.09.2025, 17:09 | ||
|
Сейчас посмотрел на Озоне, память 256 Гб за 500к. Итого 2 ляма. А Винду как прикрутить ? Ей тупо места не хватит.
0
|
||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|
| 02.09.2025, 17:25 | |
|
Jin X,
База 1 ТБ. Что с Виндой делать, для нее нет места.
0
|
|
|
342 / 134 / 10
Регистрация: 19.07.2024
Сообщений: 765
|
|||
| 02.09.2025, 17:35 | |||
|
Добавлено через 1 минуту Зачем винда? Она не нужна.
0
|
|||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|
| 02.09.2025, 17:50 | |
|
Сравнить скорость разных модулей ОЗУ в наносекундах можно с помощью формулы: тайминг*2000/частоту памяти.
ОЗУ с частотой 3600 МГц и таймингами CL14 будет работать со скоростью 14*2000/3600 = 7,8 нс. 4000 МГц на CL16 покажет ровно 8 нс. Оба варианта примерно одинаковы по скорости, но второй предпочтительнее из-за большей пропускной способности. В то же время, если взять память с частотой 4000 МГц при CL14, то это будет уже 7 нс. При этом пропускная способность станет еще выше, а время доставки информации снизится на 1 нс.
0
|
|
|
Asm/C++/Delphi/Py/PHP/VBA
|
||||
| 02.09.2025, 18:56 | ||||
![]()
0
|
||||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|||
| 02.09.2025, 19:10 | |||
|
Jin X,
Начнем с того, что 3500 МГц, это 0.28 Nanoseconds. Насчет AIDA64, ее 1 человек писал, это не фирменная прога, корпорации например. Добавлено через 2 минуты
0
|
|||
|
Asm/C++/Delphi/Py/PHP/VBA
|
|||
| 02.09.2025, 19:25 | |||
|
0
|
|||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|||
| 02.09.2025, 19:38 | |||
|
0
|
|||
|
3 / 3 / 1
Регистрация: 15.01.2025
Сообщений: 52
|
|
| 02.09.2025, 21:38 [ТС] | |
|
Эко вас, товарищи, понесло.
![]() Все идеи типа "возьми чипы памяти и сам себе спаяй видюху" не приемлемы т.к. существует объективная реальность ![]() - я и моё окружение не обладает такими компетенциями (об этом я уже говорил) - адресное пространство в 1ТБ имет длину адреса в 5 байт (40 бит) - параллельная передача адреса видится смутно (максимум по байтно). - даже если такое устройство кто-то может создать появляется вопрос интеграции его в компьютер (как на физическом уровне, так и программном - драйвера) Возможно я ошибаюсь и вы мне покажите работающее устройство где реализован ваш подход (хотя бы частично), тогда буду изучать ваш опыт. Сейчас мне это видится каким-то стебом.
0
|
|
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
||
| 02.09.2025, 21:46 | ||
|
Поговорить ему захотелось. Ардуинка на 8 бит и комп, это разные вещи.
0
|
||
|
3 / 3 / 1
Регистрация: 15.01.2025
Сообщений: 52
|
||
| 02.09.2025, 21:51 [ТС] | ||
|
Jin X,
есть реализация на GPU - в 30 раз быстрее, НО там нет ЕЩЁ никаких проверок (вопрос этой темы поэтому и возник). Как понимаю ТУТ единственное решение Каждый раз запускать функцию CPU.
0
|
||
|
Asm/C++/Delphi/Py/PHP/VBA
|
|
| 03.09.2025, 10:13 | |
|
As17, есть вариант на спин-локах. То есть у вас есть 2 managed-переменные: флаг и адрес. Когда данные готовы, GPU выставляет флаг. Его же CPU в цикле читает, пока он не станет true (ну или не увеличится на 1). Далее берётся адрес и по нему идёт чтение с диска (или DirectStorage). После готовности CPU выставляет другой флаг, который уже GPU так же ждёт. Сильно грузит процессор, но другого варианта вроде бы нет. Это будет быстрее, чем каждый раз запускать kernel-функцию (если вы это имели в виду).
Добавлено через 1 минуту Можно и одной переменной обойтись, где флагом является, например, старший бит. Ну или там будет индекс (он же флаг) + массив, если несколько GPU-потоков могут одновременно несколько данных отдать.
0
|
|
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|
| 03.09.2025, 11:44 | |
|
Есть идея про майнинг, несколько видеокарт в SLI. Так можно ускорить вычисления.
Насчет диска аналогично, сделать типа рейд0, базу дробить на диски и переключаться между ними. Хорошая идея ? Надо пробовать, вроде должно работать, хотя и не слишком быстро, на первый взгляд. Надо потестить доступ в начале и конце диска, есть ли большие отличия. Все равно надо делать предсказание и грузить заранее, нет другого способа ускорить чтение с диска. Даже если напрямую в гпу. NVMe имеют задержку доступа около 20-30 микросекунд (мкс), тогда как у SATA SSD это примерно 100 мкс, а у традиционных жестких дисков (HDD) – 2-5 миллисекунд (мс). 30 микросекунд это 33 kilohertz
0
|
|
|
342 / 134 / 10
Регистрация: 19.07.2024
Сообщений: 765
|
|||||
| 03.09.2025, 12:26 | |||||
![]() Добавлено через 3 минуты Займитесь лучше тем, в чём разбираетесь. Добавлено через 1 минуту
0
|
|||||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|
| 03.09.2025, 12:51 | |
|
jcxz,
Что насчет даташита ? Ссылка есть ?
0
|
|
|
342 / 134 / 10
Регистрация: 19.07.2024
Сообщений: 765
|
|
| 03.09.2025, 13:44 | |
|
Я выше привёл ссылки. Полный даташит там под NDA. Нужен - заходите подписывайте и получайте.
Кому нужно, тот подпишет и получит. Мне оно не нужно. Да и та ссылка - это только один из производителей. Наугад. Наверняка и другие есть. А лучше (как уже писали) - чипы ОЗУ использовать. Хоть и дороже. PS: Если всё-же в тех закрытых даташитах указано слишком большое время доступа, то тогда видимо остаётся использовать только чипы ОЗУ.
0
|
|
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|||
| 03.09.2025, 14:14 | |||
|
И завязывай флудить во всех темах.
0
|
|||
|
342 / 134 / 10
Регистрация: 19.07.2024
Сообщений: 765
|
|||
| 03.09.2025, 14:21 | |||
|
0
|
|||
|
110 / 74 / 6
Регистрация: 08.08.2025
Сообщений: 716
|
|||
| 03.09.2025, 14:25 | |||
|
0
|
|||
| 03.09.2025, 14:25 | |
|
Поддержка OpenCL AMD на видеокарте ATI Radeon HD 6370M Ищу драйвер видеокарты nvidia GT520m cuda 1Gb для ноутбука Acer Aspire 5750G под win XP. видеокарта openCL / cuda Видеокарта не поддерживает OpenCL что делать? Как использовать GPU моей видеокарты для выполнения кода? Искать еще темы с ответами Или воспользуйтесь поиском по форуму: |
|
| Опции темы | |
|
|
Новые блоги и статьи
|
|||
|
Был там один разговор по поводу свободы в материальном мире.
kumehtar 19.08.2026
Суть: рассматривается живое существо, оказавшееся внутри довольно странной системы (этого мира) и пытающееся обустроить в ней свой кусок пространства.
Жизнь действительно предъявляет каждому. . .
|
Когда логика программы не спасает от человеческих ошибок
Maks 18.08.2026
В последнее время всё чаще и чаще сталкиваюсь с таким явлением, как абсолютная невнимательность (или глупость) пользователей. Проявляется это чаще всего на работе в коллективе. Допустим, человек с. . .
|
Лето уходит
kumehtar 17.08.2026
|
Мысли в слух
kumehtar 17.08.2026
Забавно, насколько сейчас стала доступна информация. Например о магии, духовном развитии, медитациях, и других подобных направлениях, ранее зачастую тайных, передаваемых от учителя к ученику. Хотя. . .
|
|
Перемещение строк из ТЧ в другой документ с учетом текущего пробега
Maks 17.08.2026
Реализация из решения ниже выполнена на примере нетипового документа "Автозапчасти", с ТЧ "Шины".
За основу взят алгоритм отсюда: https:/ / www. cyberforum. ru/ blogs/ 359708/ 10838. html
Задача: . . .
|
Саморегулирующийся социальный контракт для сервера cross-section.
Hrethgir 14.08.2026
С кодом конечно таких глубоких размышлений пока не было, впрочем я уже привык к алгоритмизации. Суть предмета записи: снова в диалоге с нейросетью (я взял пока себе ник для учётки админа - Rector). . . .
|
Часы электронные
Uhbif79 12.08.2026
Выкладываю программу часов. Программа позволяет:
1. Использовать системное время и дату,
2. Есть возможность вводить время и дату вручную.
3. Реализованы 2 будильника: начало и конец рабочего дня. . . .
|
Часы с будильником на основе класса QLCDNumber
Uhbif79 12.08.2026
Всем добрый день, выкладываю программу часов с будильником на основе класса QLCDNumber.
Здесь я пробовал самостоятельно создавал классы, впервые столкнулся с видимостью переменной одного класса из. . .
|