«Программирование графических процессоров». Вариант №1

Состав работы

material.view.file_icon
material.view.file_icon Контрольная работа.doc

Необходимые программы

Работа представляет собой zip архив с файлами (распаковать онлайн), которые открываются в программах:
  • Microsoft Word

Описание

Тема контрольной работы: «Базовые принципы организации памяти GPU»

Некоторые выдержки из отчета приведены далее.
Graphics Processing Unit (GPU) - высокопроизводительный многопроцессорный блок, использующийся в графическом конвейере видеокарты для ускорения графических операций.
Графический процессор специализирован для интенсивных, параллельных вычислений - именно то, что представляет
собой графический рендеринг (rendering — «визуализация» Термин в компьютерной графике, обозначающий процесс получения изображения по модели с помощью компьютерной программы), и поэтому сконструирован таким образом, что большее количество транзисторов занимается обработкой
данных, а не кэшированием данных и управлением потоком.
Архитектуры CPU и GPU также различаются по количеству ядер. Ядро - это процессор внутри процессора. Большинство процессоров имеют от четырех до восьми ядер, хотя некоторые имеют до 32 ядер. Каждое ядро может обрабатывать свои задачи или потоки.
Графический процессор имеет менее сложные и маленькие ядра, потому что (он не универсален) и предназначен для параллелизма данных и применения одной и той же операции к нескольким элементам данных (SIMD).

Отчет содержит ответы на задания, пояснения в отчете сопровождаются рисунками, часть из которых представлена на скриншотах.
Объем отчета составляет 14 станиц формата А4.
Отчет содержит 11 поясняющих рисунков.

Дополнительная информация

Год сдачи: 2020
Преподаватель: Милешко А.В.
Работа зачтена без замечаний.

Рекомендую использовать представленные материалы в качестве методической помощи для выполнения своих работ.
Контрольная работа по дисциплине: Программирование графических процессоров. Вариант №1
Задание 1. Дана спецификация графического процессора: 1. Максимальное число варпов на мультипроцессор: 64 2. Максимальное число блоков на мультипроцессор: 32 3. Максимальное количество 32-х битных регистров на мультипроцессор: 65536 4. Максимальное количество 32-х битных регистров на блок: 65536 5. Максимальное количество 32-х битных регистров на нить: 255 6. Размер разделяемой памяти мультипроцессора (байт): 65536 7. Размер разделяемой памяти блока (байт): 49152 Параметры запускаемой программы:
User IT-STUDHELP : 8 ноября 2022
750 руб.
promo
Программирование графических процессоров. Лабораторная 3
1. Прочитайте главы теоретического материала под названиями "Pinnedmemory" и "Потоки (streams) в CUDA". Ответьте на контрольные вопросы в конце глав (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Примените потоки для алгоритмов реализованные в лабораторной работе №1. 3. Определите оптимальное количество потоков для матрицы размером 2500x2500 элементов и вектора размером 2500 элементов.
User Алёна25 : 1 июля 2026
150 руб.
Программирование графических процессоров. Лабораторная 1
1. Прочитайте главы теоретического материала под названиями "Отличия GPU от CPU", "Первая программа на CUDAC", "Алгоритм сложения двух векторов на GPU", "События, обработка ошибок и получение информации об устройстве", "Глобальная, локальная и константная память". Ответьте на контрольные вопросы и выполните контрольные задания, предложенные в конце этих глав (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Реализуйте параллельный алгоритм умножения AxV, где A
User Алёна25 : 1 июля 2026
150 руб.
Программирование графических процессоров. Лабораторная 2
1. Прочитайте главу из теоретического материала "Разделяемая память" и ответьте на контрольные вопросы (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Оптимизируйте алгоритмы, реализованные в лабораторной работе №1 при помощи разделяемой памяти. 3. Постройте графики зависимости времени выполнения алгоритма от размера матрицы и вектора (Размеры матрицы 1000x500, 1000x1000, 1500x1000, 2000x1000, 2000x1500, 2500x1500, 2500x2000). 4. Проанализируйте, реализова
User Алёна25 : 1 июля 2026
150 руб.
Программирование графических процессоров Лабораторная 2
Задание 1. Прочитайте главу из теоретического материала "Разделяемая память" и ответьте на контрольные вопросы (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Оптимизируйте алгоритмы, реализованные в лабораторной работе №1 при помощи разделяемой памяти. 3. Постройте графики зависимости времени выполнения алгоритма от размера матрицы и вектора (Размеры матрицы 1000x500, 1000x1000, 1500x1000, 2000x1000, 2000x1500, 2500x1500, 2500x2000). 4. Проанализируйте, реал
User svladislav987 : 28 августа 2023
200 руб.
Программирование графических процессоров Лабораторная 3
Выполнение лабораторной работы поможет получить навыки требующиеся для выполнения третьего задания контрольной работы. Задание 1. Прочитайте главы теоретического материала под названиями "Pinned memory" и "Потоки (streams) в CUDA". Ответьте на контрольные вопросы в конце глав (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Примените потоки для алгоритмов реализованные в лабораторной работе №1. 3. Определите оптимальное количество потоков для матрицы размером
User svladislav987 : 28 августа 2023
200 руб.
Программирование графических процессоров Лабораторная 1
Задание 1. Прочитайте главы теоретического материала под названиями "Отличия GPU от CPU", "Первая программа на CUDA C", "Алгоритм сложения двух векторов на GPU", "События, обработка ошибок и получение информации об устройстве", "Глобальная, локальная и константная память". Ответьте на контрольные вопросы и выполните контрольные задания, предложенные в конце этих глав (ответы на контрольные вопросы не нужно включать в отчёт по лабораторной работе). 2. Реализуйте параллельный алгоритм умножения Ax
User svladislav987 : 28 августа 2023
200 руб.
Программирование графических процессоров. Вариант 5
Задание 1. Дана спецификация графического процессора: 1. Максимальное число варпов на мультипроцессор:32 2. Максимальное число блоков на мультипроцессор:16 3. Максимальное количество 32-х битных регистров на мультипроцессор: 65536 4. Максимальное количество 32-х битных регистров на блок: 65536 5. Максимальное количество 32-х битных регистров на нить: 255 6. Размер разделяемой памяти мультипроцессора (байт): 65536 7. Размер разделяемой памяти блока (байт): 49152 Параметры запускаемой программы: 1
User Zla : 29 марта 2022
650 руб.
Вал приводной - 02.004 Деталирование
Приводной вал служит для передачи вращения от электродвигателя к рабочим органам машины. Вращение на вал передается через шкив 4 и смонтированную в нем фрикционную муфту. Шкив 4 вращается свободно относительно диска 3, соединенного с валом 15 шпонкой 24. На диске 5 укреплены палец 16, на котором свободно поворачивается рычаг включения 17, и палец 13, на котором поворачиваются фрикционные секторы 14 и 20 муфты. Вал 15 начнет вращаться после включения муфты. Для этого необходимо передвинуть втулку
User HelpStud : 14 октября 2025
500 руб.
Вал приводной - 02.004 Деталирование promo
Лабораторная работа № 4 по дисциплине: Методы моделирования и оптимизации
Решение игры как задачи линейного программирования Задание: Две отрасли могут осуществлять капитальные вложения в 3 объекта. Стратегии отраслей: i-я стратегия состоит в финансировании i-го объекта (i = 1, 2, 3). Учитывая особенности вкладов и местные условия, прибыли первой отрасли выражаются матрицей 3х3. Величина прибыли первой отрасли считается такой же величиной убытка для второй отрасли - представленная игра может рассматриваться как игра двух игроков с нулевой суммой. Решить матричную игр
User AndrySSS : 20 июня 2013
335 руб.
Всеобщая история БИЛЕТ №3
ЗАЧЕТ По дисциплине: Всеобщая история БИЛЕТ №3 Билет 3 1. Рембрант и Рафаэль - это: 2. Территории, потерявшие независимость и попавшие под власть завоевателей, называют: 3. Сторонников Реформации в Германии называли: 5. Укажите хронологические рамки Тридцатилетней войны: 6. Укажите, кого во Франции называли финансовой аристократией: 20. При короле франков из династии Меровингов Хлодвиге… Укажите неверный ответ. 24. Установите соответствие между понятиями и их определениями. 25. Средневековая г
User KVASROGOV : 27 мая 2020
150 руб.
Всеобщая история БИЛЕТ №3
Расчёт перерабатывающего шнека
Содержание Введение………………………………………………………………………2 1. Состояние вопроса (анализ конструкции шнеков)………………….4 1.1 Винтовые конвейеры и питатели……………………….................5 1.2 Напорные и перерабатывающие шнеки………………………….14 1.3 Шнековые фрезы горных машин…………………………………19 2. Расчёты и построение графиков……………...……………………....33 3. Распечатка результатов на ЭВМ……………………………………..44 4. Выводы………………………………………………………………...45 Литература…………………………………………………………...46 Одно из важнейших мест в техн
User Oleg1991 : 22 марта 2012
50 руб.
up Наверх