Intel Xe
Intel Xe,中文名英特尔锐炬 Xe(格式化為Xe,兩個字母分開發音),早期曾被非正式地稱為Gen12,是由英特尔开发的獨立显示卡(dGPU)架構。 Intel Xe包括集成/低功耗 (Xe-LP) 、高性能游戏 (Xe-HPG)、数据中心/高性能 (Xe-HP) 和高性能计算 (Xe-HPC) 等在內的許多指令集架構。Intel Xe与Tiger Lake产品一起推出。 历史 Intel Xe不是英特爾首次尝试研發獨立顯示卡,早在…
共 13 篇文章
Intel Xe,中文名英特尔锐炬 Xe(格式化為Xe,兩個字母分開發音),早期曾被非正式地稱為Gen12,是由英特尔开发的獨立显示卡(dGPU)架構。 Intel Xe包括集成/低功耗 (Xe-LP) 、高性能游戏 (Xe-HPG)、数据中心/高性能 (Xe-HP) 和高性能计算 (Xe-HPC) 等在內的許多指令集架構。Intel Xe与Tiger Lake产品一起推出。 历史 Intel Xe不是英特爾首次尝试研發獨立顯示卡,早在…
CUDA(Compute Unified Devices Architecture,统一计算架构)是由英伟达(NVIDIA)所推出的一个并行计算平台,是該公司對於GPGPU的正式名稱。透過這個技術,使用者可利用NVIDIA的GPU进行图像处理之外的運算。 CUDA 開發套件(CUDA Toolkit )只能將自家的CUDA C-語言(對OpenCL只有链接的功能),編譯成PTX中間語言,或特定NVIDIA GPU架構的機器碼(NVIDI…
AMD Instinct 是 AMD 的專業 GPU 品牌。它在 2016 年取代了 AMD 的 FirePro S 品牌。與主流消費/遊戲產品的 Radeon 品牌相比,Instinct 產品線旨在加速深度學習、人工神經網絡和高性能計算/GPGPU 應用。 Radeon Instinct 產品線直接與 Nvidia 的 Ampere 和 Intel Xeon Phi 以及即將推出的 Intel Xe 系列機器學習和 GPGPU 卡競爭…
ROCm是超微半导体(AMD)用于圖形處理器(GPU)编程的软件栈。ROCm涉及多个领域:图形处理器通用计算(GPGPU)、高性能计算(HPC)和异构计算。它提供多种编程模型:HIP(基于GPU内核的编程)、OpenMP/訊息傳遞介面(基于指令的编程)和OpenCL。 ROCm是免费、自由和开源的软件(GPU固件除外),以各种许可证发布。ROCm最初是Radeon Open Compute platform的缩写,但由于Open Com…
圖形處理器(,縮寫:),又稱顯示核心(display core)、視覺處理器(video processor)、顯示晶片(display chip)或圖形晶片(graphics chip),是一種專門在個人電腦、工作站、遊戲機和一些行動裝置(如平板電腦、智慧型手機等)上執行繪圖運算工作的微處理器。以图形处理器为核心的主板扩展卡也称顯-{}-示卡,或簡稱顯-{}-卡。 圖形處理器是輝達在1999年8月發表GeForce 256繪圖處理晶片…
Futhark是一个函数式、数据并行、阵列编程语言,最初于哥本哈根大学(DIKU)作为HIPERFIT(财务信息技术的函数式高性能计算)计划的一部份而开发。它聚焦于确使以函数式风格书写的数据并行程序,可以高性能的执行于大规模并行硬件上,特别是在GPU上。Futhark强烈的受到启发,但是为了确使更具进取性的编译器优化,对如何表达并行施加了约束。特别是,不支持非正规的嵌套数据并行。 概述 Futhark是属于ML家族的语言,它具有从OCa…
串流處理()是一種計算機編程範式,相當於數據流程編程,,和反應式編程 ,其允許一些應用更容易地利用了有限形式的並行處理。這些應用程序可以使用多個計算單元,例如圖形處理上的浮點運算器或現場可編程門陣列(FPGAs),而無需明確管理這些單元之間的分配,同步或通信。 串流處理範例通過限制可執行的並行計算來簡化並行軟件和硬件。給定一個數據序列(串流處理),一系列操作(內核函數)被應用到串流中的每個元素。例如:直播軟件。內核函數通常使用流水線(計…
OpenCL(,中譯:开放计算语言),是一个为异构平台编写程序的框架,此异构平台可由CPU、GPU、DSP、FPGA或其他类型的处理器與硬體加速器所组成。OpenCL由一门用于编写kernels(在OpenCL设备上运行的函数)的语言(基于C99)和一组用于定义并控制平台的API组成。OpenCL提供了基于任务分割和数据分割的并行计算机制。 OpenCL类似于另外两个开放的工业标准OpenGL和OpenAL,这两个标准分别用于三维图形和…
通用圖形處理器(,全稱图形处理单元上的通用计算()),是利用处理图形任务的图形处理器来計算原本由中央处理器处理的通用计算任务。这些通用计算任务通常与图形处理没有任何关系。由于现代图形处理器有强大的并行处理能力和可编程流水线,令图形处理器也可以处理非图形数据。特别是在面对单指令流多数据流(SIMD)且数据处理的运算量远大于数据调度和传输的需要时,通用圖形處理器在性能上大大超越了传统的中央处理器应用程序。 GPU技術大會 NVIDIA每年都…
FireStream是ATI研發的一个流处理器系列,在AMD收購ATI後改為 Firepro S 系列,建基于Radeon图形显示芯片,提供高性能计算能力。FireStream产品中的显核不是用來作3D加速用途,而是利用显核内置的强大像素处理器變成一群并行处理器,作为浮点运算协处理器,协助中央处理器计算复杂的浮点运算程序,例如複雜的科学運算。 而早在数年前,人們就意識到GPU不但可以處理图形數據,還可以處理其他數據。BionicFX就試…
SYCL是一个面向OpenCL的高层次编程模型,一种单一源码特定领域嵌入式语言(DSEL),目的是提高编程效率。SYCL 1.2基于纯C++11,SYCL 2.2基于纯C++14。该标准由科纳斯组织开发,於2014年3月發布。 教程 ComputeCpp SYCL指南中包含几个教程。 参见 C++ CUDA Metal (API) OpenACC OpenCL OpenMP Vulkan 参考文献 外部链接 [https://www.k…
GPU集群是一個计算机集群,其中每個節點配備有圖形處理單元(GPU)。通過圖形處理單元(GPGPU)上的通用計算來利用現代GPU的計算能力,可以使用GPU集群執行非常快速的計算。 硬件(GPU) GPU集群可以使用來自兩個主要獨立硬件供應商的硬件(AMD和nVidia)。 硬件(其他) 互聯 除了计算机節點及其各自的GPU之外,還需要足夠快的互連以便在節點間傳送數據。互連的類型在很大程度上取決於存在的節點數量。互連的一些例子包括千兆以太…
在計算中,內核函數是為高吞吐量加速器(例如GPU,DSP或FPGA)編譯的例程,與主程序分開。它們有時被稱為计算着色器,與GPU 共享頂點著色器和像素著色器的執行單元,但不限於在一類設備或圖形API上執行。 使用 在實現傳統語言中的算法(除了沒有隱含的順序操作)或傳遞給內部迭代器的代碼時,計算內核大致對應於內部循環。 可以使用OpenCL C (由OpenCL API 管理)的單獨編程語言來指定為着色器(由OpenGL之類的圖形API管…