APP下载
报价宝  ›  综合  › 

Turing 6倍Nvidia新一代GPU架构Turing比Pascal快6倍!Quadro两代GPU架构大比较

报价宝 来源:baojiabao.com 发布时间:2018-08-15 10:31:00 10月02日更新
报价宝综合消息Turing 6倍Nvidia新一代GPU架构Turing比Pascal快6倍!Quadro两代GPU架构大比较

【温哥华SIGGRAPH直击】
Nvidia发表了新一代的GPU架构Turing,也推出了采用此架构的光线追踪GPU产品Quadro RTX。Nvidia首席执行官黄仁勋还现场展示了今年3月同样的一段《星际大战》光线追踪特效示范短片Reflections,来呈现即时光线追踪的光影渲染效果?先来看看这个短片得光影渲染效果,利用即时光线追踪计算产生的阴影和反射、折射效果格外真实。3月当时利用了配备4个人工智能专用的Volta GPU以及价值7万美元的人工智能工作站DGX Station来计算,但现在只需用单张新推出的光线追踪GPU卡Quadro RTX 8000就能做到。

若以同样专攻影像特效处理的GPU产品线Quadro来看,Nvidia首席执行官黄仁勋指出,全新Turing架构的效能,是前一代Quadro Pascal架构的6倍之多。

新一代Turing架构是全新的设计,除了GPU原有的SM(Streaming Multiprocessor)模组外,还包括了AI计算用的Tensor Core,以及光线追踪用的RT Core,等于集结了Nvidia过去两大类GPU的特性,再增加一个新的特殊核心。

但是,Turning架构内建的SM模组也采取了新设计,除了浮点运算能力,还增加了可以平行执行的整数执行器,可以同时提供16 TFLOPS(Tera Floating-point Operations Per Second),再加上同样效能的16 TIPS(Tera Integer Operations Per Second)运算效能。

除此之外,Turing架构增加了一个全新的处理核心:专门处理光线追踪的RT Core,用于计算光线在三角形间交互作用和不同边界间户,最高每秒可处理10 Giga道光线。
另外Turing架构也内建了出现在另一个人工智能系列产品线使用的Volta GPU架构上的AI计算专用核心Tensor Core,不过,核心数比Volta产品线内建的640 Tensor Core核心数略低,Turing架构目前最多只内建了576个(RTX 6000和RTX 8000两款),最高可以提供到125 TFLOPS的半精度浮点运算,或是500 TOPS INT4计算(每秒可以处理500兆次整数计算)。

相较于Quadro前一代采用的16奈米制程Pascal架构GPU,Turing架构GPU芯片则采用了更先进的12奈米制程,芯片面积从更大达到754平方毫米,内有186亿个晶体管,前Pascal架构GPU只有118亿个晶体管。在一般运算能力上,Turing架构GPU可提供到16 TFLOPS计算力,也远高于Pascal架构GPU的13 TFLOPS计算能力。内存支援也有很大的差异,Pascal架构的Quadro产品,可支援到24GB的GDDR5内存(时脉10GHz),但Turing架构GPU可支援到更高速的GDDR6内存(时脉14Ghz),单卡容量更是高达48GB。透过NVLink串连双GPU卡,内存还可以再倍增,例如串接两张RTX 8000最大可提供96GB的全域照明计算(Global Illumination) 。

同样用星际大战短片的光影渲染来比较,同样效果,黄仁勋指出,采用Pascal架构的GPU需要308毫秒,但Turing架构GPU搭配即将推出的Deep Learning Anti-Aliasing (DLAA)技术,只需要45毫秒,等于Turing架构的光影渲染速度可以达到Pascal架构的6倍。

为了支援RTX GPU,Nvidia在软件层上提供了多项新工具和API,包括了光栅化(Rasterization)计算API、光线追踪API、CUDA运算API、Tensor Core用的AI API等,另外OptiX、DXR、Vulkan也可以支援新的Turing架构光线追踪加速功能,Nvidia还正式将材质定义语言MDL开源释出,另外RTX也支援Pixar的开发语言USD(Universal Scene Description)。开发者只要呼叫API,就可以利用RTX GPU的光线追踪核心来计算。

文章标签: 报价宝 降噪耳机价格 耳机价格 红米手机价格 华为手机价格 小米手机价格 电视机价格 笔记本电脑价格 笔记本价格 汽车价格 报价宝 手机价格 笔记本价格 小米手机价格 红米手机价格