NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体
  • 上方文Q
  • 2016年09月13日 17:54
  • 0

在北京召开的GTC 2016技术大会上,NVIDIA CEO黄仁勋亲自发布了新一代高性能计算卡Tesla P40、Tesla P4,专为人工智能、深度学习、神经网络推演而生。

它们俩将取代上代麦克斯韦架构的Tesla M40/M4,都进化到了最新的帕斯卡架构,当然也有16nm工艺。

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

Tesla P40基于高端大核心GP100,并且开启全部3840个流处理器(此前的Titan X只有3584个),核心频率1303-1531MHz,FP32单精度浮点计算能力12TFlops,INT8(八位数据专用推理指令) 47TOPS,响应速度比CPU快45倍。

该卡搭配384-bit 24GB GDDR5显存,等效频率7.2Gbps,整卡功耗250W,被动散热。

顺带一提,GP100大核心的Tesla P100也只开启了3584个流处理器,完整也是3840个,搭配显存是GDDR5X。

Tesla P4的核心则是GTX 1080/1070同款的GP104,全部2560个流处理器,核心频率只有810-1063MHz,单精度性能5.5TFlops,INT8 22TOPS,搭配256-bit 6Gbps 8GB GDDR5显存,功耗50-75W,半高被动散热。

相比于前辈,它们的计算性能分别提升了70%、1.5倍,INT8特性也是首次加入,功耗则维持不变。

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA表示,Tesla P40可提供非常高的深度学习工作负载处理能力,一台配备八块Tesla P40加速器的服务器在性能上可媲美140多台CPU服务器,同时成本节省超过65万美元。

Tesla P4则可为超大规模数据中心提供极高的能效,一台配备单个Tesla P4的服务器可以取代13台CPU服务器,总体拥有成本可节省超过800%。

同时,NVIDIA还发布了两款配套的开发工具:TensorRT是为优化将部署到生产环境的深度学习模型而创建的库,能即时响应极其复杂的网络;DeepStream SDK则利用帕斯卡务器的强大功能同时,对最多达93路的高清视频流进行实时解码和分析。

Tesla P40/P4将分别在10月、11月发货给相关OEM、ODM厂商。

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

NVIDIA发布全新计算卡Tesla P40/P4:帕斯卡完全体

文章纠错

  • 好文点赞
  • 水文反对

此文章为快科技原创文章,快科技网站保留文章图片及文字内容版权,如需转载此文章请注明出处:快科技

观点发布 网站评论、账号管理说明
热门评论
查看全部0条评论
相关报道

最热文章排行查看排行详情

邮件订阅

评论0 | 点赞0| 分享0 | 收藏0