|
公司基本資料信息
|
NVIDIA®(英偉達(dá)™)Tesla™ C2050與C2070計(jì)算處理器能夠推動(dòng)整個(gè)行業(yè)向并行計(jì)算的過渡,為臺式機(jī)帶來了小型集群般的性能。Tesla GPU的20系列產(chǎn)品家族基于代號為“Fermi”的下一代CUDA架構(gòu),支持技術(shù)與企業(yè)計(jì)算所“必備”的諸多特性,其中包括C++支持、可實(shí)現(xiàn)極高精度與可擴(kuò)展性的ECC存儲器以及7倍于Tesla 10系列GPU的雙精度性能。Tesla™ C2050與C2070 GPU旨在重新定義高性能計(jì)算并實(shí)現(xiàn)超級計(jì)算的平民化。
與最新的四核CPU相比,Tesla C2050與C2070計(jì)算處理器以十分之一的成本和二十分之一的功耗即可實(shí)現(xiàn)同等超級計(jì)算
基于新一代Fermi CUDA架構(gòu)的GPU |
與基于最新四核CPU的純CPU系統(tǒng)相比,該GPU以十分之一的成本和二十分之一的功耗即可實(shí)現(xiàn)同等的集群性能。 |
448個(gè)CUDA核心 |
每顆GPU最高可實(shí)現(xiàn)515 Gigaflop雙精度峰值性能,從而讓一臺工作站即可實(shí)現(xiàn)Teraflop級甚至更高的性能。每顆GPU的單精度峰值性能超過1 Teraflop。 |
ECC存儲器 |
能夠滿足工作站計(jì)算精度與可靠性方面的關(guān)鍵需求。能夠?yàn)榇鎯ζ髦械臄?shù)據(jù)提供保護(hù)功能,從而為應(yīng)用程序增強(qiáng)數(shù)據(jù)完整性和可靠性。寄存器文件、L1/L2高速緩存、共享存儲器以及DRAM均受ECC的保護(hù)。 |
臺式機(jī)上的集群性能 |
與一個(gè)小型服務(wù)器集群相比,配備多顆GPU的單臺工作站能夠更快地解決大型難題。 |
每顆GPU最多配備6GB GDDR5存儲器 |
更大的數(shù)據(jù)集能夠保存在直接附屬于GPU的本地存儲器上,從而實(shí)現(xiàn)了性能的最大化并減少了數(shù)據(jù)傳輸?shù)那闆r。 |
NVIDIA®(英偉達(dá)™)并行DataCache™ |
能夠?yàn)槲锢硇Ч馑闫鳌⒐饩€追蹤以及稀疏矩陣乘法等諸多算法加速,在這些算法中,數(shù)據(jù)地址事先都是未知的。每個(gè)流式多處理器模塊均包含一個(gè)可配置的L1高速緩存,所有處理器核心使用統(tǒng)一的L2高速緩存。 |
NVIDIA®(英偉達(dá)™)GigaThread™引擎 |
通過多項(xiàng)技術(shù)實(shí)現(xiàn)了吞吐量的最大化,其中包括10倍于上一代架構(gòu)的高速上下文切換、并發(fā)內(nèi)核執(zhí)行以及改良的線程塊調(diào)度。 |
異步傳輸 |
計(jì)算核心在PCIe總線上傳輸數(shù)據(jù)的同時(shí)還能夠處理其它數(shù)據(jù),因而增強(qiáng)了系統(tǒng)性能。即便是地震處理這類需要大量數(shù)據(jù)傳輸?shù)膽?yīng)用程序,也能夠通過事先將數(shù)據(jù)傳輸至本地存儲器的方法來最大限度提升計(jì)算效率。 |
CUDA編程環(huán)境受到各種編程語言與API的廣泛支持 |
開發(fā)人員無論選擇C語言、C++、OpenCL、DirectCompute還是選擇Fortran語言,都能夠?qū)崿F(xiàn)應(yīng)用程序的并行機(jī)制,進(jìn)而利用“Fermi”GPU的創(chuàng)新架構(gòu)。Microsoft Visual Studio開發(fā)人員可以使用NVIDIA®(英偉達(dá)™)Parallel Nsight工具。 |
高速PCIe Gen 2.0數(shù)據(jù)傳輸率 |
實(shí)現(xiàn)了主系統(tǒng)與Tesla處理器之間帶寬的最大化。讓Tesla系統(tǒng)能夠應(yīng)用于幾乎所有具備一條開放式PCIe x16插槽且符合PCIe規(guī)范的主系統(tǒng)。 |
3規(guī)格
尺寸規(guī)格 |
9.75英寸PCIe x16規(guī)格 |
Tesla GPU的數(shù)量 |
1 |
CUDA核心數(shù)量 |
448 |
CUDA核心頻率 |
1.15 GHz |
雙精度浮點(diǎn)性能(峰值) |
515 Gflops |
單精度浮點(diǎn)性能(峰值) |
1.03 Tflops |
專用存儲器總?cè)萘?span>* Tesla C2050 Tesla C2070 |
3GB GDDR5 6GB GDDR5 |
存儲器頻率 |
1.5 GHz |
存儲器接口 |
384位 |
存儲器帶寬 |
144 GB/秒 |
功耗 Tesla C2050 |
238W熱設(shè)計(jì)功耗 |
系統(tǒng)接口 |
PCIe x16 Gen2 |
散熱解決方案 |
主動(dòng)式風(fēng)扇散熱器 |
顯示器支持 Dual- 顯示器最大分辨率@ 60Hz |
1 2560x1600 |
軟件開發(fā)工具 |
CUDA C/C++/Fortran、OpenCL以及DirectCompute工具包。 針對Visual Studio的NVIDIA®(英偉達(dá)™)Parallel Nsight™ |
*注:在開啟ECC功能的情況下,專用存儲器中的一部分將用于ECC數(shù)據(jù),因此用戶可用存儲器容量將減少12.5%。(例如總?cè)萘繛? GB的存儲器將僅能為用戶提供2.68 GB的可用容量。)
1. NVIDIA Tesla C2070并非是GTX 590這樣的顯卡, 正確的名稱叫作"運(yùn)算GPU", 它本身就已經(jīng)擁有CPU的功能, 所以它搭建的平臺"可以不再"需要INTEL, AMD這樣的傳統(tǒng)CPU作為中央處理器(如圖)
2. 如果和傳統(tǒng)超級圖形工作站(服務(wù)器)相比, 他的價(jià)格明顯要便宜很多, 如圖, 如果用四個(gè)nVIDIA Tesla C2070 組成的平臺(實(shí)現(xiàn)了四核心+4GPU+4X6G GDDR5內(nèi)存+顯存的超級圖形平臺), 只要人民幣10萬左右, 而如果是性能相當(dāng)?shù)耐燃壍钠胀ㄆ脚_(一個(gè)4核心SNB架構(gòu)的至強(qiáng)CPU, 2個(gè)NVIDIA QUADRO 6000專業(yè)顯卡組成SLI, 24G 內(nèi)存), 價(jià)格明顯要貴很多.
3. TESLA C2070也可以當(dāng)作普通的顯卡一樣插在普通電腦的PCI-E 16X插槽上來當(dāng)普通顯卡用, 但是它作為以專業(yè)圖形顯卡為基準(zhǔn)的設(shè)計(jì), 游戲性能比GTX 590要慢很多, 但是圖形渲染能力(AUTOCAD 3D, 3DS MAX, MAYA這些)比GTX 590快10倍以上