Abo
  • Services:
Anzeige
Nvidia-Chef Jen-Hsun Huang stellt den GP100 vor.
Nvidia-Chef Jen-Hsun Huang stellt den GP100 vor. (Bild: Marc Sauter/Golem.de)

Pascal GP100: Nvidias Grafikchip besteht aus 15 Milliarden Transistoren

Nvidia-Chef Jen-Hsun Huang stellt den GP100 vor.
Nvidia-Chef Jen-Hsun Huang stellt den GP100 vor. (Bild: Marc Sauter/Golem.de)

15,3 Milliarden Transistoren auf 610 mm² Chipfläche im 16FF-Prozess und 3.840 Shader-Einheiten mit 16 GByte HBM2-Speicher: Nvidia hat den GP100-Grafikchip mit Pascal-Technik vorgestellt.

Nvidia-Chef Jen-Hsun Huang hat auf der Keynote der GPU Technology Conference 2016 in San Jose, Kalifornien, den GP100-Grafikchip samt der Tesla-P100-Beschleunigerkarte angekündigt. Die auf der Pascal-Architektur basierende Tesla P100 erreicht eine Geschwindigkeit von 10,6 Teraflops bei einfacher Genauigkeit (FP32), was für Spiele wichtig ist. Die für wissenschaftliche Anwendungen relevante FP64-Performance (doppelte Genauigkeit) gibt Nvidia mit 5,3 Teraflops an - das Verhältnis 2:1 gab es bisher nur bei AMD.

Anzeige

Der GP100-Chip wird im 16FF-Prozess bei der TSMC gefertigt und besteht aus 15 Milliarden Transistoren. Zum Vergleich: Nvidias aktueller GM200 der Titan X integriert 8 Milliarden Transistoren und AMDs Fiji der Fury X 8,9 Milliarden Transistoren. Die Die-Fläche des GP100 gibt Nvidia mit enormen 610 mm² an, was etwas größer als der GM200 (601 mm²) und der Fiji (596 mm²) ist. Der Chip soll sich bereits in der Serienfertigung befinden, was angesichts der Maße erstaunlich ist. Fragen zur Yield-Rate wollte Nvidia nicht beantworten.

  • Nvidia-Chef Jen-Hsun Huang (Foto: Marc Sauter/Golem.de)
  • Jen-Hsun Huang stellt die Tesla P100 vor. (Foto: Marc Sauter/Golem.de)
  • Die Tesla P100 schafft 21,2 Teraflops. (Foto: Marc Sauter/Golem.de)
  • Tesla P100 (Foto: Marc Sauter/Golem.de)
  • Leistungswerte der Tesla P100 (Foto: Marc Sauter/Golem.de)
  • Der Chip wird im 16FF-Prozess hergestellt und nutzt HBM2. (Foto: Marc Sauter/Golem.de)
  • Blockdiagramm des GP100 (Foto: Marc Sauter/Golem.de)
  • Blockdiagramm eines SM eines GP100 (Foto: Marc Sauter/Golem.de)
Die Tesla P100 schafft 21,2 Teraflops. (Foto: Marc Sauter/Golem.de)

Die Basis für den neuen GP100 bilden sechs Graphics Processor Cluster (GPC). Jeder enthält fünf Texture Processor Cluster (TPC) mit zwei Streaming Multiprocessors (SMP) mit 64 Shader- und 40 Textur-Einheiten, was an AMDs GCN erinnert. Insgesamt bietet der Chip ergo 3.840 ALUs und 240 TMUs, der L2-Cache fasst 4 MByte. Hinzu kommen 15,36 MByte an Register-Speicher für schnelle On-Chip-Berechnungen. Das Speicherinterface ist 4.096 Bit breit und nutzt High Bandwidth Memory (HBM2), der mit auf einem Interposer sitzt.

Für die Tesla P100 schaltet Nvidia 3.584 Shader-Einheiten frei und taktet sie mit 1.328 MHz Basis- und 1.480 MHz Boost-Frequenz. Daraus resultieren 21,2 Teraflops bei halber Genauigkeit (FP16). Bei einfacher Genauigkeit (FP32) sind es 10,6 Teraflops und bei doppelter Genauigkeit (FP64) noch 5,3 Teraflops. Nvidia verbaut FP32-Einheiten, die pro Takt zwei FP16-Berechnungen durchführen können, und dedizierte FP64-ALUs. Das 4:2:1-Verhältnis ist untypisch, bisherige Nvidia-Architekturen beherrschen bis zu 3:1 für FP32/FP64. Nicht beschleunigt ist INT8, also Integer mit acht Bit Genauigkeit, was andere Pascal-Chips bei vierfacher FP32-Geschwindigkeit ausführen können (sofern freigeschaltet).

  • Nvidia-Chef Jen-Hsun Huang (Foto: Marc Sauter/Golem.de)
  • Jen-Hsun Huang stellt die Tesla P100 vor. (Foto: Marc Sauter/Golem.de)
  • Die Tesla P100 schafft 21,2 Teraflops. (Foto: Marc Sauter/Golem.de)
  • Tesla P100 (Foto: Marc Sauter/Golem.de)
  • Leistungswerte der Tesla P100 (Foto: Marc Sauter/Golem.de)
  • Der Chip wird im 16FF-Prozess hergestellt und nutzt HBM2. (Foto: Marc Sauter/Golem.de)
  • Blockdiagramm des GP100 (Foto: Marc Sauter/Golem.de)
  • Blockdiagramm eines SM eines GP100 (Foto: Marc Sauter/Golem.de)
Tesla P100 (Foto: Marc Sauter/Golem.de)

Am 4.096-Bit-Interface hängen 16 GByte HBM2 von Samsung. Die vier Stacks liefern eine Datentransfer-Rate von 720 GByte pro Sekunde. Das entspricht rund 1,4 GHz - HBM2 schafft allerdings bis zu 2 GHz. Da die Tesla P100 allerdings keinen GP100-Vollausbau nutzt, ist eine gedrosselte Speichergeschwindigkeit sinnvoll, um die 300 Watt TDP einzuhalten.

Vorerst erhalten Cloud-Plattform-Anbieter Zugriff auf die Tesla-P100-Karten, einzelne Hersteller folgen im ersten Quartal 2017. Ein auf dem GP100 basierendes Geforce-Modell hat Nvidia nicht angekündigt.


eye home zur Startseite
Ach 06. Apr 2016

Das Problem ist heutzutage halt, dass der Speicher zum Nadelöhr wird. 4K, 8K und HDRI...

Golressy 06. Apr 2016

Cloud-Plattform-Anbieter erhalten die Karten nur? Da die meisten Clouds ja auf Linux/Unix...

Prypjat 06. Apr 2016

Das ist ein treffender Vergleich. Viele Online Shops haben die Angabe zum Speicher in den...

anonym 06. Apr 2016

ach deswegen gibts den dgx1 mit 8 tesla p100 die per pcie and 2 xeons angebunden sind...

Poison Nuke 06. Apr 2016

und ob. Für jedes Frame muss der gesamte Speicherinhalt einmal ausgelesen werden. Die...



Anzeige

Stellenmarkt
  1. neam IT-Services GmbH, Paderborn
  2. PTV Group, Karlsruhe
  3. HAGEMEYER Deutschland GmbH & Co. KG, München
  4. über Hays AG, Mannheim


Anzeige
Blu-ray-Angebote
  1. (u. a. Hobbit Trilogie Blu-ray 43,89€ und Batman Dark Knight Trilogy Blu-ray 17,99€)
  2. 299,99€ (Vorbesteller-Preisgarantie)
  3. 24,99€ (Vorbesteller-Preisgarantie)

Folgen Sie uns
       


  1. Deutsche Telekom

    Weitere 39.000 Haushalte bekommen heute Vectoring

  2. Musikerkennungsdienst

    Apple erwirbt Shazam

  3. FTTH

    EWE senkt die Preise für seine Glasfaserzugänge

  4. WLAN

    Zahl der Vodafone-Hotspots steigt auf zwei Millionen

  5. Linux-Grafiktreiber

    Mesa 17.3 verbessert Vulkan- und Embedded-Treiber

  6. Gemini Lake

    Intel bringt Pentium Silver mit Gigabit-WLAN

  7. MG07ACA

    Toshiba packt neun Platter in seine erste 14-TByte-HDD

  8. Sysinternals-Werkzeug

    Microsoft stellt Procdump für Linux vor

  9. Forschungsförderung

    Medizin-Nobelpreisträger Rosbash kritisiert Trump

  10. Sicherheit

    Keylogger in HP-Notebooks gefunden



Haben wir etwas übersehen?

E-Mail an news@golem.de


Anzeige
Bundesregierung: Mit verdrehten Zahlen gegen die ePrivacy-Verordnung
Bundesregierung
Mit verdrehten Zahlen gegen die ePrivacy-Verordnung
  1. Steuerstreit Apple zahlt 13 Milliarden Euro an Irland
  2. Rechtsunsicherheit bei Cookies EU warnt vor Verzögerung von ePrivacy-Verordnung
  3. Datenschutz EU-Parlament stimmt ePrivacy-Verordnung zu

Dynamics 365: Microsoft verteilt privaten Schlüssel an alle Kunden
Dynamics 365
Microsoft verteilt privaten Schlüssel an alle Kunden
  1. Microsoft Kollaboratives Whiteboard als Windows-10-Preview verfügbar
  2. Microsoft-Studie Kreative Frauen interessieren sich eher für IT und Mathe
  3. Connect 2017 Microsoft setzt weiter auf Enterprise-Open-Source

Amazon Video auf Apple TV im Hands on: Genau das fehlt auf dem Fire TV
Amazon Video auf Apple TV im Hands on
Genau das fehlt auf dem Fire TV
  1. Amazon Verkaufsbann für Apple TV bleibt bestehen
  2. Smartphone-Speicherkapazität Wie groß der Speicher eines iPhones sein sollte
  3. Mate 10 Pro im Test Starkes Smartphone mit noch unauffälliger KI

  1. Re: Lüge...

    No name089 | 04:17

  2. Re: Homescreen unbrauchbar!

    No name089 | 04:14

  3. Jeder der neun Platter ...

    amagol | 04:04

  4. Re: "Microsoft loves Linux"

    Teebecher | 04:02

  5. Re: Wie halten die das Helium da drin?

    maverick1977 | 03:33


  1. 19:10

  2. 18:55

  3. 17:21

  4. 15:57

  5. 15:20

  6. 15:00

  7. 14:46

  8. 13:30


  1. Themen
  2. A
  3. B
  4. C
  5. D
  6. E
  7. F
  8. G
  9. H
  10. I
  11. J
  12. K
  13. L
  14. M
  15. N
  16. O
  17. P
  18. Q
  19. R
  20. S
  21. T
  22. U
  23. V
  24. W
  25. X
  26. Y
  27. Z
  28. #
 
    •  / 
    Zum Artikel