NVIDIA¤¬¿ôÃû¥Ñ¥é¥á¡¼¥¿µ¬ÌϤÎAI¥â¥Ç¥ë¤ò¼Â¸½¤¹¤ëGPU¥¢¡¼¥¥Æ¥¯¥Á¥ã¡ÖBlackwell¡×¤È¿·GPU¡ÖB200¡×¤òȯɽ

NVIDIA¤¬µ»½Ñ¥«¥ó¥Õ¥¡¥ì¥ó¥¹¡ÖGTC 2024¡×¤ÎÃæ¤Ç¡¢2ǯ¤Ö¤ê¤Î¿·¤¿¤ÊGPU¥¢¡¼¥¥Æ¥¯¥Á¥ã¡ÖBlackwell¡×¤È¡¢Blackwell¥¢¡¼¥¥Æ¥¯¥Á¥ã¥Ù¡¼¥¹¤ÎGPU¡ÖB200¡×¤òȯɽ¤·¤Þ¤·¤¿¡£Blackwell¤Ë¤è¤ê¡¢¤¢¤é¤æ¤ëÁÈ¿¥¤¬¥³¥¹¥È¤È¥¨¥Í¥ë¥®¡¼¾ÃÈñ¤ò25ʬ¤Î1¤ËÍÞ¤¨¡¢¿ôÃû¥Ñ¥é¥á¡¼¥¿¤ÎÂ絬ÌϸÀ¸ì¥â¥Ç¥ë(LLM)¤Ë¤è¤ë¥ê¥¢¥ë¥¿¥¤¥àÀ¸À®AI¤ò¹½ÃÛ¡¦¼Â¹Ô²Äǽ¤Ë¤Ê¤ë¤ÈNVIDIA¤Ï½Ò¤Ù¤Æ¤¤¤Þ¤¹¡£
https://www.nvidia.com/ja-jp/data-center/technologies/blackwell-architecture/

Blackwell¥¢¡¼¥¥Æ¥¯¥Á¥ã¤Ï¡¢2022ǯ¤Ëȯɽ¤µ¤ì¤¿Hopper¥¢¡¼¥¥Æ¥¯¥Á¥ã¤Î¸å·Ñ¤Ç¤¹¡£Ì¾Á°¤Ï¡¢¥¢¥á¥ê¥«²Ê³Ø¥¢¥«¥Ç¥ß¡¼¤Ë¥¢¥Õ¥ê¥«·Ï¥¢¥á¥ê¥«¿Í¤È¤·¤Æ½é¤á¤ÆÅÂÆ²Æþ¤ê¤·¤¿¿ô³Ø¼Ô¡¦Åý·×³Ø¼Ô¤Î
¥Ç¥Ó¥Ã¥É¡¦¥Ï¥í¥ë¥É¡¦¥Ö¥é¥Ã¥¯¥¦¥§¥ë¤«¤éºÎ¤é¤ì¤Þ¤·¤¿¡£
NVIDIA¤¬¼¡À¤ÂåGPU¥¢¡¼¥¥Æ¥¯¥Á¥ã¡ÖHopper¡×¤òȯɽ¡¢AI½èÍý®ÅÙ¤¬Ampere¤Î6ÇܤʤɳƼïÀǽ¤¬ÈôÌöŪ¤Ë¸þ¾å - GIGAZINE

NVIDIA¤Ë¤è¤ì¤Ð¡¢Blackwell¤Ë¤Ï6¤Ä¤Î³×¿·Åª¥Æ¥¯¥Î¥í¥¸¡¼¤¬ÅëºÜ¤µ¤ì¤Æ¤¤¤ë¤È¤Î¤³¤È¡£
¢¡1¡§À¤³¦¤ÇºÇ¤â¶¯ÎϤʥÁ¥Ã¥×
Hopper¥¢¡¼¥¥Æ¥¯¥Á¥ã¤ÎGPU¡¦H100¤ÏTSMC¤Î4nm¥×¥í¥»¥¹¤ÇÀ½Â¤¤µ¤ì¤¿¥È¥é¥ó¥¸¥¹¥¿¤ò800²¯¸ÄÅëºÜ¤·¤Æ¤¤¤Þ¤¹¤¬¡¢Blackwell GPU¤Ï4nm¥×¥í¥»¥¹¤Î²þÎÉÈǤÇÀ½Â¤¤µ¤ì¤¿¥È¥é¥ó¥¸¥¹¥¿¤ò2080²¯¸ÄÅëºÜ¡£¸Â³¦¥µ¥¤¥º¤ÎGPU¥À¥¤2¤Ä¤òËèÉÃ10TB¤Î¹â®¥¤¥ó¥¿¡¼¥Õ¥§¡¼¥¹¡ÖNV-HBI¡×¤ÇÀܳ¤¹¤ë¤³¤È¤Ç¡¢1¤Ä¤ÎGPU¤È¤·¤Æ°·¤¤¤Þ¤¹¡£
¢¡2¡§Âè2À¤ÂåTransformer Engine
LLMºÇŬ²½¤Î¤¿¤á¤Î¥é¥¤¥Ö¥é¥ê¡ÖNVIDIA TensorRT-LLM¡×¤È¡ÖNeMo¡×¥Õ¥ì¡¼¥à¥ï¡¼¥¯¤òÁȤ߹ç¤ï¤»¤¿¥À¥¤¥Ê¥ß¥Ã¥¯¥ì¥ó¥¸´ÉÍý¥¢¥ë¥´¥ê¥º¥à¤È¡¢¿·¤·¤¤¥Þ¥¤¥¯¥í¥Æ¥ó¥½¥ë¥¹¥±¡¼¥ê¥ó¥°¤Î¥µ¥Ý¡¼¥È¤Ë¤è¤ê¡¢¿·¤¿¤Ê4¥Ó¥Ã¥ÈÉâÆ°¾®¿ôÅÀAI¿äÏÀµ¡Ç½¤Ç¥³¥ó¥Ô¥å¡¼¥Æ¥£¥ó¥°¤È¥â¥Ç¥ë¤Î¥µ¥¤¥º¤¬2Çܤˤʤê¤Þ¤¹¡£
¢¡3¡§Âè5À¤ÂåNVLink
¹â®GPU¥¤¥ó¥¿¡¼¥³¥Í¥¯¥È¡ÖNVLink¡×¤ÎºÇ¿·¥Ð¡¼¥¸¥ç¥ó¤Ë¤è¤ê¡¢GPU¤¢¤¿¤êËèÉÃ1.8TB¤ÎÁÐÊý¸þ¥¹¥ë¡¼¥×¥Ã¥È¤ò¼Â¸½¤·¡¢µðÂçLLM¸þ¤±¤ËºÇÂç576´ð¤ÎGPU´Ö¤Ç¤Î¥·¡¼¥à¥ì¥¹¤Ê¹â®ÄÌ¿®¤òÊݾڤ·¤Æ¤¤¤Þ¤¹¡£
¢¡4¡§RAS¥¨¥ó¥¸¥ó
ÀìÍѤÎRAS(¿®ÍêÀ¡¦²ÄÍÑÀ¡¦ÊݼéÀ)¥¨¥ó¥¸¥ó¤òÈ÷¤¨¤ë¤Û¤«¡¢¥Á¥Ã¥×¥ì¥Ù¥ë¤ÇAI¥Ù¡¼¥¹¤ÎͽËÉÊݼ鵡ǽ¤¬Äɲ乤뤳¤È¤Ç²óÉüÎϤò¹â¤á¡¢¥·¥¹¥Æ¥à¤Î²ÔƯ»þ´Ö¤òºÇÂç²½¤·¡¢±¿ÍÑ¥³¥¹¥È¤òºï¸º¤·¤Þ¤¹¡£
¢¡5¡§°ÂÁ´¤ÊAI
¹âÅ٤ʡ֥³¥ó¥Õ¥£¥Ç¥ó¥·¥ã¥ë¥³¥ó¥Ô¥å¡¼¥Æ¥£¥ó¥°¡×µ¡Ç½¤¬¡¢¿·¤¿¤Ê¥Í¥¤¥Æ¥£¥Ö¥¤¥ó¥¿¡¼¥Õ¥§¥¤¥¹°Å¹æ²½¥×¥í¥È¥³¥ë¤ò¥µ¥Ý¡¼¥È¤·¡¢¥Ï¡¼¥É¥¦¥§¥¢¥Ù¡¼¥¹¤Î¶¯ÎϤʥ»¥¥å¥ê¥Æ¥£¤Ë¤è¤ê¡¢µ¡Ì©¥Ç¡¼¥¿¤äAI¥â¥Ç¥ë¤òÉÔÀµ¥¢¥¯¥»¥¹¤«¤éÊݸ¤Þ¤¹¡£¥³¥ó¥Õ¥£¥Ç¥ó¥·¥ã¥ë¥³¥ó¥Ô¥å¡¼¥Æ¥£¥ó¥°¤Ï¡¢°Å¹æ²½¤Ê¤·¥â¡¼¥É¤È¤Û¤ÜƱÅù¤Î¥¹¥ë¡¼¥×¥Ã¥È¥Ñ¥Õ¥©¡¼¥Þ¥ó¥¹¤òȯ´ø¤·¤Þ¤¹¡£
¢¡6¡§²òÅ२¥ó¥¸¥ó
ÀìÍѤβòÅ२¥ó¥¸¥ó¤¬LZ4¡¢Snappy¡¢Deflate¤Ê¤ÉºÇ¿·¤Î°µ½Ì·Á¼°¤ò¥µ¥Ý¡¼¥È¡£¤Þ¤¿¡¢Grace CPU¤ÎÂçÍÆÎÌ¥á¥â¥ê¤ËËèÉÃ900GB¤ÎÁÐÊý¸þÂÓ°èÉý¤Ç¹â®¥¢¥¯¥»¥¹¤Ç¤¤ëµ¡Ç½¤Ë¤è¤ê¡¢¥Ç¡¼¥¿¥Ù¡¼¥¹¥¯¥¨¥êÁ´ÂΤò¹â®²½¤·¡¢¥Ç¡¼¥¿Ê¬ÀϤä¥Ç¡¼¥¿¥µ¥¤¥¨¥ó¥¹¤ÇºÇ¹â¤Î¥Ñ¥Õ¥©¡¼¥Þ¥ó¥¹¤ò¼Â¸½¤·¤Þ¤¹¡£
¤³¤ÎBlackwell¥¢¡¼¥¥Æ¥¯¥Á¥ã¥Ù¡¼¥¹¤ÎGPU¤¬¡ÖB200¡×¤Ç¤¹¡£
¤Ê¤ª¡¢¤³¤Î̾Á°¤ÏÀµ¼°È¯É½°ÊÁ°¤Î2024ǯ2·î¡¢Dell¤Î¥¸¥§¥Õ¡¦¥¯¥é¡¼¥¯Éû²ñŤ¬¡Ö¾ÃÈñÅÅÎÏ1000W¤ÎGPU¤òNVIDIA¤¬³«È¯Ãæ¤Ç¤¢¤ë¡×¤È¤¤¤¦Ê¸Ì®¤ÎÃæ¤Ç½Ð¤·¤¿¤³¤È¤¬¤¢¤ê¤Þ¤¹¡£
NVIDIA¤¬¡Ö¾ÃÈñÅÅÎÏ1000W¤ÎÇúÇ®GPU¡×¤ò³«È¯Ã椫 - GIGAZINE

B200¤òÍѤ¤¤¿¥×¥é¥Ã¥È¥Õ¥©¡¼¥à¤È¤·¤Æ¤Ï¡¢2´ð¤ÎB200¤È1´ð¤ÎGrace CPU¤òÀܳ¤·¤¿¥¹¡¼¥Ñ¡¼¥Á¥Ã¥×¡ÖGB200¡×¡¢72´ð¤ÎB200¤È36´ð¤ÎGrace¤òÁȤ߹ç¤ï¤»¤¿Àܳ¤·¤¿¡ÖGB200 NVL72¡×¡¢B200¤ò8´ð¤òÀܳ¤·¤¿Åý¹çAI¥×¥é¥Ã¥È¥Õ¥©¡¼¥à¡ÖDGX B200¡×¤È¥µ¡¼¥Ð¡¼¥Ü¡¼¥É¡ÖHGX B200¡×¤Ê¤É¤ÎÀ½Éʤ¬¼¨¤µ¤ì¤Æ¤¤¤Þ¤¹¡£¤Þ¤¿¡¢GB200¤ò36´ðÁȤ߹ç¤ï¤»¤¿¡ÖDGX GB200¡×¥·¥¹¥Æ¥à¡¢DGX GB200¤Ç¹½ÃÛ¤µ¤ì¤¿¼¡À¤ÂåAI¥¹¡¼¥Ñ¡¼¥³¥ó¥Ô¥å¡¼¥¿¡¼¡ÖDGX SuperPOD¡×¤Ê¤É¤âȯɽ¤µ¤ì¤Æ¤¤¤Þ¤¹¡£
NVIDIA GB200 NVL72 Delivers Trillion-Parameter LLM Training and Real-Time Inference | NVIDIA Technical Blog
https://developer.nvidia.com/blog/nvidia-gb200-nvl72-delivers-trillion-parameter-llm-training-and-real-time-inference/
NVIDIA Launches Blackwell-Powered DGX SuperPOD for Generative AI Supercomputing at Trillion-Parameter Scale | NVIDIA Newsroom
https://nvidianews.nvidia.com/news/nvidia-blackwell-dgx-generative-ai-supercomputing
Åý¹çAI¥×¥é¥Ã¥È¥Õ¥©¡¼¥à¡ÖDGX B200¡×¤Ï¡¢¶õÎä¼°¥é¥Ã¥¯¥Þ¥¦¥ó¥È·¿DGX¥×¥é¥Ã¥È¥Õ¥©¡¼¥à¤ÎÂè6À¤Âå¤Ë¤¢¤¿¤ê¤Þ¤¹¡£8´ð¤ÎB200¤È2´ð¤ÎIntel Xeon¥×¥í¥»¥Ã¥µ¤òÅëºÜ¤·¡¢ºÇÂç¤Ç144PFLOPS¤ÎAI¥Ñ¥Õ¥©¡¼¥Þ¥ó¥¹¤È1.4TB¤ÎÂçÍÆÎÌGPU¥á¥â¥ê¡¢ËèÉÃ64TB¤Î¥á¥â¥êÂÓ°èÉý¤Ë¤è¤ê¡¢1Ãû¥Ñ¥é¥á¡¼¥¿¥â¥Ç¥ë¤Î¥ê¥¢¥ë¥¿¥¤¥à¿äÏÀ¤Ç¡¢Hopper¥¢¡¼¥¥Æ¥¯¥Á¥ã¤ÈÈæ¤Ù¤Æ15Çܤι⮲½¤ò¼Â¸½¤·¤Æ¤¤¤Þ¤¹¡£

¡ÖDGX SuperPOD¡×¤Ï¡¢¥¸¥§¥ó¥¹¥ó¡¦¥Õ¥¢¥óCEO¤¬¡ÖAI»º¶È³×Ì¿¤Î¹©¾ì¡×¤Èɽ¸½¤¹¤ë¥¹¥Ñ¥³¥ó¤Ç¡¢¡ÖNVIDIA¥¢¥¯¥»¥é¥ì¡¼¥Æ¥Ã¥É¥³¥ó¥Ô¥å¡¼¥Æ¥£¥ó¥°¡¢¥Í¥Ã¥È¥ï¡¼¥¥ó¥°¡¢¥½¥Õ¥È¥¦¥§¥¢¤ÎºÇ¿·¤Î¿ÊÊâ¤òÁȤ߹ç¤ï¤»¤Æ¡¢¤¢¤é¤æ¤ë´ë¶È¡¢¶È³¦¡¢¹ñ¤¬ÆÈ¼«¤ÎAI¤ò²þÎɤ·¡¢À¸À®¤Ç¤¤ë¤è¤¦¤Ë¤·¤Þ¤¹¡×¤È¤Î¤³¤È¡£NVIDIA Quantum-2 InfiniBand ¥¢¡¼¥¥Æ¥¯¥Á¥ã¤Ë¤è¤ê¡¢GB200¥Á¥Ã¥×¤ò¿ôËü¸ÄÅëºÜ¤¹¤ë¤³¤È¤¬¤Ç¤¤Þ¤¹¡£

¤Þ¤¿¡¢ÊÌÅÓȯɽ¤µ¤ì¤¿¡ÖQuantum-X800 InfiniBand ¥Í¥Ã¥È¥ï¡¼¥¥ó¥°¡×¤ò¥µ¥Ý¡¼¥È¤¹¤ë¤³¤È¤Ç¡¢¥×¥é¥Ã¥È¥Õ¥©¡¼¥àÆâ¤Î³ÆGPU¤ËºÇÂç¤ÇËèÉÃ1800GB¤ÎÂÓ°èÉý¤òÄ󶡤·¤Þ¤¹¡£
¤µ¤é¤Ë¡¢Âè4À¤Âå¤ÎSHARP(Scalable Hierarchical Aggregation and Reduction Protocol)¥Æ¥¯¥Î¥í¥¸¡¼¤Ë¤è¤ê¡¢Á°À¤ÂåÈæ¤Ç4ÇܤȤʤë14.4TFLOPS¤ÎÀǽ¤ò¼Â¸½¤·¤Æ¤¤¤ë¤È¤Î¤³¤È¤Ç¤¹¡£
