「世界中のAIがOCI上で作られている」–オラクル担当幹部がAIインフラをアピール

今回は「「世界中のAIがOCI上で作られている」–オラクル担当幹部がAIインフラをアピール」についてご紹介します。

関連ワード (ITインフラ等) についても参考にしながら、ぜひ本記事について議論していってくださいね。

本記事は、ZDNet Japan様で掲載されている内容を参考にしておりますので、より詳しく内容を知りたい方は、ページ下の元記事リンクより参照ください。


 OracleでOracle Cloud Infrastructure(OCI)担当エグゼクティブ・バイスプレジデントを務めるMahesh Thiagarajan(マヘシュ・シャガラジャン)氏が都内でグループインタビューに応じた。米国ラスベガスで開催の年次カンファレンス「Oracle CloudWorld 2024」で発表された「OCI Supercluster」をはじめとする同社のAIインフラストラクチャーについて戦略を明らかにした。

 同社のAIインフラは、OCI上で提供されるAIサービスである。生成AI、コンピュータビジョン、予測分析などの高度なAIワークロードを迅速に実行するための機能が含まれる。Thiagarajan氏は「幅広いAIインフラストラクチャーを提供しており、最も要求の厳しいAIワークロードをクラウドで実行される顧客を支援している。Oracleの分散クラウドを活用することで、顧客は最高レベルのデータとAIの主権を維持しながら、クラウドサービスやAIサービスを利用したい場所で柔軟に導入できる」と述べる。

 OCIのAIインフラの特徴としては(1)GPUの性能を極限まで引き出すベアメタルサーバー、(2)大規模にスケール可能なOCI Supercluster、(3)I/Oがボトルネックにならない高性能なストレージ――の3点が挙げられる。

 まず1つ目としては、GPUサーバーをベアメタルインスタンスで提供するため、仮想化によるオーバーヘッドが発生せず、GPUの性能を最大限に引き出すことができる。また、GPUに最適なサーバーをNVIDIAと共同で開発しているという。「われわれは、AIトレーニングのためにベアメタルGPUを提供する唯一のハイパースケーラーだ」とThiagarajan氏は強調する。

 2つ目のOCI Superclusterは、最大13万1072基の「NVIDIA Blackwell GPU」を搭載可能なコンピューティングクラスターである。ピーク性能は最大2.4ゼタFLOPSに達し、米国オークリッジ国立研究所のスーパーコンピューター「Frontier」の3倍以上、他のハイパースケーラーの6倍以上のGPU数を提供するという。また、RDMA over Converged Ethernet version 2(RoCE v2)またはNVIDIA Quantum-2 InfiniBandベースの超低遅延ネットワークにより、「GPUを最大限に活用してもネットワークのボトルネックは発生しない」(Thiagarajan氏)という。

 なお、OCI Superclusterは、「NVIDIA H100/H200 Tensor Core GPU」、またはNVIDIA Blackwell GPUを搭載した「OCI Compute」とともに注文を受け付けている。H100を搭載したシステムは、最大1万6384GPUまで拡張でき、最大65エクサFLOPSの性能と13Pb/sのネットワークスループットを提供する。H200を搭載したシステムは、最大6万5536GPUまで拡張でき、最大260エクサFLOPSの性能と52Pb/sのネットワークスループットを提供し、2024年後半に利用を開始する予定。

 「NVIDIA GB200 NVL72」を搭載した液冷ベアメタルインスタンスは、NVLinkおよびNVLink Switchを使用して、単一のNVLinkドメイン内で最大72基のBlackwell GPUと通信し、129.6TB/sの帯域幅を提供する。2025年前半に利用可能になる予定のNVIDIA Blackwell GPUは、第5世代のNVLink、NVLink Switch、およびクラスターネットワーキングを活用し、単一のクラスター内でシームレスなGPU間通信を実現するとしている。

 3つ目はストレージである。「OCI File Storageサービス」の高性能マウントターゲット(HPMT)を利用することで、1テラバイト当たり最大1Gbpsの高スループットでAIワークロードのストレージアクセスが可能になる。また、「マネージドLustreサービス」の利用によって、1TB当たり最大8Gbpsの超高性能なストレージアクセスも可能になる。現在は早期アクセスを提供しており、2025年2月に一般提供を開始する予定となっている。

 「OCIは顧客のニーズを満たすために、10日ごとに1万GPUという記録的な速さで大量のGPUをデリバリーしている」とThiagarajan氏はアピールし、最大規模の大規模言語モデル(LLM)のうちの4つがOCI上で稼働していることを明らかにした。

 「大手LLMからAIスタートアップまで多くの企業がOCIのAIインフラを使っている。世界中のAIがOCI上で作られているといっても過言ではない」(Thiagarajan氏)

COMMENTS


Recommended

TITLE
CATEGORY
DATE
グローバル学生特化型プラットフォーム「JPort」のSPeakが8000万円調達、就活のボーダーレス化目指す
HRテック
2021-05-21 20:37
Reddit、サイバー犯罪集団から脅迫される–要求はAPI有料化の撤回
IT関連
2023-06-22 21:12
アリババ、経営体制を刷新へ–現CEOはクラウド事業に専念
IT関連
2023-06-22 08:36
【3月14日】掲載記事アクセスランキング・トップ5―1位はロシアがInstagramのブロック、2位は第3世代iPhone SE
IT関連
2022-03-15 14:35
「LibreOffice」のUIを自分の好みに合わせて変更するには
IT関連
2023-08-16 00:35
中国の偽物・不正ビジネスに切り込む「暴露系」動画が注目を集める
IT関連
2023-11-22 07:50
AWSが「ChatGPT」対抗の生成AIを出す可能性はあるか–AWSジャパン技術幹部に聞いてみた
IT関連
2023-08-05 00:18
Coral Capitalが投資先スタートアップ向けに新型コロナワクチン合同職域接種の開始を発表
VC / エンジェル
2021-06-09 05:47
新種のランサムウェアとその亜種、2021年には大幅に減少–ウィズセキュア調査
IT関連
2022-06-28 23:04
RSA、IDaaSの国内展開を本格化–データセンターの新設で需要拡大に対応
IT関連
2024-01-16 10:14
ニュータニックス、DataRobot、日立システムズが連携–オンプレ生成AIソリューションの実現へ
IT関連
2024-10-13 02:48
ビックカメラ、100億円規模のVC設立 「オープンイノベーションを加速」
企業・業界動向
2021-06-29 01:40
自社製品の改善と社内のIT活用に尽力–パロアルトネットワークスのCIOの役割
IT関連
2024-10-12 23:34
国内クラウド市場は5年で約2倍成長、2028年には16兆円超に。今後は基幹系システムのクラウド移行などが牽引。IDC Japan
クラウド
2024-06-14 05:57