SageMaker HyperPod、推論向けモデルキャッシュに対応
2026/09/11 リリース
AWSはAmazon SageMaker HyperPodで、モデルの重みとコンテナイメージをクラスターノードに事前配置するモデルキャッシュを一般提供します。ローカルNVMeから読み込むことで、スケールアウトを約60%高速化し、コンテナイメージの取得時間を97%削減できます。キャッシュがないノードでは従来のS3、FSx、ECRからの取得に自動的に切り替わります。
正確な内容・最新情報は公式情報をご確認ください。
元記事を確認する