NVIDIA Nemotron 3.5 LightningモデルがAmazon SageMaker JumpStartで利用可能に
ID 5588
GUID 88caf411647d7c1d310fe05e47c166605847a192
発表日(JST)
要約生成日時(JST)
タイトル NVIDIA Nemotron 3.5 LightningモデルがAmazon SageMaker JumpStartで利用可能に
詳細リンク https://aws.amazon.com/about-aws/whats-new/2026/01/nvidia-nemotron-3.5-lightning-on-sagemaker-jumpstart/
カテゴリ
要点
  • NVIDIAのNemotron 3.5 LightningモデルがAmazon SageMaker JumpStartで利用可能になった
  • 永続的なエージェントワークロードと高スループットのエンタープライズオートメーション向けに設計
  • ハイブリッドMixture-of-Experts(MoE)アーキテクチャで総30Bパラメータ、フォワードパスあたり3Bアクティブ
  • 比較可能なモデルと比べて最大4倍のスループット(約410トークン/秒)と30%高速なタスク完了を実現
  • DFlash投機的デコーディングにより最大100万トークンのコンテキストを処理
  • オープンデータセットで完全にオープントレーニングされており、企業がカスタマイズ・デプロイ可能
  • SageMaker JumpStartから数クリックまたはSageMaker Python SDKでデプロイ可能
アップデート内容要約

NVIDIAのNemotron 3.5 LightningモデルがAmazon SageMaker JumpStartで利用可能になりました。このモデルは永続的なエージェントワークロードと高速タスク実行に最適化されたオープンモデルで、ハイブリッドMixture-of-Experts(MoE)アーキテクチャを採用し、最大4倍のスループットと30%高速なタスク完了を実現します。SageMaker JumpStartを通じて数クリックでデプロイ可能です。

アップデート内容全文

NVIDIAのNemotron 3.5 LightningがAmazon SageMaker JumpStartで利用可能になり、AWSのお客様は永続的なエージェントワークロードと高速タスク実行において、そのクラスで最速のオープンモデルにアクセスできるようになりました。
Nemotron 3.5 Lightningは、パーソナルアシスタント、金融文書処理、サイバーセキュリティトリアージ、通信オペレーションなど、さまざまなドメインにわたる永続エージェントおよび高スループットのエンタープライズオートメーション向けに設計されています。
総パラメータ数30B、フォワードパスあたりわずか3Bのアクティブパラメータを持つハイブリッドMixture-of-Experts(MoE)アーキテクチャ上に構築されており、比較可能なモデルと比べて最大4倍のスループット(約410トークン/秒)と30%高速なタスク完了を実現します。
Nemotron 3 Ultraから蒸留され、DFlash投機的デコーディングにより最大100万トークンのコンテキストを処理し、一般的なエージェントハーネスと直接統合されます。
このモデルはオープンデータセットで完全にオープントレーニングされており、企業は独自のツール、ワークフロー、ポリシーに合わせてポストトレーニングを行い、エッジ、オンプレミス、またはクラウドインフラストラクチャ全体で完全な所有権を持ってデプロイできます。
SageMaker JumpStartを使用すると、お客様は数クリックでこのモデルをデプロイし、特定のAIワークロードを実行できます。
これらのモデルの使用を開始するには、SageMakerコンソールのSageMaker JumpStartモデルカタログに移動するか、SageMaker Python SDKを使用してモデルをAWSアカウントにデプロイしてください。
SageMaker JumpStartでの基盤モデルのデプロイと使用に関する詳細は、Amazon SageMaker JumpStartのドキュメントを参照してください。

関連サービス
  • Amazon SageMaker
  • Amazon SageMaker JumpStart
関連サービスの説明
  • Amazon SageMaker JumpStartは、Amazon SageMakerの機能の一つで、事前トレーニング済みの基盤モデル(大規模言語モデルなど)を簡単に発見、デプロイ、微調整できるサービスです。モデルカタログから数クリックでモデルをデプロイでき、機械学習の専門知識がなくても最先端のAIモデルを活用できます。様々なプロバイダー(NVIDIA、Meta、Anthropicなど)のモデルが提供されています。
  • Amazon SageMakerは、機械学習モデルの構築、トレーニング、デプロイを包括的にサポートするフルマネージドサービスです。データの準備、モデルの開発、トレーニング、チューニング、本番環境へのデプロイまで、機械学習ワークフロー全体をカバーしています。Python SDKも提供されており、プログラムからモデルの管理やデプロイを行うことも可能です。
関連URL