メインコンテンツへスキップ

LLMの学習・推論に最適なGPUクラウドプロバイダー

クラウドでの学習、ファインチューニング、提供、およびサーバーレス推論に適した、手頃なGPUプロバイダーをご紹介します。
更新 2026年8月10日  · 10 分 読む

AIで探索

ChatGPTで開くClaudeで開くPerplexityで開く

データサイエンティスト、MLエンジニア、LLMエンジニアは役割こそ異なりますが、インフラに求めるものはたいてい同じです——できるだけ少なく、シンプルであること。クラウド環境の設定やAWSの複雑なサービスに何時間も費やしたくはありません。数回クリックして、ターミナルやJupyter Notebookを開き、テンプレートを選んで、学習・ファインチューニング・提供をすぐに始めたいのです。

本ガイドに挙げるプロバイダーは、その発想で選定しています。使いやすいダッシュボード、事前構成済みの環境、ノートブック、ターミナル、コンテナテンプレート、わかりやすいセットアップガイドを提供します。Jupyterが標準で用意されていない場合でも、ほとんどは数分で導入できます。

とはいえ、すべてが同じユーザーを対象としているわけではありません。価格やハードウェア選択を軸にしたマーケットプレイスもあれば、予測可能な仮想マシン、サーバーレスGPU実行、マネージド推論、分散学習向けのエンタープライズ規模のクラスターを提供するところもあります。ここでは、GPUマーケットプレイスと柔軟なキャパシティネットワーク、セルフサービス型AI GPUクラウド、エンタープライズ規模のAIクラウド、開発者ファーストでノートブックに優しいプラットフォームの4カテゴリで10サービスを比較します。

GPUマーケットプレイスと柔軟なキャパシティネットワーク

GPTマーケットプレイスは、分散GPUキャパシティへの柔軟なアクセスを中心に設計されています。実験、バッチジョブ、短時間のファインチューニング、ハードウェア選択やコストが最重要な場面で便利です。

1. Vast.ai

Vast.aiは、モデル提供やLLMのファインチューニングで手頃なGPUを探す際に、私が最も頻繁に使うプラットフォームです。

マーケットプレイスには多様なGPUマシンが並び、ハードウェア、VRAM、信頼性、ロケーション、価格で比較できます。各リスティングでは計算とストレージの費用が明確に分解され、支払い内容が一目でわかります。

Vast.ai website

インスタンスはJupyter Notebook、ブラウザーベースのターミナル、SSH、VS Code接続に対応。短時間のテストなら、数十円程度でインスタンスを停止することもよくあります。ただし、ハードウェアが複数のマーケットプレイス提供者から来るため、マシンの空き状況や信頼性にばらつきが出る場合があります。

おすすめ用途: 手頃なコストでの実験、モデル提供、LoRAファインチューニング、バッチ推論。

2. RunPod

RunPodは私のお気に入りのGPUプラットフォームで、LLMのファインチューニングと推論に数百ドルを費やしてきました。

Vast.aiより高速かつ使いやすい一方で、計算とストレージのコストを加味すると優良なマシンは高額になる場合があります。RunPodはテンプレート、JupyterLab、Webターミナル、SSH、VS Code連携が揃っており、ほぼ箱から出してすぐ使えます。

Runpod Website

最近の唯一の課題はGPUの空き状況です。人気のマシンが時々利用不可になり、待つか、より高価なオプションを選ばざるを得ないことがあります。それでも、複雑なクラウドインフラを学ばずにモデルの学習や提供を行いたいデータサイエンティストにとって、RunPodは依然として最良のプラットフォームの一つです。

RunPodは最近の2本のチュートリアル、バイオメディカルQA向けのDiffusionGemmaのファインチューニングGemma 4のファインチューニングで活用しており、どちらも単一のRunPod GPUポッド上で最初から最後まで実行できます。

おすすめ用途: 初心者、データサイエンティスト、LLMファインチューニング、モデル提供、「とにかく動く」GPU環境が欲しい方。

3. Spheron Network

Spheronは、AWSや長期契約に煩わされずに、手頃な高性能GPUへアクセスしたいときの有力な選択肢です。

複数のデータセンタープロバイダーのGPUキャパシティを1つのダッシュボードに集約し、VMやベアメタル、完全なrootのSSHアクセス、透明性のある料金、分単位課金を提供します。

Spheron Network website

RTX 4090やA100から、H100、H200、B200まで幅広く提供。大規模ワークロード向けには、NVLink、InfiniBand、RoCEネットワーキングに対応したマルチGPU・マルチノードクラスターのデプロイも可能です。RunPodよりややインフラ寄りですが、分散学習において本格的なLLMチームに高い柔軟性をもたらします。

おすすめ用途: 手頃な高性能GPU、マルチGPUによるLLM学習、分散ワークロード、VMまたはベアメタルアクセスが必要なチーム。

4. TensorDock

TensorDockは、完成済みの仮想マシンを起動できる手頃なGPUマーケットプレイスです。

GPU、CPU、RAM、ストレージ、ロケーション、OSを選べば、rootアクセス可能なマシンが手に入ります。安価なコンシューマGPUから強力なA100やH100まで、ハードウェアの選択肢は豊富です。

image6.png

RunPodのように「用意周到」ではありません。通常はSSHで接続し、自分で環境を構築しますが、DockerはVMテンプレートに含まれており、Jupyterも開放ポート経由でセットアップできます。より自由度は高い一方、ツールの導入や管理に慣れている必要があります。

おすすめ用途: 手頃なGPU仮想マシン、カスタムPyTorch習、自己管理のvLLMやTGIデプロイ。

セルフサービス型AI GPUクラウド

これらのプラットフォームはオープンなマーケットプレイスというより、きちんとしたクラウドマシンを借りる感覚に近いものです。GPUを選び、VMを起動し、SSHやVS Codeで接続して、学習・ファインチューニング・提供用に自分の環境を構築します。

5. Hyperstack

Hyperstackは、AWSやAzure、複雑なエンタープライズ契約に縛られず、予測可能なGPUインフラを提供します。

GPU構成、リージョン、OSイメージ、SSHキーを選ぶだけで、数分で完全な仮想マシンを起動できます。オンデマンド、スポット、リザーブドのキャパシティを複数のデータセンターリージョンで提供します。

Hyperstack website

長時間の学習ジョブや自己管理の推論デプロイに、信頼できるマシンが欲しい場合に適しています。環境構築は必要ですが、従来のハイパースケーラーで一から組むよりは、はるかにシンプルな体験です。

おすすめ用途: 予測可能なGPU VM、長時間の学習ジョブ、カスタム環境、自己管理のモデル提供。

6. Hyperbolic

私はHyperbolicに数百ドルを投じていますが、今でもとても気に入っています。私にとっては、高性能GPUへ最速かつ最安でアクセスできる手段の一つであることが多いです。マシンは信頼性が高く、起動が速く、VS Codeから直接接続でき、まるでローカルで作業しているかのような体験になります。

Hyperbolic website

HyperbolicはオンデマンドGPUインスタンス、リザーブドクラスター、プライベートクラウドインフラ、OpenAI互換の推論APIを提供します。つまり、素早いファインチューニング実験から、専有キャパシティやマネージド推論への移行まで、同一プラットフォームで完結できます。

最大の課題は空き状況です。以前は手頃な単体H100やA100が見つけやすかったのですが、最近は必要なときに安価な選択肢がないことが増えました。H200が単体で見つかることもありますが、利用可能な構成の多くが4基や8基のGPUクラスターで、通常の私のワークロードには過剰かつ高価です。

おすすめ用途: 手頃な高性能GPU計算、LLMファインチューニング、VS Codeユーザー、マネージド推論、将来的にリザーブドクラスターが必要になるチーム。

エンタープライズ規模のAIクラウド

ここで紹介するプロバイダーは、本格的なAIワークロード向けです。専用GPUクラスター、高速ネットワーキング、スケーラブルなストレージ、リザーブドキャパシティ、数時間ではなく数カ月にわたり安定稼働するインフラが対象です。

7. Nebius

Nebiusは大好きです。私は主に推論でToken Factoryを使ってきましたが、高速・高信頼で、OpenAI互換API経由で非常に使いやすいです。基盤インフラを管理することなく、60以上のオープンモデルにアクセスできます。

Nebius website

最近ようやくGPUクラウド側も触り始めましたが、同様に印象的です。単体GPUマシンの起動から、マネージドKubernetes、ストレージ、高速ネットワーキングを伴う長期稼働クラスターの構築まで可能。数カ月単位で大規模クラスターを予約すると割引もあります。

小規模実験向けだけのプラットフォームではありません。すでに大企業が本番級ワークロードで利用しています。たとえばRevolutはNebius上で200基超のNVIDIA H100を使って学習と推論を実行し、Recraftは同プラットフォームで200億パラメータのモデルを学習させました。

おすすめ用途: 信頼性の高い推論、長期稼働のGPUクラスター、分散学習、マネージドKubernetes、本番規模のAIワークロード。

8. Together AI

Together AIは、単なる推論APIにとどまりません。マネージド推論、ファインチューニング、専用エンドポイント、セルフサービスGPUクラスターを1つのプラットフォームで提供します。複数のプロバイダーを行き来することなく、オープンウェイトのモデルを学習・カスタマイズ・デプロイできます。

Together AI website

GPUクラスターはH100、H200、B200、GB200といったハイエンドハードウェアを備え、InfiniBandネットワーキング、永続ストレージ、KubernetesSlurmに対応。オンデマンドでの起動も、長期ワークロード向けの予約も可能です。

短時間の実験で安価なGPUを1台だけ使いたい人には過剰かもしれません。しかし、学習・ファインチューニング・大規模提供を信頼できるインフラで運用したい企業には合理的な選択です。

おすすめ用途: エンタープライズ向けGPUクラスター、大規模モデル学習、マネージドファインチューニング、専用推論、本番AIシステムの構築。

開発者ファーストでノートブックに優しいプラットフォーム

これらのプラットフォームは、クラウドインフラの管理に時間を費やすより、コードに集中したい開発者のために作られています。ノートブックやVS Codeといった馴染みのツールを提供し、裏側のGPUプロビジョニングを大部分引き受けてくれます。

9. Modal

Modalは、通常のGPUマシンを借りるのとはまったく異なります。Pythonコードを書いて必要なGPUを選ぶと、Modalがサーバーレスのコンテナ内で実行します。ゼロから複数GPUまで自動スケールし、実際にリソースを使った時間に基づいて課金されます。

Modal Website

推論APIのデプロイ、評価パイプラインの実行、モデルのファインチューニング、突発的にGPUが増えるワークロードに最適です。Modalは数秒で起動するGPUノートブックも提供しており、カスタム環境に対応し、最大で8基のA100またはH100を使用できます。

一点理解しておきたいのは、Modalには発想の転換が必要だということです。単にVMを開いてリモートPCのように使うのではありません。Pythonでインフラを定義します。最初は違和感があるかもしれませんが、仕組みを理解すると非常に強力です。

おすすめ用途: サーバーレス推論、モデル評価、自動化パイプライン、ファインチューニング、自動スケールが必要なワークロード。

10. Thunder Compute

Thunder Computeは、多くのデータサイエンティストがGPUクラウドに求める姿に近いサービスです。マシンを起動し、VS Code、CursorWindsurf、コマンドライン、またはJupyter Notebookで直接接続できます。JupyterLabはすでにインストール済みで、環境設定に何時間もかけずに実験を開始できます。

Thunder Compute website

特に気に入っているのはVS Code拡張のコンセプトです。クラウドのダッシュボード、SSHターミナル、ローカルエディタを行き来する代わりに、エディタ内からGPUインスタンスをリモートワークスペースとして作成・オープンできます。ローカルで作業している感覚に近く、それでいて強力なクラウドGPUにアクセスできます。

Thunder Computeにはプロトタイピング用と本番用のモードが別々に用意されています。まずは実験向けのシンプルなマシンから始め、後に永続ストレージや複数GPU対応の本番構成へ移行できます。

おすすめ用途: Jupyter中心の研究、VS Codeユーザー、モデル実験、対話的なデータサイエンス作業、Google Colabの強力な代替を探している方。

最適なGPUプロバイダーの選び方

唯一の「最良」GPUプロバイダーは存在しません。最適解は、GPUの空き状況、価格、使いやすさ、ストレージコスト、そしてノートブック/VM/サーバーレス推論/フルGPUクラスターのどれが必要かによって変わります。

  • 柔軟なキャパシティ、幅広いGPU選択肢、競争力のある価格を求めるならVast.aiRunPodSpheronTensorDock
  • 学習、ノートブック、自前の推論ホスティングに使える、より信頼性の高いクラウドVMを求めるならHyperbolicまたはHyperstack
  • 専用クラスター、分散学習、リザーブドキャパシティ、本番規模のインフラが必要ならNebiusまたはTogether AI
  • 使いやすさを最重視するならModalまたはThunder Compute。サーバーレス用途にはModal、馴染みのあるVS CodeやJupyterのワークフローにはThunder Computeが最適。

まとめ

私は主にVast.ai、RunPod、Hyperbolic、Modalを使っています。使いやすく、柔軟で、比較的手頃だからです。最安のマシン探しはたいていVast.aiが第一候補。使いやすさではRunPodが抜群で、HyperbolicはGPUさえ空いていれば高速かつ信頼性が高く、Modalはサーバーレス推論や自動化ワークロードに最適です。

ごく小さな実験には、今でもGoogle ColabやローカルのJupyter Notebookを使います。ただし、Colabには制約が多く、遅いこともあり、本格的なLLMファインチューニング、モデル提供、長時間の学習ジョブにはおすすめしません。

結局のところ、最良のプラットフォームとは、クラウドインフラのエンジニアになることを強要せず、すぐに作業を始められるものです。とはいえ、インフラエンジニアを目指す(あるいは裏側の仕組みを知りたい)場合は、まずはUnderstanding Cloud Computingコースをおすすめします。

GPUクラウドプロバイダーに関するFAQ

LLMのファインチューニングや推論に最も安いGPUプロバイダーはどこですか?

Vast.aiやTensorDockのようなマーケットプレイスは、多数のホストからキャパシティを集約するため、時間単価が最安になりがちです。一方でSpheronやHyperbolicは、H100のようなハイエンドカードでも競争力を保っています。総コストはGPU、ストレージ、実行時間に左右されるため、時間単価が最安でも請求額が最安とは限りません。短時間のテストなら、スポット料金や分単位課金で数十円〜数百円に抑えられます。

大規模言語モデルのファインチューニングにH100 GPUは必要ですか?

必須ではありません。小〜中規模のモデルなら、RTX 4090(24 GB)のようなコンシューマカードでも、LoRAや4ビット量子化のQLoRAを用いればうまくファインチューニングできます。モデルが小容量カードのメモリに収まらない場合や、大規模データセットでより高速に学習したい場合に、A100やH100が主に必要になります。

GPUマーケットプレイスとサーバーレスGPUプラットフォームの違いは何ですか?

Vast.aiやTensorDockのようなマーケットプレイスは、起動中は稼働・アイドルを問わず、セットアップしたフルマシンの料金を支払います。Modalのようなサーバーレスプラットフォームは、ゼロからスケールし、ジョブがGPUを使用した秒数に基づいて課金します。マーケットプレイスは制御性が高く時間単価が安い傾向があり、サーバーレスはアイドルコストとセットアップの大半を取り除きます。

これらのGPUプロバイダーでJupyter NotebookやVS Codeは使えますか?

はい。ここで紹介したほとんどのプロバイダーは、Jupyter Notebook、ブラウザターミナル、SSH、またはVS Codeのリモート接続に対応しています。RunPodやThunder Computeなら、ほぼワンクリックで使い始められます。Jupyterがプリインストールされていない場合でも、通常は数分で導入・起動できます。

これらのGPUクラウドプロバイダーは、AWSやAzure、Google Cloudより安いですか?

多くの場合、しかも大幅に安くなることがあります。というのも、フル機能のハイパースケーラープラットフォームのオーバーヘッドなしにGPUレンタルに特化しているからです。SpheronやHyperbolicは、主要クラウドの1GPUあたり価格を大きく下回るH100の料金を掲示しています。その代償として、マネージドサービスが少ないことや、一部のマーケットプレイスでは空き状況や信頼性の予測が難しいことがあります。

トピック

クラウド人気コース

Tracks

AWS クラウドプラクティショナー (CLF-C02)

10時間
Amazon の AWS Certified Cloud Practitioner (CLF-C02) に備え、主要な AWS のコンピューティング、データベース、ストレージサービスの使い方と保護方法を学びます。
詳細を見るRight Arrow
コースを開始
もっと見るRight Arrow