計算機 LLMのコスト — APIとセルフホスティングの比較
ChatGPT、Claude、Gemini、DeepSeekに、実際には毎月いくらかかっていますか?どの程度の利用量からRTX 5090やMac mini M5 Proの導入費用を回収できるのでしょうか?利用量を入力すれば、計算結果をお知らせします。
月間利用量
高度なモード
用途に合った最適化を有効にしてください。すべてのモデルがすべてのモードをサポートしているわけではありません。表の注記を参照してください。
APIを介した月額コスト(8 fournisseurs)
| モデル | Vendor | Input | Output | Total/mois | メモ |
|---|---|---|---|---|---|
| Mistral Small 4★ より安価 | Mistral | $1.5 | $1.5 | 2.6 € | EU でホスティング、低価格 |
| DeepSeek V4.1 Flash | DeepSeek | $3.0 | $3.0 | 5.3 € | オフピーク時間帯は50%割引 |
| GPT-5 mini | OpenAI | $2.5 | $5.0 | 6.6 € | 小型モデルで、価格に対する品質が良好 |
| Gemini 3.8 Flash | $7.5 | $9.4 | 14.8 € | 最新の Flash(2026 年 12 月 31 日までの料金保証) | |
| Claude Haiku 4.5 | Anthropic | $10.0 | $12.5 | 19.8 € | 非常に高速で、マルチモーダルです |
| Claude Sonnet 5 | Anthropic | $20.0 | $25.0 | 39.6 € | 1Mのコンテキスト、Anthropicで最も優れた品質対コスト比 |
| Claude Opus 5.5 | Anthropic | $40.0 | $50.0 | 79.2 € | コンテキスト1M、キャッシュは価格の5% |
| GPT-6 Astra | OpenAI | $100 | $125 | 198 € | OpenAI のハイエンドモデル(2026 年 9 月) |
セルフホスティングの月額費用 (4 configs)
| ハードウェア | VRAM | 購入 TTC | Amort./mois | 月額電気代 | Total/mois | 月間トークン処理容量 | 対応モデル |
|---|---|---|---|---|---|---|---|
| RTX 5070 Ti 16GB(既存PC内)★ より安価 | 16 GB | 1 300 € | 54.2 € | 21.1 € | 75.3 € | 19.4M ~45 tok/s | 14Bは余裕あり、24BはQ4でも余裕が少ない |
| Mac mini M5 Pro 24 GB⚠ 必要なスペックを満たしていません | 24 GB | 1 999 € | 83.3 € | 2.8 € | 86.1 € | 8.6M ~20 tok/s | 最大14B(≈24GB中16GB使用可能) |
| Mac Studio M5 Max 36 GB | 36 GB | 2 999 € | 125 € | 4.1 € | 129 € | 15.1M ~35 tok/s | Q4で約32Bのモデルまで対応(使用可能な容量は約27 GB) |
| RTX 5090 32GB(既存PCで) | 32 GB | 5 000 € | 208 € | 31.2 € | 240 € | 34.6M ~80 tok/s | Q4〜Q6 で最大32B(70B は不可) |
判定
GitHub CopilotやCursorを置き換えるために、こうした検討をしているのでしょうか。ローカルなら、 0 €/月 また、コードがクラウドに送信されることは一切ありません。ガイド 「ローカル・コード・コパイロット」 は、30分で始められる完全なセットアップ(Ollama + Cline + Aider、すぐに使える設定付き)を紹介し、ローカル環境ではクラウドを代替できない場面も率直に説明します。
キットを見る →ローカル実行か、ChatGPT / Claudeのサブスクリプションか?
サブスクリプションにかかる費用と、チームで共有するローカルマシンにかかる費用を比較してください。
サブスクリプション:2026年9月28日に確認した公開価格(税抜、1ドル0.88ユーロで換算、20%のVATを追加)。マシン:24ヶ月で償却した購入価格 + 電気代0.20ユーロ/kWh。14Bから32Bのローカルモデルは、困難なタスクにおける最も強力なモデル、またはサブスクリプションに含まれるWeb検索や画像生成を置き換えません。同時接続ユーザーが数人を超えると、より強力なGPUが必要になります。
LLMを動かすためのGPUサーバーには、いくらかかりますか?
「自分の」GPUサーバーを持つ方法は二つあります。購入するか、時間単位で借りるかです。1日に数時間使う場合、初年度はレンタルのほうが安くなることが多いですが、常時使う場合は購入費用をすぐに回収できます。また、自宅に置いたマシンなら、データを外部へ送り出しません。
購入:24ヶ月間の月額費用
| マシン | 価格 | 償却 | 電力消費(4時間/日) | 月額合計 | まで(Q4) |
|---|---|---|---|---|---|
| RTX 5070 Ti 16 GB(既存PC) | 1 300 € | 54 € | 9 € | ≈ 63 € | 14B |
| Mac mini M5 Pro 24 GB | 1 999 € | 83 € | 2 € | ≈ 85 € | 14B |
| Mac Studio M5 Max 36 GB | 2 999 € | 125 € | 3 € | ≈ 128 € | 32B |
| RTX 5090 32 GB(既存PC) | ≈ 5 000 € | 208 € | 16 € | ≈ 224 € | 32B |
電気代:負荷時の消費電力 × 4時間 × 30日、単価は0.20 €/kWh。残りの時間はマシンの電源を切る想定です。価格は2026年9月に調査したものです。
レンタル:時単位価格
| レンタルサーバー | GPUメモリ | 時単位価格 | 1日4時間 | 24時間24分 |
|---|---|---|---|---|
| Scaleway L4(パリ) | 24 GB | 0,79 €(税抜) | ≈ 95 € | ≈ 577 € |
| RunPod RTX 5090 | 32 GB | 0,61 à 0,87 € | 73 à 104 € | 443 à 636 € |
| RunPod A100 | 80 GB | 1,05 à 1,40 € | 126 à 168 € | 764 à 1 021 € |
| RunPod H100 | 80 GB | 1,75 à 3,07 € | 210 à 369 € | 1 278 à 2 242 € |
公開料金は2026年9月28日にscaleway.comとrunpod.ioで確認しました(RunPodはコミュニティ向けとセキュア向けの価格幅を記載し、ドルは0.88ユーロで換算)。1日4時間なら月120時間、24時間365日稼働なら月730時間です。
どれを選ぶべきですか?
- 日々数時間程度 :RTX 5090をレンタルすると月額73〜104ユーロで済み、約5,000ユーロで購入したカードの減価償却費よりも安くなります。
- 常時稼働 : RTX 5090を24時間24時間レンタルすると月額443〜636ユーロ、購入価格は約5,000ユーロで、電気費を含めて9〜14ヶ月で返済可能(月額約95ユーロ)
- センシティブなデータ :自宅に置いたマシンは何も送信しません。レンタルする場合は、欧州のホスティング事業者を選んでください。
計算方法と前提条件
この計算ツールが示すのは大まかな目安であり、会計上の正式な見積もりではありません。以下の前提条件は、実際の利用状況とどこが異なるかを判断できるよう、あえて明示しています。
API 価格
- 2026 年 9 月 28 日に公開された料金(USD/M トークン)。出典:developers.openai.com/api/docs/pricing、platform.claude.com/docs/en/about-claude/pricing、ai.google.dev/gemini-api/docs/pricing、api-docs.deepseek.com、mistral.ai/pricing。
- USD→EURの換算にはレート0.88を使用(2026年9月。日によって±5%変動する可能性があります)。
- 長いコンテキストの追加料金(OpenAI、Gemini:20万トークン超) NON 適用済み — calcはモデルごとに単一の価格を使用します。
- キャッシュ(モデルごとに異なる割引料金で、入力料金の2%〜10%)は、「Cache prompts」トグルが有効な場合にのみ適用されます。それ以外の場合は考慮されません。
- バッチモード(OpenAI/Anthropic/Google/Mistral 50%割引、24時間遅延)は、「バッチモード」トグルが有効である場合にのみ適用される。
- DeepSeekのオフピーク料金(50%割引)は、対応するトグルがオンの場合にのみ適用されます。
セルフホスト版の価格設定
- 購入価格=2026 年 9 月に確認したフランスの税込価格(「TVA récupérable」の切り替えで税抜価格に変更、−16.67%)。グラフィックスカードについては、既存の PC があることを前提としています。
- アイドル時/負荷時の消費電力=システム全体(PC:電源+CPU+RAM+SSD+GPU、Mac:全体を含む)。出典:TomsHardware/AnandTechのレビュー、Apple Power Analyzer、pcpartpickerコミュニティによる測定。
- 月間処理可能トークン数 = 推定トークン/秒 × 稼働時間 × 30日。トークン/秒は、余裕を持ってメモリに収まるモデルと、VRAM容量の上限に近いモデルを組み合わせた混合ワークロードで推定します。
- NON 維持費:保守(約1時間/月 ≒ 30~50€のフリーランス相当)、インターネット帯域幅、販売時の機器純減価、欠陥・RMA対応。
- 「PCを24時間オン」の切り替え:アイドル時の消費電力量 = (24h - heures_actives) × idleW。チェックを外すと、稼働時間外はPCの電源をオフにします(アイドル時は0W)。
重要な制限事項
- 品質が同等ではない :複雑な推論やマルチモーダル処理では、ローカルで動かすLlama 3.3 70B ≠ GPT-5です。損益分岐点の計算は機能的に同等であることを前提としているため、用途によってはセルフホスティングの採算性を過大評価する可能性があります。
- 入手可能性 : セルフホストでは、リクエストを処理するためにマシンの電源が入っている必要があります。APIは常時利用可能で、即座にスケーリングできます。
- レイテンシー :セルフホスト = ミリ秒単位(ローカル);API = 提供元と地域により200~2000 ms。
- データ / GDPR :セルフホスト=第三者にデータを送信しない。米国API(OpenAI/Anthropic/Google)=EU域外へのデータ移転。EUホストのMistral=GDPRにネイティブ対応。
- さらに詳しく: モデル比較ツール · GPU設定ツール · 250のLLMを含むカタログ · QuelLLM MCPサーバー.