ツール02 · LLMのコスト

計算機 LLMのコスト — APIとセルフホスティングの比較

ChatGPT、Claude、Gemini、DeepSeekに、実際には毎月いくらかかっていますか?どの程度の利用量からRTX 5090やMac mini M5 Proの導入費用を回収できるのでしょうか?利用量を入力すれば、計算結果をお知らせします。

月間利用量

目安: 10M の入力 + 2.5M の出力 = 平均的な Claude の会話 約5,000件分(1会話あたり入力1,500トークン + 出力500トークン)。ご自身の使い方に合わせて調整してください。

高度なモード

用途に合った最適化を有効にしてください。すべてのモデルがすべてのモードをサポートしているわけではありません。表の注記を参照してください。

APIを介した月額コスト(8 fournisseurs)

バッジをクリックしてモデルの有効・無効を切り替えます
モデルVendorInputOutputTotal/moisメモ
Mistral Small 4★ より安価Mistral$1.5$1.52.6 €EU でホスティング、低価格
DeepSeek V4.1 FlashDeepSeek$3.0$3.05.3 €オフピーク時間帯は50%割引
GPT-5 miniOpenAI$2.5$5.06.6 €小型モデルで、価格に対する品質が良好
Gemini 3.8 FlashGoogle$7.5$9.414.8 €最新の Flash(2026 年 12 月 31 日までの料金保証)
Claude Haiku 4.5Anthropic$10.0$12.519.8 €非常に高速で、マルチモーダルです
Claude Sonnet 5Anthropic$20.0$25.039.6 €1Mのコンテキスト、Anthropicで最も優れた品質対コスト比
Claude Opus 5.5Anthropic$40.0$50.079.2 €コンテキスト1M、キャッシュは価格の5%
GPT-6 AstraOpenAI$100$125198 €OpenAI のハイエンドモデル(2026 年 9 月)

セルフホスティングの月額費用 (4 configs)

ハードウェアの償却期間: 24 月額+電気費(0.20 €/kWh)。Capacity = 推定tok/s × 4h/jour × 30日;不足している場合に警告を発行 12.5Mトークンが要求されます。
ハードウェアVRAM購入 TTCAmort./mois月額電気代Total/mois月間トークン処理容量対応モデル
RTX 5070 Ti 16GB(既存PC内)★ より安価16 GB1 300 €54.2 €21.1 €75.3 €19.4M
~45 tok/s
14Bは余裕あり、24BはQ4でも余裕が少ない
Mac mini M5 Pro 24 GB⚠ 必要なスペックを満たしていません24 GB1 999 €83.3 €2.8 €86.1 €8.6M
~20 tok/s
最大14B(≈24GB中16GB使用可能)
Mac Studio M5 Max 36 GB36 GB2 999 €125 €4.1 €129 €15.1M
~35 tok/s
Q4で約32Bのモデルまで対応(使用可能な容量は約27 GB)
RTX 5090 32GB(既存PCで)32 GB5 000 €208 €31.2 €240 €34.6M
~80 tok/s
Q4〜Q6 で最大32B(70B は不可)

判定

カスタマイズ可能な比較 — 以下のオプションを変更してください
比較する API
Mistral Small 4
2.6 €/mois
APIのほうが安価です ★。 ハードウェアの購入は不要で、即座にスケーリングできます。
比較するハードウェア
RTX 5070 Ti 16GB(既存PC内)
75.3 €/mois (amorti)
ローカルで処理するトークン、非公開データ、ミリ秒単位の遅延。
セルフホスティングの損益分岐点
これまで(この規模では)ありませんでした。
現在の利用量では、Mistral Small 4(2.6 €/月)の費用は、RTX 5070 Ti 16GB(既存PC内)の電気代だけよりも安くなります。利用量を増やすか、上記のハードウェア/APIを変更してください。
コードを書くために使う場合は
同じ計算、Copilotバージョン

GitHub CopilotやCursorを置き換えるために、こうした検討をしているのでしょうか。ローカルなら、 0 €/月 また、コードがクラウドに送信されることは一切ありません。ガイド 「ローカル・コード・コパイロット」 は、30分で始められる完全なセットアップ(Ollama + Cline + Aider、すぐに使える設定付き)を紹介し、ローカル環境ではクラウドを代替できない場面も率直に説明します。

キットを見る →

ローカル実行か、ChatGPT / Claudeのサブスクリプションか?

サブスクリプションにかかる費用と、チームで共有するローカルマシンにかかる費用を比較してください。

サブスクリプション
63.4 €
月額、税込み
ローカルマシン
85.1 €
24か月間の月額
費用回収まで
32.5ヶ月
3年間の節約額:217 €

サブスクリプション:2026年9月28日に確認した公開価格(税抜、1ドル0.88ユーロで換算、20%のVATを追加)。マシン:24ヶ月で償却した購入価格 + 電気代0.20ユーロ/kWh。14Bから32Bのローカルモデルは、困難なタスクにおける最も強力なモデル、またはサブスクリプションに含まれるWeb検索や画像生成を置き換えません。同時接続ユーザーが数人を超えると、より強力なGPUが必要になります。

LLMを動かすためのGPUサーバーには、いくらかかりますか?

「自分の」GPUサーバーを持つ方法は二つあります。購入するか、時間単位で借りるかです。1日に数時間使う場合、初年度はレンタルのほうが安くなることが多いですが、常時使う場合は購入費用をすぐに回収できます。また、自宅に置いたマシンなら、データを外部へ送り出しません。

購入:24ヶ月間の月額費用

マシン価格償却電力消費(4時間/日)月額合計まで(Q4)
RTX 5070 Ti 16 GB(既存PC)1 300 €54 €9 €≈ 63 €14B
Mac mini M5 Pro 24 GB1 999 €83 €2 €≈ 85 €14B
Mac Studio M5 Max 36 GB2 999 €125 €3 €≈ 128 €32B
RTX 5090 32 GB(既存PC)≈ 5 000 €208 €16 €≈ 224 €32B

電気代:負荷時の消費電力 × 4時間 × 30日、単価は0.20 €/kWh。残りの時間はマシンの電源を切る想定です。価格は2026年9月に調査したものです。

レンタル:時単位価格

レンタルサーバーGPUメモリ時単位価格1日4時間24時間24分
Scaleway L4(パリ)24 GB0,79 €(税抜)≈ 95 €≈ 577 €
RunPod RTX 509032 GB0,61 à 0,87 €73 à 104 €443 à 636 €
RunPod A10080 GB1,05 à 1,40 €126 à 168 €764 à 1 021 €
RunPod H10080 GB1,75 à 3,07 €210 à 369 €1 278 à 2 242 €

公開料金は2026年9月28日にscaleway.comとrunpod.ioで確認しました(RunPodはコミュニティ向けとセキュア向けの価格幅を記載し、ドルは0.88ユーロで換算)。1日4時間なら月120時間、24時間365日稼働なら月730時間です。

どれを選ぶべきですか?

  • 日々数時間程度 :RTX 5090をレンタルすると月額73〜104ユーロで済み、約5,000ユーロで購入したカードの減価償却費よりも安くなります。
  • 常時稼働 : RTX 5090を24時間24時間レンタルすると月額443〜636ユーロ、購入価格は約5,000ユーロで、電気費を含めて9〜14ヶ月で返済可能(月額約95ユーロ)
  • センシティブなデータ :自宅に置いたマシンは何も送信しません。レンタルする場合は、欧州のホスティング事業者を選んでください。

計算方法と前提条件

この計算ツールが示すのは大まかな目安であり、会計上の正式な見積もりではありません。以下の前提条件は、実際の利用状況とどこが異なるかを判断できるよう、あえて明示しています。

API 価格

  • 2026 年 9 月 28 日に公開された料金(USD/M トークン)。出典:developers.openai.com/api/docs/pricing、platform.claude.com/docs/en/about-claude/pricing、ai.google.dev/gemini-api/docs/pricing、api-docs.deepseek.com、mistral.ai/pricing。
  • USD→EURの換算にはレート0.88を使用(2026年9月。日によって±5%変動する可能性があります)。
  • 長いコンテキストの追加料金(OpenAI、Gemini:20万トークン超) NON 適用済み — calcはモデルごとに単一の価格を使用します。
  • キャッシュ(モデルごとに異なる割引料金で、入力料金の2%〜10%)は、「Cache prompts」トグルが有効な場合にのみ適用されます。それ以外の場合は考慮されません。
  • バッチモード(OpenAI/Anthropic/Google/Mistral 50%割引、24時間遅延)は、「バッチモード」トグルが有効である場合にのみ適用される。
  • DeepSeekのオフピーク料金(50%割引)は、対応するトグルがオンの場合にのみ適用されます。

セルフホスト版の価格設定

  • 購入価格=2026 年 9 月に確認したフランスの税込価格(「TVA récupérable」の切り替えで税抜価格に変更、−16.67%)。グラフィックスカードについては、既存の PC があることを前提としています。
  • アイドル時/負荷時の消費電力=システム全体(PC:電源+CPU+RAM+SSD+GPU、Mac:全体を含む)。出典:TomsHardware/AnandTechのレビュー、Apple Power Analyzer、pcpartpickerコミュニティによる測定。
  • 月間処理可能トークン数 = 推定トークン/秒 × 稼働時間 × 30日。トークン/秒は、余裕を持ってメモリに収まるモデルと、VRAM容量の上限に近いモデルを組み合わせた混合ワークロードで推定します。
  • NON 維持費:保守(約1時間/月 ≒ 30~50€のフリーランス相当)、インターネット帯域幅、販売時の機器純減価、欠陥・RMA対応。
  • 「PCを24時間オン」の切り替え:アイドル時の消費電力量 = (24h - heures_actives) × idleW。チェックを外すと、稼働時間外はPCの電源をオフにします(アイドル時は0W)。

重要な制限事項

  • 品質が同等ではない :複雑な推論やマルチモーダル処理では、ローカルで動かすLlama 3.3 70B ≠ GPT-5です。損益分岐点の計算は機能的に同等であることを前提としているため、用途によってはセルフホスティングの採算性を過大評価する可能性があります。
  • 入手可能性 : セルフホストでは、リクエストを処理するためにマシンの電源が入っている必要があります。APIは常時利用可能で、即座にスケーリングできます。
  • レイテンシー :セルフホスト = ミリ秒単位(ローカル);API = 提供元と地域により200~2000 ms。
  • データ / GDPR :セルフホスト=第三者にデータを送信しない。米国API(OpenAI/Anthropic/Google)=EU域外へのデータ移転。EUホストのMistral=GDPRにネイティブ対応。
  • さらに詳しく: モデル比較ツール · GPU設定ツール · 250のLLMを含むカタログ · QuelLLM MCPサーバー.