AIエージェントの費用を比較:月額料金のしくみと計算例

AIエージェントの費用は、サービスの月額料金だけでは決まりません。月1,000通の問い合わせメールを例に、Marblism、n8nとClaude、自社APIの予算を比較。課金単位、トークン数、年払いの初回請求、人による確認や保守まで、運用に必要な支出と採用できる返信あたりの費用をどう見積もるかを解説します。

Wednesday, October 7, 2026Omid Saffari
AIエージェントの費用を比較:月額料金のしくみと計算例

AIエージェントで月1,000通の問い合わせメールに対応する場合、この記事の条件で試算すると、ソフトウェア費用は完成済みのサービスで$82、年払いのホスト型ビルダーで月額換算$25.50、自社で組むAPIワークフローで$10.50です。どの方式でも、人による確認、メール環境、障害時の対応責任者は必要です。判断の軸になるのは、採用できる返信を作るために毎月いくらかかるかです。

AIエージェントの料金は、何をどこまで購入するかで変わります

AIエージェントは、モデルを使って仕事を進め、連携したツールで操作を実行します。カスタマーサポートなら、メールを読み、該当する対応方針を探し、返信案を作るといった仕事です。ただし、モデルだけを購入しても、メールとの接続、承認のしくみ、サポート業務全体がそろうわけではありません。

料金は、そのしくみのどこまでを購入するかで決まります。

  • **完成済みのエージェントサービス:**すぐに使えるアシスタントに、通常はサブスクリプション料金やシート料金を支払います。シートとは、有料のユーザーアカウントです。契約料金に加えて、利用量の上限が設けられる場合もあります。
  • **ノーコードビルダー:**処理の手順を自分でつなぎ、クレジット、タスク、ワークフローの実行回数に応じて支払います。実行回数は一連の処理が最後まで走った回数で、クレジットは提供元が従量課金に使う単位です。
  • **自社で組むAPIワークフロー:**自社のソフトウェアからAPIを通じてモデルを呼び出します。APIは、プログラムが処理を依頼するための接続口です。モデルが読み書きするテキストの単位であるトークンに加え、ホスティングや有料ツールの費用を支払います。

同じ仕事を任せる方法でも、引き受ける責任は異なります。創業者ならメールの返信案を用意するサービスを購入できます。業務責任者ならワークフローを組み立てられます。バックエンドチームなら、それを動かすソフトウェアを自社で管理できます。

掲載料金は、2026年10月7日に各提供元のページで確認しました。金額はすべて米ドル(USD)です。年払いの料金はその旨を明記し、合計額は記載した前提に基づく予測として示しています。性能テストの結果ではありません。初期設定にかかる時間は、継続的な請求額とは分けて記録してください。

各サービスの公表料金と、課金される単位

利用方式サービス・モデルの例公表料金請求額を決める利用量
完成済みのエージェントサービスMarblism$44/月、年払いでは$24/月AI従業員全体で共有する月50時間、チームメンバー数は無制限
完成済みのエージェントサービスLindy Teamアクティブユーザーあたり月$29.99からシートあたり3,000クレジット、チーム全体で共有
ビルダーGumloop Pro$37/月から月20,000クレジット、通常のエージェント実行管理手数料は8%
ビルダーn8n Starter$20/月、年払いワークフロー全体の実行が月2,500回、ホスティング込み、ステップ数は無制限
自社で利用するモデルAPIClaude Haiku 4.5百万トークンあたり入力$1/出力$5モデルに送信する、またはモデルが生成する、キャッシュを使わないトークン
自社で利用するモデルAPIClaude Sonnet 5.5百万トークンあたり入力$2/出力$10モデルに送信する、またはモデルが生成する、キャッシュを使わないトークン
自社で利用するモデルAPIOpenAI GPT-6 Luna百万トークンあたり入力$0.10/出力$0.50標準の短いコンテキストに適用される、キャッシュを使わないトークン

モデルの料金は、キャッシュ、バッチ処理の割引、速度に対する追加料金を適用しない通常料金です。同じメールを処理しても、モデルによってトークン数や返信の品質は変わります。単価が安くても、自社のサポート品質を満たす返信を出せて初めて選択肢になります。

ほかのサービスも、表示料金だけでは判断できません。Lindyの最安料金は、1,000通の返信を保証するものではありません。返信案の作成は、日常業務で2〜250クレジットという幅のある料金体系に含まれ、メールの送信には承認が必要です。アクティブユーザーを増やすと、有料シートも増えます。Lindyの利用量と承認のルールを確認してください。

Gumloopのクレジットは、テキスト処理以外にも使われます。現行の従量課金ルールでは、クレジット単価は**$0.005です。成功したコネクター呼び出しあたり最低1クレジット、アクティブなセッション時間あたり毎分5クレジットがかかり、そのうえで通常の実行管理手数料8%**が加算されます。Gumloopのクレジット課金の全項目を確認してください。

自分のモデルAPIキーを使っても、ツールや計算処理の料金は残ります。現行の従量課金ポリシーでは、この場合のエージェント手数料は**16%**になります。以前からのアカウントには、旧ルールが適用されることもあります。手数料の計算基準は、外部のモデル提供元へ移したモデル利用分も含め、その実行全体に本来かかる費用です。残ったツール料金だけに手数料率を掛けてはいけません。

月1,000通の問い合わせメールに返信する場合を比べます

条件を具体的にそろえます。小規模な企業に、既存の対応方針を使って回答できる問い合わせメールが、月1,000通届くとします。ワークフローが返信案を作り、人が確認して採用した返信を送信します。

追加の返信案作成を100回見込み、合計を1,100回とします。これは計画上の10%の余裕であり、どの製品についても再試行率を示すものではありません。添付ファイル、インターネット検索、有料の情報補完は含めず、既存のメール環境も新たなソフトウェア費用の小計には入れません。

ビルダーとAPIの試算では、各処理全体で入力3,000トークン、課金対象の出力400トークンを使うと仮定します。これはモデルを一度呼び出す場合の数値です。複数回呼び出すワークフローなら、全呼び出しの利用量を合算する必要があります。完成済みのサービスでは、内部のモデル利用を提供元が決めるため、公表されたタスク課金の単位を確認します。

方式1:Marblism標準の返信案作成なら月$82

MarblismのEvaを利用するSaaSの創業者は、共有の時間枠を使ってタスクを実行します。この時間はタスクごとに決められた課金上の値で、AIが実際に動いた時間を測るものではありません。新着メールの分類は20秒、返信案の作成は5分です。Marblismのタスク別の消費時間とプランで確認できます。

今回の仕事では、次のように計算します。

  • 新着メール1,000通を分類:1,000 × 20秒 = 5.56時間。
  • 追加分も含めて返信案を1,100回作成:1,100 × 5分 = 91.67時間。
  • 課金上の合計利用時間:97.22時間。

これは、月払い$82の100時間プランに収まります。基本の**$44の50時間プランでは足りません。年払いでは、100時間プランは$45/月**です。この時間枠は、アカウント内で実行するほかのAI業務にも使われます。

Evaはメール環境に返信案を作成し、人が確認して送信ボタンを押します。したがって、この予算で利用できるのは、返信作成を支援するサービスです。承認の作業は利用者側に残ります。Evaによる返信の処理を確認してください。

利用枠には、もうひとつ注意点があります。Marblismでは、アプリ連携の操作や自動処理の実行を、別途25秒として計上します。今回の処理ごとにこうした操作を追加すると、さらに7.64時間かかり、合計は104.86時間になります。その場合は、月$120の150時間プランが必要です。$82の試算に含まれるのは、標準機能による分類と返信案の作成だけです。ほかの操作を追加する前に、利用量の内訳を確認してください。

方式2:n8nとClaudeなら月額換算$25.50

ECの業務責任者なら、届いた問い合わせメール、該当する対応方針、モデル呼び出しをつなぎ、確認用の返信案を保存できます。n8nのGmail連携は、メールの読み込みと下書きの作成に対応しています。Anthropic連携では、自分のAPIキーを使えます。Gmailで実行できる操作、Anthropicの認証設定を参照してください。

各処理でワークフロー全体が一度実行される構成を想定します。**1,100回の実行は、Starterの2,500回の利用枠に収まります。**同じ実行内の各ステップが、それぞれ別の実行回数として数えられるわけではありません。ただし、追加で起動する処理も利用枠に収める必要があります。n8nの実行回数の定義とプランを確認してください。

自分のAnthropicキーを使う場合、モデル料金は別途かかります。

1,100 × 3,000 = 入力3.3百万トークン。

1,100 × 400 = 出力0.44百万トークン。

確認済みのHaikuの単価で計算すると、3.3 × $1 + 0.44 × $5 = $5.50です。ここに年払いプランの月額換算$20を足すと、ソフトウェア費用は月額換算$25.50になります。Starterのホスティングはn8nが提供するため、この例では別のホスティング契約を追加しません。

n8nのクレジットは、用途の異なる残高を区別してください。Assistant creditsは、ワークフローの構築やトラブル対応の支援に使います。Gateway creditsは、ワークフローの実行中に呼び出すモデルの料金に使います。この例では、Gateway creditsの代わりに自分のAnthropicキーを使っています。Assistantの利用枠で、このモデル料金をまかなえるわけではありません。用途の異なるクレジットのしくみを確認してください。

方式3:自社のClaude APIワークフローとホスティングなら月$10.50

バックエンドチームは、同じ範囲の業務を自社アプリケーションで実行できます。メールを受け取り、対応方針を渡し、返信案を依頼して、人が確認できるように保存します。同じトークン数を前提にすれば、Haikuの料金は引き続き**$5.50/月**です。

ホスティング費用の具体例として、Cloudflare Workers Paidはアカウントあたり月$5からで、10百万件のリクエストと30百万ミリ秒のCPU時間を含みます。この例では、アプリケーションと小規模なデータストアが、含まれる利用枠に収まると仮定します。Workersと付属データサービスの料金を確認してください。

ソフトウェア費用の小計は、$5.50 + $5 = $10.50/月です。既存のメール環境を使い、任意の有料ツールを追加せず、アカウントの利用枠を消費するほかの処理もないことが前提です。WorkersにはFreeプランもありますが、その制限が実装に合うかどうかは、別途確認する必要があります。

トークン数を同じにすると、Sonnetはトークン料金が$11、同じホスティング費用を含めて$16です。GPT-6 Lunaはトークン料金が$0.55、ホスティング込みで$5.55になります。これは単価の比較であり、どのモデルも同じ品質でメールを処理できることを示すものではありません。

API費用の小計が低い分、自社で管理する範囲は広がります。メールとの接続、返信案の保存、エラー処理、モデルの振る舞いをチームで保守します。実際の利用量を測定した後は、Claude APIの料金ガイドで、モデル単価、キャッシュ、バッチ処理についてさらに確認できます。

タスクごとのトークン数は、どう見積もればよいですか?

顧客のメールだけでなく、モデルが受け取る内容全体を確認します。指示、過去のメッセージ、対応方針の抜粋、ツールの説明、ツールの実行結果は、どれも入力トークンに含まれる可能性があります。後続のモデル呼び出しで、その一部を再び処理することもあります。Claudeのツール利用に伴うトークン計上を確認してください。

最初の試算表では、指示を800トークン、メールとスレッドを400トークン、該当する対応方針を1,800トークンと仮定します。合計は入力3,000トークンです。返信案の課金対象の出力は400トークンとします。これは後から測定値に置き換えるための計画値であり、提供元が保証する標準的なトークン数ではありません。

  1. 利用するモデルで入力全体を数えます

    リクエスト全体を、モデルのトークンカウント用エンドポイントに送ります。Claudeのカウンターは無料で、モデルごとに対応していますが、得られるのは推定値です。多くのホスト型ツールや外部ツールとの接続を使うリクエストでは、代わりに実際のレスポンスに記録された利用量が必要です。単語数からの概算だけで、請求額を確定することはできません。Claudeのトークンカウントを確認してください。

  2. 完了したタスクの利用量を測定します

    代表的なメールを、実際の構成で処理します。追加の返信案や再試行も含め、すべてのモデル呼び出しで課金された入力と出力を記録してください。キャッシュを有効にする場合は、その利用量も分けて記録します。クレジット制のビルダーでは、タスク全体の内訳を確認します。Gumloopでは、チャットのヘッダーにあるクレジット数から詳細パネルを開けます。Gumloopの費用内訳を確認してください。

  3. 処理回数を掛け、固定料金を足します

    各処理の費用 =(入力トークン数 × 入力単価 + 出力トークン数 × 出力単価)÷ 1,000,000です。月間のトークン費用は、この金額に月間の処理回数を掛けて求めます。そのうえで、プラットフォームやホスティングの料金と、別途従量課金されるツールの費用を足します。

Haikuでは、(3,000 × $1 + 400 × $5)÷ 1,000,000 = 各処理$0.005です。1,100回処理すると、先ほどの**$5.50**になります。タスクで複数回の呼び出しが必要なら、それぞれの費用を合計してから月間の仕事の件数を掛けてください。最後の返信案を作る呼び出しだけで見積もってはいけません。

粘土で作られた郵便局の計量カウンターに、Haikuの処理の想定利用量を表示:入力3,000トークンと出力400トークンで$0.005、1,100回で$5.50
想定利用量を確認済みのHaiku単価で計算すると、処理全体で$0.005、1,100回で$5.50です。

AIエージェントの費用で見落としやすい項目

人による確認と修正。採用する返信の確認にメールあたり30秒かかると仮定すると、1,000通では500分、つまり8.33時間です。各返信に一分かかるなら、16.67時間になります。確認、修正、引き継ぎに実際にかかった時間に、雇用に伴う間接費も含めた自社の時間単価を掛けてください。同じ問い合わせを従来の方法で処理していた時間と比べます。

**再試行と追加の判断。**今回の例では、追加の処理を100回見込んでいます。実際のエージェントは、問い合わせの分類、情報の取得、返信案の検証を、それぞれ別のモデル呼び出しで行うこともあります。成果として数えるのが採用した返信だけでも、こうした呼び出しや失敗した処理は、月額費用に含めてください。

**ツールの呼び出し。**トークン料金が低くても、すべてのツール代が含まれるわけではありません。Claudeのウェブ検索は、1,000回あたり$10に加え、検索結果のトークン料金がかかります。この例で処理ごとに一度検索すると、検索料金が$11増え、入力トークンも増えます。自社の対応方針だけで回答するサポートエージェントなら、検索は不要かもしれません。Claudeの検索料金を確認してください。

**データと外部API。**ワークフローが使うメール、ヘルプデスク、CRM、データベース、文書ストレージ、情報補完サービスを確認します。コネクターが含まれていても、使えるのは接続機能です。接続先サービスの契約料金や利用料まで自動的に含まれるわけではありません。既存の費用と新たな費用を把握し、運用全体の予算と、このエージェントによって増える支出の両方を計算できるようにしてください。

**保守と利用枠。**認証情報の不具合、古くなった対応方針、動作の変化には、引き続き誰かが対応する必要があります。その時間も記録してください。サブスクリプションの共有枠にも上限があります。ほかの業務が同じ時間枠やクレジットを使うと、上位プランが必要になることもあります。

同じ粘土の郵便局の断面図で、プラットフォーム、モデル、ツール、データ、人による確認の各費用を表現
モデル利用料は運用費の一部です。プラットフォーム、ツール、データ、確認を行う人の費用も加えます。

問い合わせの解決件数で課金されるヘルプデスク向けエージェントについては、カスタマーサポートを自社で構築するか、サービスを利用するかの比較ガイドで扱っています。そちらのプロジェクト全体の採算は、この記事の継続的なソフトウェア費用の試算とは分けて考えてください。

導入後30日間で、何を測ればよいですか?

  • **成果:**受信したメール数、採用した返信数、再度対応が必要になった問い合わせ、人に引き継いだ案件。
  • **すべての課金単位:**有料ユーザー数、時間、クレジット、実行回数、入力・出力トークン、課金対象のツール呼び出し。
  • **追加作業:**採用した返信あたりの処理回数、修正、繰り返しの実行。
  • **人の作業時間:**確認、引き継ぎ、保守にかかった時間と、従来のワークフローとの比較。
  • **その他の料金:**ホスティング、ストレージ、接続先API、次の利用枠のプラン。
  • **採用した返信あたりの費用:**その業務に帰属するソフトウェア、ツール、人の費用をすべて足し、採用した返信数で割ります。問い合わせの解決件数を測る場合は、解決あたりの費用を別に記録してください。

継続して運用できる方式を選びます

今週中にメールの返信案を用意したいSaaSの創業者なら、完成済みのアシスタントから始められます。購入前に、問い合わせ全体を処理できる利用枠か確認し、確認担当者を決めてください。すぐに使える作業環境があることが利点です。注目すべき数値は、料金を支払った月ごとに採用できた返信数です。

メール、対応方針、注文データを組み合わせたいECの業務責任者なら、ビルダーを利用できます。ワークフロー全体を試し、実行回数やクレジットの内訳を確認してください。シンプルな返信案作成サービスと費用を比べる前に、有料の注文データ照会も加えます。

ワークフローを保守する担当者を確保できるバックエンド責任者なら、APIを利用する方法があります。範囲を限定したサポート業務から始め、返信の品質基準を満たすモデルのうち、最も安いものを評価してください。継続的な開発と確認の時間も予算に収まってこそ、トークン料金の節約が役立ちます。

この考え方は、ほかの業務にも使えます。営業責任者は、連絡した見込み客の数だけでなく、すべてのフォローアップメッセージと情報補完の操作を数えてください。経理担当者は、定期レポートごとのデータ取得、モデル呼び出し、確認を数え、採用したレポートによって省ける手作業の時間と比較します。

正しい結果の基準や、例外への対応担当者がまだ定まっていないなら、自律処理を広範囲に展開するのは待ってください。既存のルールベースのワークフローで安定して仕事を完了できている場合、モデルの追加は、効果が確認できていない段階で新たな料金を生むことになります。

実務に役立つツールと予算の解説は、ニュースレターでもお届けしています。

最終更新
2026年10月7日
カテゴリー
Explained

Googleでこのサイトを優先する

omidsaffari.comをGoogle検索の優先ソースに追加

omidsaffari.comを優先ソースに設定すると、GoogleがTop Stories・AI Overviews・AI Modeであなたのために優先表示します。

AI 文字起こしの料金は据え置き:Grok Voice Transcribe 2.0移行ガイド

AI 文字起こしの料金は据え置き:Grok Voice Transcribe 2.0移行ガイド

Grok Voice Transcribe 2.0のAI 文字起こし料金は、バッチが音声1時間あたり$0.10、ストリーミングが$0.20のままです。デフォルトモデル変更で起こり得る出力差、移行前に確認すべき総コスト、1.0と2.0を同条件で検証して本番モデルを固定する手順を、運用担当者向けに整理します。2026年9月20日Explained
HAR ファイルで原因を追う:Cloudflare Browser Runの失敗調査

HAR ファイルで原因を追う:Cloudflare Browser Runの失敗調査

Cloudflare Browser RunのSession RecordingにInspectパネルが加わり、完了後のログ、通信、最終DOMを確認できるようになりました。HAR ファイルで失敗原因を絞り込み、不要な再実行を減らす手順、料金への影響、録画では見えない領域まで、実務向けに分かりやすく解説します。2026年9月19日Explained
v0でnpm プライベートパッケージを活用する:社内コンポーネント再利用の実践ガイド

v0でnpm プライベートパッケージを活用する:社内コンポーネント再利用の実践ガイド

v0が共有環境変数経由でnpm プライベートパッケージに対応。NPM_TOKENとNPM_RCの選び方、認証情報をモデルやSandboxに渡さない仕組み、社内コンポーネントを試作から本番へ引き継ぐ設定手順、料金と実務上の注意点を整理し、差し替え工数を減らせるか判断する方法を解説します。2026年9月19日Explained
Claude Code 料金を見直す:auto modeの分類器課金が消える条件

Claude Code 料金を見直す:auto modeの分類器課金が消える条件

Claude Code 2.1.278では、auto modeの安全判定をサーバー側で処理できるセッションの分類器リクエスト課金がなくなります。API、Enterprise、クラウド、ゲートウェイ環境で適用条件を見極め、/statusで実際の課金経路を確認し、予算へ正しく反映する方法を解説します。2026年9月19日Explained
Vercel ビルド高速化:Turboを1回だけ使う方法と料金

Vercel ビルド高速化:Turboを1回だけ使う方法と料金

VercelのPro/Enterpriseで、プロジェクト設定を変えずに1回のデプロイだけTurboを指定する方法を解説します。GitHubのコミットマーカー、Vercel CLI、デプロイAPIという3つの経路と、1分あたり$0.105からの料金、権限不足時のフォールバック、通常ビルドとの比較手順まで整理しました。2026年9月18日Explained
ChatGPT Word連携の実力:できること・料金・導入手順

ChatGPT Word連携の実力:できること・料金・導入手順

ChatGPT Word連携を使えば、Wordのサイドバーで下書き、要約、選択範囲の修正、見出し調整まで完結します。利用条件、共有される使用量、料金の考え方、データ境界、導入手順を、提案書やSOPの具体例とともに解説。コピペ往復を減らしつつ、事実や約束を守るレビュー方法も紹介します。2026年9月18日Explained
Google Antigravity移行ガイド:10月5日までのローカルジョブ対応

Google Antigravity移行ガイド:10月5日までのローカルジョブ対応

Google Antigravityの5月版エージェントは2026年10月5日に停止予定です。出力のみのジョブはID変更で済みますが、ローカルツールやfunction_callを扱う環境には、新しいツール名、PascalCase引数、行範囲編集に対応するアダプター改修が必要です。安全な移行手順を解説します。2026年9月18日Explained
Cloudflare WorkersのRPCトレースで遅延箇所を特定する

Cloudflare WorkersのRPCトレースで遅延箇所を特定する

Cloudflare WorkersのRPCトレースで、遅い顧客リクエストを別のWorkerやDurable Objectまで追跡。担当サービスとメソッドを見つける手順、サンプリング率、保持期間、2026年10月1日以降のスパン単位の料金まで、チェックアウトの例で実践的に解説します。2026年9月17日Explained
ニュースレター

毎週日曜、一通の手紙。動くシステムの話。感想戦ではなく。

週刊。スパムなし。いつでも解除できます。