トラフィックの 90% を GPT-4o mini API 経由でルーティングしています。分類と抽出をごくわずかなコストで実現できます。RouterBase の 5% 割引はそのままマージンになります。
GPT-4o mini API は OpenAI の高速・低コストなマルチモーダルモデルです — 128K トークンコンテキスト、ネイティブビジョン(テキスト+画像入力)、関数呼び出し、構造化 JSON 出力。GPT-4o mini API は OpenAI 互換:既存 SDK を RouterBase に向け、モデル名を gpt-4o-mini のままにするだけです。入力 $0.09 / 1M、出力 $0.36 / 1M、キャッシュ読み取り $0.045 / 1M — 標準価格より 5% 引き、すべて 1 つの REST エンドポイントから。
GPT-4o mini API:チャット
GPT-4o mini API を使って、OpenAI の高速・低コストなマルチモーダルモデルを実行しましょう。テキストとビジョンを 1 つのエンドポイントで扱えます。
GPT-4o mini API は、OpenAI で最もコスト効率に優れた小型モデルです。128K トークンのコンテキストウィンドウ、ネイティブなビジョン(テキスト + 画像入力)、function calling、構造化された JSON 出力を備えています。RouterBase 経由でルーティングすれば、完全に OpenAI 互換となります。既存の SDK を RouterBase のベース URL に向け、モデル名を gpt-4o-mini のままにすれば、最初のリクエストがすぐに通ります。
料金は入力トークン $0.09 / 1M、出力トークン $0.36 / 1M、キャッシュ入力読み取り $0.045 / 1M で、標準料金より 5% 安くなっています。RouterBase のキー 1 つだけで利用でき、OpenAI の認証情報を別途用意する必要はありません。
チームが GPT-4o mini API で開発・出荷する 6 つの理由
ネイティブビジョンから 5% オフの料金まで、GPT-4o mini が際立つ理由をご紹介します。
128K トークンのコンテキスト
1 リクエストあたり最大 128,000 トークンを受け付けます。長いドキュメント、複数ファイルにわたるコード、長い会話履歴も、1 回の GPT-4o mini API 呼び出しに収まります。
ネイティブビジョン
GPT-4o mini API は、テキストと並べて画像も受け付けます。同じリクエストに画像 URL または base64 を渡せば、キャプション生成、抽出、視覚コンテンツの推論が行えます。
function calling とツール
ツールを定義すれば、GPT-4o mini API は構造化されたツール呼び出しを返します。標準的な OpenAI の function calling スキーマで、エージェント、検索、アプリのアクションに組み込めます。
構造化された JSON 出力
JSON スキーマをリクエストすれば、GPT-4o mini API は毎回厳密に有効な JSON を返します。壊れやすいパースが不要になり、抽出や分類に最適です。
高速・低コスト
大量処理向けに設計されています。GPT-4o mini API は入力トークン $0.09 / 1M という OpenAI で最も安価な GPT-4 クラスのモデルで、RouterBase 経由なら標準料金より 5% 安くなります。
1 つのキーで 200+ モデル
GPT-4o mini API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、Gemini 3.5 Flash、その他 200+ のモデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

3 ステップで GPT-4o mini API を使い始める
サインアップから最初のレスポンスまで 5 分以内で完了します。
RouterBase API キーを作成
サインアップして API キーを生成しましょう。1 つのキーで GPT-4o mini API とカタログ内の他のすべてのモデルにアクセスできます。
最初のメッセージを送信
OpenAI 互換の SDK を routerbase.com/v1 に向け、モデルを gpt-4o-mini に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとビジョンに対応しています。
使用状況を確認
すべてのレスポンスに、入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、呼び出しごとにコストとキャッシュヒット率を確認できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが GPT-4o mini API で構築するもの
GPT-4o mini API と RouterBase のモデルカタログ上で動作する、実際の本番負荷をご紹介します。
GPT-4o mini API のネイティブビジョンが、OCR パイプライン一式を置き換えました。1 回の呼び出しでキャプション生成と抽出ができ、テキストと画像を同じリクエストで扱えます。
GPT-4o mini API の構造化された JSON 出力が、不安定な正規表現パースを葬り去りました。毎回厳密に有効な JSON が返り、リトライはゼロです。
私たちの処理量では、採算が合う GPT-4 クラスのモデルは GPT-4o mini だけです。RouterBase ならさらに 5% 安くなります。
GPT-4o mini API の function calling は、私のエージェントループにそのまま組み込めます。十分に安いので、トークンを数えるのをやめました。
RouterBase は GPT-4o mini API と 200+ の他モデルを 1 つのキーの背後に置きます。チームは新しいプロバイダーアカウントの申請をしなくなりました。
リクエストごとに GPT-4o mini API と GPT-4o を A/B テストしています。同じ SDK で、モデルフィールド 1 つの違いです。トラフィックの大半は mini のままで、請求額は 70% 下がりました。
週末で 42 のサービスを GPT-4o mini API に移行しました。唯一の PR コメントは「えっ、これだけ?」でした。
入力 $0.09 / 1M からさらに 5% 引きという料金で、GPT-4o mini API は大量処理機能を実際に収益化できるものにしてくれました。ROI の計算は一瞬でした。
よくある質問
GPT-4o mini API に関するよくある質問です。
OpenAI の GPT-4o mini への RouterBase のパススルーです。128K トークンのコンテキスト、ネイティブビジョン、function calling、構造化出力を備えた高速・低コストなマルチモーダルチャットエンドポイントで、OpenAI 互換の REST インターフェースで提供されます。