私たちは数学とコーディングのワークロードをo4-mini API経由でルーティングしています。フラッグシップのわずかなコストでo-seriesの推論が使えます。RouterBaseの5%割引は純粋な利益です。
o4-mini API は OpenAI のコスト効率に優れた o シリーズの推論モデルです —— 20 万トークンコンテキスト、調整可能な推論強度、ビジョン(テキスト+画像入力)、function calling、構造化 JSON 出力を備え、数学・コーディング・STEM の性能向けに最適化されています。OpenAI o4-mini API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを o4-mini に設定するだけです。入力 $0.66 / 1M、出力 $2.64 / 1M、キャッシュ読み取り $0.165 / 1M —— 標準価格より 5% 引き、すべて 1 つの REST エンドポイントから。
OpenAI o4-mini API:チャット
o4-mini APIを使って、OpenAIのコスト効率に優れたo-seriesの推論モデルを実行しましょう。200Kトークンのコンテキストで、数学、コーディング、視覚的推論に強みを発揮します。
o4-mini APIは、OpenAIのコンパクトなo-series推論モデルです。200Kトークンのコンテキストウィンドウ、調整可能な推論の労力、ビジョン(テキスト+画像入力)、function calling、構造化されたJSON出力を備え、フラッグシップのわずかなコストで数学、コーディング、STEMの高いパフォーマンスを実現するよう調整されています。RouterBase経由でルーティングされるOpenAI o4-mini APIは、OpenAIと完全な互換性があります。既存のSDKをRouterBaseのベースURLに向け、モデルをo4-miniに設定するだけで、最初の呼び出しがすぐに通ります。
料金は入力トークン100万あたり$0.66 / 1M、出力トークン100万あたり$2.64 / 1M、キャッシュ入力読み取り100万あたり$0.165 / 1Mで、標準レートより5%安くなっています。RouterBaseのキーは1つだけ。OpenAIの認証情報を別途用意する必要はありません。
チームがo4-mini APIで開発する6つの理由
o-seriesの推論から5%オフの料金まで、OpenAI o4-mini APIが際立つ理由をご紹介します。
コスト効率の高い推論
o4-mini APIは、フラッグシップのわずかな価格でo-seriesの連鎖思考推論を提供します。数学、コーディング、ロジックにおいてクラス最高の価格性能比を実現します。
調整可能な推論の労力
o4-mini APIでは推論の労力をlow、medium、highに設定できます。難しい多段階の問題には上げ、速くて安い回答には下げて調整しましょう。
200Kトークンのコンテキスト
1リクエストあたり最大200,000トークンを受け付けます。長いドキュメント、複数ファイルのコード、長い会話履歴も、1回のo4-mini API呼び出しに収まります。
ビジョンとfunction calling
o4-mini APIはテキストと一緒に画像を受け付け、構造化されたツール呼び出しを返します。画像URLまたはbase64を渡し、ツールを定義して、厳密に有効なJSONをリクエストできます。
OpenAI互換エンドポイント
OpenAI o4-mini APIはOpenAIのchat-completionsワイヤーフォーマットに対応しています。OpenAIで動作するPython、Node、Go、RustのどのSDKもそのまま使えます。ベースURLを更新するだけです。
200以上のモデルを1つのキーで
o4-mini APIを呼び出すのと同じRouterBaseのキーが、GPT-5、Claude Opus 4.8、Gemini 3.5 Flash、その他200+のモデルにもルーティングします。プロバイダーごとの認証情報の管理は不要です。

3ステップでo4-mini APIを始めましょう
サインアップから最初のレスポンスまで5分以内。
RouterBase APIキーを作成する
サインアップしてAPIキーを生成しましょう。1つのキーでo4-mini APIとカタログ内のすべてのモデルにアクセスできます。
最初のメッセージを送信する
OpenAI互換のSDKをrouterbase.com/v1に向け、モデルをo4-miniに設定します。レスポンスは標準のchat-completionsスキーマに従い、ストリーミング、推論、ビジョンに対応しています。
使用状況を確認する
すべてのレスポンスには、入力、出力、推論、キャッシュ読み取りのトークンを含む詳細な内訳が含まれます。コストとキャッシュヒット率を呼び出しごとに確認できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームがo4-mini APIで構築するもの
o4-mini APIとRouterBaseのモデルカタログで動作する実際の本番ワークロード。
o4-mini APIのビジョン推論が、私たちのグラフやスクリーンショットを直接読み取ります。1回の呼び出しで画像を分析し、構造化された結果を返してくれます。
o4-mini APIの構造化JSON出力が、私たちの不安定な正規表現パースを終わらせました。毎回厳密に有効なJSONで、リトライはゼロです。
調整可能な推論の労力で、o4-mini APIをタスクごとにチューニングできます。RouterBaseはそれを5%安くし、障害を自動で回避してくれます。
o4-mini APIは、フラッグシップの請求書なしに、私のエージェントループの難しい推論ステップを解決してくれます。ベースURLを1回入れ替えるだけで稼働しました。
RouterBaseはo4-mini APIと200+のモデルを1つのキーの後ろに置きます。私たちのチームは新しいプロバイダーアカウントの申請をしなくなりました。
私たちはリクエストごとにo4-mini APIとo3をA/Bテストしています。同じSDK、モデルフィールドが1つだけ。ほとんどのトラフィックはo4-miniのままで、請求額は大幅に下がりました。
私たちは週末で42のサービスをo4-mini APIに移行しました。唯一のPRコメントは「待って、これだけ?」でした。
入力$0.66 / 1Mから5%引きで、o4-mini APIはフラッグシップの請求書なしに推論グレードの品質を提供してくれました。ROIの計算は一瞬でした。
よくある質問
o4-mini APIに関するよくある質問。
RouterBaseによるOpenAIのo4-miniへのパススルーです。200Kトークンのコンテキスト、調整可能な推論の労力、画像入力、function calling、構造化出力を備えたコスト効率の高いo-series推論エンドポイントを、OpenAI互換のRESTインターフェースで提供します。