트래픽의 90%를 GPT-5 nano API로 라우팅합니다. 추론 수준의 분류와 추출을 아주 적은 비용으로 해냅니다. RouterBase의 5% 할인은 그대로 마진이 됩니다.
GPT-5 nano API 는 OpenAI 에서 가장 빠르고 저렴한 GPT-5 모델입니다 —— 40만 토큰 컨텍스트, 조절 가능한 추론, 비전(텍스트+이미지 입력), function calling, 구조화 JSON 출력을 갖추고 저지연·고처리량에 최적화되어 있습니다. GPT-5 nano API 는 OpenAI 호환: 기존 SDK 를 RouterBase 로 지정하고 모델을 gpt-5-nano 로 설정하면 됩니다. 입력 $0.03 / 1M, 출력 $0.24 / 1M, 캐시 읽기 $0.003 / 1M —— 표준가 대비 5% 저렴, 모두 하나의 REST 엔드포인트로.
GPT-5 nano API: 채팅
GPT-5 nano API로 OpenAI에서 가장 빠르고 저렴한 GPT-5 모델을 실행하세요. 추론, 400K 토큰 컨텍스트 윈도우, 비전을 지원합니다.
GPT-5 nano API는 OpenAI의 GPT-5 모델 중 가장 작고 비용 효율적인 모델입니다. 400K 토큰 컨텍스트 윈도우, 비전(텍스트 + 이미지 입력), 조정 가능한 추론 강도, function calling, 구조화된 JSON 출력을 갖추고 있으며 낮은 지연 시간과 높은 처리량에 맞게 튜닝되었습니다. RouterBase를 통해 라우팅되며 완전히 OpenAI 호환입니다. 기존 SDK를 RouterBase의 베이스 URL로 지정하고 모델을 gpt-5-nano로 설정하면 첫 호출이 즉시 통과됩니다.
요금은 입력 토큰 $0.03 / 1M, 출력 토큰 $0.24 / 1M, 캐시 입력 읽기 $0.003 / 1M로 표준 요율보다 5% 저렴합니다. RouterBase 키 하나면 충분하며, 별도의 OpenAI 자격 증명이 필요하지 않습니다.
팀이 GPT-5 nano API로 제품을 출시하는 6가지 이유
400K 토큰 컨텍스트부터 5% 할인 요금까지, GPT-5 nano가 돋보이는 이유를 소개합니다.
400K 토큰 컨텍스트
요청당 최대 400,000 토큰을 받습니다. 긴 문서, 여러 파일에 걸친 코드, 긴 채팅 기록도 단 한 번의 GPT-5 nano API 호출에 담깁니다.
nano 비용의 추론
GPT-5 nano API는 조정 가능한 추론 강도를 제공합니다. 어려운 문제에는 강도를 높이고 속도가 필요하면 낮추세요. 이 모든 것을 GPT-5 제품군에서 가장 저렴한 등급으로 누릴 수 있습니다.
가장 빠르고 저렴한 GPT-5 등급
대용량 워크로드를 위해 설계되었습니다. GPT-5 nano API는 입력 토큰 $0.03 / 1M로 가장 저렴한 GPT-5 모델이며, 대규모 분류, 자동 완성, 추출, 라우팅에 이상적입니다.
비전과 function calling
GPT-5 nano API는 텍스트와 함께 이미지를 받고 구조화된 도구 호출을 반환합니다. 이미지 URL 또는 base64를 전달하고, 도구를 정의하고, 엄격하게 유효한 JSON을 요청하세요.
OpenAI 호환 엔드포인트
GPT-5 nano API는 OpenAI의 chat-completions 와이어 포맷을 따릅니다. OpenAI에서 작동하는 모든 Python, Node, Go, Rust SDK가 그대로 동작합니다. 베이스 URL만 업데이트하면 됩니다.
200+ 모델을 키 하나로
GPT-5 nano API를 호출하는 동일한 RouterBase 키로 GPT-5, Claude Opus 4.8, Gemini 3.5 Flash 및 200+ 다른 모델로도 라우팅됩니다. 공급자별 자격 증명 관리가 필요 없습니다.

3단계로 GPT-5 nano API 시작하기
가입부터 첫 응답까지 5분 이내.
RouterBase API 키 생성하기
가입하고 API 키를 생성하세요. 키 하나로 GPT-5 nano API와 카탈로그의 모든 다른 모델에 도달합니다.
첫 메시지 보내기
OpenAI 호환 SDK를 routerbase.com/v1로 지정하고 모델을 gpt-5-nano로 설정하세요. 응답은 표준 chat-completions 스키마를 따르며, 스트리밍, 추론, 비전을 지원합니다.
사용량 확인하기
모든 응답에는 입력, 출력, 추론, 캐시 읽기 토큰을 포함한 상세 내역이 담겨 있어 호출마다 비용과 캐시 적중률을 확인할 수 있습니다.
사용한 만큼만 지불
RouterBase 는 파트너 등급 가격을 그대로 전달합니다. 모델의 공식 API 가격과 비교해 보세요.
팀이 GPT-5 nano API로 만드는 것
GPT-5 nano API와 RouterBase 모델 카탈로그에서 실행되는 실제 프로덕션 부하.
GPT-5 nano API의 비전이 OCR 파이프라인을 대체했습니다. 빠르고 저렴한 한 번의 호출로 텍스트와 이미지를 함께 캡션하고 추출합니다.
GPT-5 nano API의 구조화된 JSON 출력이 불안정하던 정규식 파싱을 없애 버렸습니다. 매번 엄격하게 유효한 JSON이 나오고 재시도는 전혀 없습니다.
우리 처리량에서는 GPT-5 nano가 채산이 맞는 유일한 GPT-5급 모델입니다. RouterBase 덕분에 5% 더 저렴해집니다.
GPT-5 nano API의 조정 가능한 추론 덕분에 요청마다 비용과 품질을 조절할 수 있습니다. 충분히 저렴해서 토큰 세는 일을 그만뒀습니다.
RouterBase는 GPT-5 nano API와 200+ 다른 모델을 키 하나 뒤에 둡니다. 우리 팀은 새 공급자 계정을 신청하는 일을 더 이상 하지 않게 되었습니다.
요청마다 GPT-5 nano API와 GPT-5를 A/B 테스트합니다. 같은 SDK에 모델 필드 하나뿐입니다. 대부분의 트래픽은 nano에 남았고 청구액은 70% 줄었습니다.
주말 동안 42개 서비스를 GPT-5 nano API로 마이그레이션했습니다. 유일한 PR 코멘트는 '잠깐, 이게 다야?'였습니다.
입력 $0.03 / 1M에서 다시 5% 할인되니, GPT-5 nano API가 우리의 대용량 기능을 실제로 수익성 있게 만들었습니다. ROI 계산은 즉각적이었습니다.
자주 묻는 질문
GPT-5 nano API에 관해 자주 묻는 질문입니다.
RouterBase가 OpenAI의 GPT-5 nano로 패스스루하는 것입니다. GPT-5 제품군에서 가장 빠르고 저렴한 채팅 엔드포인트로, 400K 토큰 컨텍스트, 조정 가능한 추론, 이미지 입력, function calling, 구조화된 출력을 갖추고 있으며 OpenAI 호환 REST 인터페이스로 제공됩니다.