본문으로 바로가기
반응형

NVIDIA API를 처음 사용한다면, 키 발급 → 모델 선택 → 키 보관 → Python 호출 순서대로 진행하면 됩니다.

아래 예제는 공식 문서에 기반한 재현 가능한 흐름을 보여줍니다

https://docs.api.nvidia.com/nim/docs/api-quickstart

 

 

핵심 용어 정의

용어 설명
NVIDIA API 키 build.nvidia.com에서 발급받는 인증 토큰【https://docs.api.nvidia.com/nim/docs/api-quickstart】
NIM API NVIDIA가 제공하는 모델 호스팅 프레임워크【https://docs.api.nvidia.com/nim/reference/llm-apis】
Free Endpoint 비용 없이 사용할 수 있는 모델 엔드포인트(카탈로그에서 필터링)【https://build.nvidia.com/models】
Chat Completions 텍스트 기반 대화형 모델 호출 경로 https://integrate.api.nvidia.com/v1/chat/completionshttps://docs.api.nvidia.com/nim/reference/llm-apis】

 

키 발급

  1. https://build.nvidia.com에 로그인
  2. Get API Key 버튼을 클릭해 키를 생성하고 복사한다【https://docs.api.nvidia.com/nim/docs/api-quickstart】
  3. 키는 비밀로 보관하고, 코드에 직접 삽입하지 않음【https://docs.api.nvidia.com/nim/docs/deployment】

 

주의: 키는 한 번만 발급되며, 분실 시 재발급이 필요합니다.

 

 

모델 선택

  • https://build.nvidia.com/models에서 Free Endpoint 필터를 적용해 사용 가능한 모델을 확인한다.
  • 카탈로그에 표시된 모델은 주기적으로 업데이트될 수 있으니, 실제 호출 시에는 최신 이름을 반드시 확인한다【https://build.nvidia.com/models】

 

키 보관 (안전한 방법)

# 예제 코드 1 – .env 파일에 키 저장
from dotenv import load_dotenv
import os

load_dotenv()                     # .env 파일을 로드

# 환경 변수 NVIDIA_API_KEY에 키를 설정하고, 런타임에 로드
NVIDIA_API_KEY = os.getenv("NVIDIA_API_KEY")
if not NVIDIA_API_KEY:
    raise ValueError("NVIDIA_API_KEY가 설정되지 않았습니다.")

 

주의: 실제 배포 시에는 .env 파일이나 클라우드 시크릿 관리 서비스를 사용하세요.
예제 코드이며 실행 전 환경에 맞게 확인·수정해야 합니다.

Python으로 모델 호출

# 예제 코드 2 – requests 로 Chat Completions 호출
import requests
import json

api_url = "https://integrate.api.nvidia.com/v1/chat/completions"
headers = {
    "Authorization": f"Bearer {NVIDIA_API_KEY}",
    "Content-Type": "application/json"
}
payload = {
    "model": "nvidia/nemotron-4-340b-instruct",   # 실제 사용 시 카탈로그에서 선택
    "messages": [
        {"role": "user", "content": "안녕하세요! NVIDIA API는 어떻게 사용하나요?"}
    ],
    "max_tokens": 150
}

response = requests.post(api_url, headers=headers, json=payload)

# 예제 코드 3 – 응답 파싱 및 오류 처리
if response.status_code == 200:
    result = response.json()
    print(json.dumps(result, indent=2, ensure_ascii=False))
else:
    print(f"오류 {response.status_code}: {response.text}")

 

주의: 위 코드는 예제 코드이며 실행 전 환경에 맞게 확인·수정해야 합니다.

모델 이름은 카탈로그에서 실제 사용 가능한 이름으로 교체하세요.

 

 

카탈로그에서 Free Endpoint 찾기

  1. https://build.nvidia.com/models 로 이동
  2. Filter  Free Endpoint 를 선택
  3. 제공되는 모델을 확인하고, 원하는 모델을 클릭

최신 모델 리스트는 공식 카탈로그 페이지에 반영될 수 있으므로, 사용 전 반드시 최신 정보를 확인하세요.

 

API 키 발급 및 호출 예제

API 키는 모델 상세 페이지에서 Get API Key 버튼을 눌러 발급받습니다.
아래는 Python requests 를 이용한 간단한 호출 예제입니다.

# 예제 코드이며 실행 전 환경에 맞게 확인해야 합니다.
import requests

API_KEY = "YOUR_API_KEY"
ENDPOINT = "https://integrate.api.nvidia.com/v1/chat/completions"

headers = {
    "Authorization": f"Bearer {API_KEY}",
    "Content-Type": "application/json"
}

payload = {
    "model": "nvidia/nemotron-4-340b-instruct",
    "messages": [
        {"role": "user", "content": "안녕하세요! NIM API 무료 사용법이 궁금합니다."}
    ],
    "max_tokens": 150
}

response = requests.post(ENDPOINT, json=payload, headers=headers)
print(response.json())

위 코드는 공식 API 문서(API Catalog Quickstart Guide) 를 기반으로 작성되었습니다.

 

호스팅 엔드포인트와 Chat Completions 경로

이 경로는 LLM API 문서에 명시되어 있습니다.

 

콘솔에서 잔여 크레딧 조회 방법

  1. https://build.nvidia.com 로 로그인
  2. My Account  Usage 페이지 이동
  3. Remaining Credits 섹션을 확인

잔여 크레딧은 콘솔 UI에서 직접 확인할 수 있으며, 상세 내역은 API를 통해 조회할 수도 있습니다.

 

정책 변동 시 주의사항

  • 무료 크레딧 양  사용 한도는 공식 문서에 명시되지 않아 정확한 수치를 제공할 수 없습니다.
  • 카탈로그 모델 리스트와 Free Endpoint 제공 여부는 주기적으로 업데이트될 수 있으니, 최신 정보를 정기적으로 확인하세요.

 

오류 확인

HTTP 코드 의미 처리 예시
401 인증 실패 (키 오류) 키 재발급 또는 환경 변수 확인
429 요청 과다 (Rate Limit) 백오프 후 재시도
500 서버 내부 오류 잠시 후 재시도

 

참고 자료

 

 

무료 정책 및 모델 목록은 변동될 수 있으므로, 최신 정보는 반드시 위에 링크된 공식 문서를 확인하십시오.

 

위 흐름을 따라 진행하면 NVIDIA API를 무료로 체험하고, Python 코드만으로 모델 호출까지 완료할 수 있습니다.

궁금한 점이 있으면 공식 문서를 참고하거나, 댓글을 통해 질문해 주세요.

반응형