NVIDIA API를 처음 사용한다면, 키 발급 → 모델 선택 → 키 보관 → Python 호출 순서대로 진행하면 됩니다.
아래 예제는 공식 문서에 기반한 재현 가능한 흐름을 보여줍니다
https://docs.api.nvidia.com/nim/docs/api-quickstart
핵심 용어 정의
| 용어 | 설명 |
|---|---|
| NVIDIA API 키 | build.nvidia.com에서 발급받는 인증 토큰【https://docs.api.nvidia.com/nim/docs/api-quickstart】 |
| NIM API | NVIDIA가 제공하는 모델 호스팅 프레임워크【https://docs.api.nvidia.com/nim/reference/llm-apis】 |
| Free Endpoint | 비용 없이 사용할 수 있는 모델 엔드포인트(카탈로그에서 필터링)【https://build.nvidia.com/models】 |
| Chat Completions | 텍스트 기반 대화형 모델 호출 경로 https://integrate.api.nvidia.com/v1/chat/completions【https://docs.api.nvidia.com/nim/reference/llm-apis】 |
키 발급
https://build.nvidia.com에 로그인- Get API Key 버튼을 클릭해 키를 생성하고 복사한다【https://docs.api.nvidia.com/nim/docs/api-quickstart】
- 키는 비밀로 보관하고, 코드에 직접 삽입하지 않음【https://docs.api.nvidia.com/nim/docs/deployment】
주의: 키는 한 번만 발급되며, 분실 시 재발급이 필요합니다.
모델 선택
https://build.nvidia.com/models에서 Free Endpoint 필터를 적용해 사용 가능한 모델을 확인한다.- 카탈로그에 표시된 모델은 주기적으로 업데이트될 수 있으니, 실제 호출 시에는 최신 이름을 반드시 확인한다【https://build.nvidia.com/models】
키 보관 (안전한 방법)
# 예제 코드 1 – .env 파일에 키 저장
from dotenv import load_dotenv
import os
load_dotenv() # .env 파일을 로드
# 환경 변수 NVIDIA_API_KEY에 키를 설정하고, 런타임에 로드
NVIDIA_API_KEY = os.getenv("NVIDIA_API_KEY")
if not NVIDIA_API_KEY:
raise ValueError("NVIDIA_API_KEY가 설정되지 않았습니다.")
주의: 실제 배포 시에는 .env 파일이나 클라우드 시크릿 관리 서비스를 사용하세요.
예제 코드이며 실행 전 환경에 맞게 확인·수정해야 합니다.
Python으로 모델 호출
# 예제 코드 2 – requests 로 Chat Completions 호출
import requests
import json
api_url = "https://integrate.api.nvidia.com/v1/chat/completions"
headers = {
"Authorization": f"Bearer {NVIDIA_API_KEY}",
"Content-Type": "application/json"
}
payload = {
"model": "nvidia/nemotron-4-340b-instruct", # 실제 사용 시 카탈로그에서 선택
"messages": [
{"role": "user", "content": "안녕하세요! NVIDIA API는 어떻게 사용하나요?"}
],
"max_tokens": 150
}
response = requests.post(api_url, headers=headers, json=payload)
# 예제 코드 3 – 응답 파싱 및 오류 처리
if response.status_code == 200:
result = response.json()
print(json.dumps(result, indent=2, ensure_ascii=False))
else:
print(f"오류 {response.status_code}: {response.text}")
주의: 위 코드는 예제 코드이며 실행 전 환경에 맞게 확인·수정해야 합니다.
모델 이름은 카탈로그에서 실제 사용 가능한 이름으로 교체하세요.
카탈로그에서 Free Endpoint 찾기
- https://build.nvidia.com/models 로 이동
- Filter → Free Endpoint 를 선택
- 제공되는 모델을 확인하고, 원하는 모델을 클릭
최신 모델 리스트는 공식 카탈로그 페이지에 반영될 수 있으므로, 사용 전 반드시 최신 정보를 확인하세요.
API 키 발급 및 호출 예제
API 키는 모델 상세 페이지에서 Get API Key 버튼을 눌러 발급받습니다.
아래는 Python requests 를 이용한 간단한 호출 예제입니다.
# 예제 코드이며 실행 전 환경에 맞게 확인해야 합니다.
import requests
API_KEY = "YOUR_API_KEY"
ENDPOINT = "https://integrate.api.nvidia.com/v1/chat/completions"
headers = {
"Authorization": f"Bearer {API_KEY}",
"Content-Type": "application/json"
}
payload = {
"model": "nvidia/nemotron-4-340b-instruct",
"messages": [
{"role": "user", "content": "안녕하세요! NIM API 무료 사용법이 궁금합니다."}
],
"max_tokens": 150
}
response = requests.post(ENDPOINT, json=payload, headers=headers)
print(response.json())
위 코드는 공식 API 문서(API Catalog Quickstart Guide) 를 기반으로 작성되었습니다.
호스팅 엔드포인트와 Chat Completions 경로
- Hosted Endpoint: https://integrate.api.nvidia.com
- Chat Completions 경로: https://integrate.api.nvidia.com/v1/chat/completions
이 경로는 LLM API 문서에 명시되어 있습니다.
콘솔에서 잔여 크레딧 조회 방법
- https://build.nvidia.com 로 로그인
- My Account → Usage 페이지 이동
- Remaining Credits 섹션을 확인
잔여 크레딧은 콘솔 UI에서 직접 확인할 수 있으며, 상세 내역은 API를 통해 조회할 수도 있습니다.
정책 변동 시 주의사항
- 무료 크레딧 양 및 사용 한도는 공식 문서에 명시되지 않아 정확한 수치를 제공할 수 없습니다.
- 카탈로그 모델 리스트와 Free Endpoint 제공 여부는 주기적으로 업데이트될 수 있으니, 최신 정보를 정기적으로 확인하세요.
오류 확인
| HTTP 코드 | 의미 | 처리 예시 |
|---|---|---|
| 401 | 인증 실패 (키 오류) | 키 재발급 또는 환경 변수 확인 |
| 429 | 요청 과다 (Rate Limit) | 백오프 후 재시도 |
| 500 | 서버 내부 오류 | 잠시 후 재시도 |
참고 자료
- API Catalog Quickstart – 키 발급 절차 상세【https://docs.api.nvidia.com/nim/docs/api-quickstart】
- LLM APIs Reference – 엔드포인트와 파라미터 설명【https://docs.api.nvidia.com/nim/reference/llm-apis】
- Models | Try NVIDIA NIM APIs – Free Endpoint 카탈로그 확인【https://build.nvidia.com/models】
- Deployment FAQ – 키 보관 및 보안 권고【https://docs.api.nvidia.com/nim/docs/deployment】
무료 정책 및 모델 목록은 변동될 수 있으므로, 최신 정보는 반드시 위에 링크된 공식 문서를 확인하십시오.
위 흐름을 따라 진행하면 NVIDIA API를 무료로 체험하고, Python 코드만으로 모델 호출까지 완료할 수 있습니다.
궁금한 점이 있으면 공식 문서를 참고하거나, 댓글을 통해 질문해 주세요.
'AI' 카테고리의 다른 글
| 멀티 에이전트가 항상 더 좋은 것은 아닌 이유 (0) | 2026.08.03 |
|---|---|
| Orca에서 Codex 연결하기: 설치부터 작업 실행까지 (0) | 2026.08.03 |
| Orca ADE란? Codex를 워크트리에서 병렬로 사용하는 방법 (1) | 2026.08.02 |
| AI가 잘 읽는 Markdown 문서 구조 만들기 (0) | 2026.08.02 |
| AI 에이전트 하네스란? 모델보다 실행 구조가 중요한 이유 (0) | 2026.08.02 |
