Warp

Nemotron 3 Ultra 550B A55B

대화입력: 텍스트출시일 2026. 6. 4.

제작사 NVIDIA · 미국 · nvidia.com

NVIDIA의 대화 모델.

사용 방법

이름 뒤에 접미사만 붙이면 됩니다. 어려운 질문은 이 모델이 그대로 답하고, 쉬운 질문만 더 싼 모델로 갑니다. 이 모델보다 비싼 모델은 쓰지 않습니다.

model: "nvidia/nemotron-3-ultra-550b-a55b:auto"

성향을 지정하지 않습니다 — 키에 저장된 기본값이 그대로 적용됩니다.

접미사 없이 이름만 넣으면 라우팅 없이 항상 이 모델로 갑니다 — 절감도 없습니다.

컨텍스트

512K

최대 출력

33K

입력 $/1M

$0.60

출력 $/1M

$3.60

기능

제공 업체

TogetherGMI CloudVenice

제공 업체

같은 모델을 제공하는 업체별 단가·지연·업타임입니다. Warp은 최근 응답 상태가 좋은 업체부터 시도하고, 실패하면 다음 업체로 넘어갑니다. 행을 누르면 리전·데이터 정책까지 자세히 볼 수 있습니다.

제공 업체 지표 불러오는 중…

성능

업체별 실측 지연(짧을수록 좋음)과 처리량(높을수록 좋음)입니다.

속도

제공 업체 지표 불러오는 중…

파라미터 지원

이 모델로 요청을 보낼 때 Warp이 각 파라미터를 실제로 어떻게 처리하는지입니다. 제공 업체와 API 표면마다 결과가 다릅니다.

제공 업체