{{ formError }}
기본 설정만 저장합니다. 명령·환경변수·토큰·비밀정보·모델 링크는 저장하지 않습니다.
{{ capacityStatus }}
STEP {{ stepNo }}{{ stepName }}
무엇을 실행하려고 하나요?
권한과 상품 사용 가능 여부를 자동 확인합니다.
인프라 · {{ infraNote }}
바로 실행 가능한 환경인가요?
승인된 이미지(digest 고정)와 검증 모델만 공유형에서 실행할 수 있습니다.
모델은 다음 단계(GPU 선택)에서 고릅니다. 검증 모델이나 Hugging Face 링크를 넣으면 필요한 GPU를 계산해 상품을 추천합니다
{{ modelCheck }}
실행 명령 * 컨테이너 안에서 sh -c로 실행합니다. 여러 줄 가능{{ cmdLen }} / 4000
{{ cmdErr }}
환경변수 선택. 키는 대문자, 숫자, _ (숫자로 시작 불가). COMPUTELENS_로 시작하는 키는 예약{{ envCount }} / 20
{{ r.err }}
비밀값은 넣지 마세요. 환경변수는 작업 상세에 그대로 표시됩니다.
쓰던 작업 저장소를 아래에서 고르면 /workspace에 붙습니다. 입력 데이터와 결과를 그 안에 두면 노트북과 추론에서도 같은 볼륨으로 이어 씁니다. 임시로 두면 파드가 끝날 때 컨테이너 안 파일은 사라집니다.
코드·데이터 쓰던 볼륨을 /workspace에 붙입니다
작업 저장소
{{ wsFixedText }} 새 볼륨 이름{{ wsNameErr }}
모델 캐시{{ modelCacheText }}
보존{{ keepText }}
내 작업에 맞는 GPU인가요?
필요한 GPU 메모리를 계산해 상품별로 비교합니다. 추론은 모델의 config.json과 가중치 파일 크기로, 개발은 모델 크기로 계산합니다. 규칙 계산값이며 LLM이 생성한 수치가 아닙니다.
모델 정보: {{ modelInfoStatus }}런타임: {{ runtimeStatus }}메모리: {{ memoryStatus }}실제 실행: 배포 후 확인 필요
{{ modelNextAction }}
모델 기술 정보
{{ hfInfo }}가중치 {{ est.weights }} GiBKV cache {{ est.kv }} GiB런타임 여유 {{ est.overhead }} GiB필요 메모리 (추정) {{ est.total }} GiB{{ estNote }}
고급: 전체 프로파일 보기 ({{ otherCount }}개)
직접 GPU 자원 설정 · 고급 옵션
직접 GPU 자원 설정 공유 GPU 1장 · {{ cuCardLabel }}GPU 1장을 다른 작업과 공유하며 필요한 자원을 지정합니다.
자동 할당: CPU {{ cu.cpu }}개 · RAM {{ cu.ram }} GiB
예상 요금 {{ cu.priceText }}/시간
예상 요금 {{ cu.priceText }}/시간
{{ cu.modelNote }}
연산 상한은 처리 속도를 보장하는 비율이 아닙니다.
배정 상태 자세히 보기
GPU별 남은 할당 예산
{{ k.label }}
메모리 {{ k.totalGiB }} 중 {{ k.freeGiB }} GiB 남음
연산 {{ k.totalCores }} 중 {{ k.freeCores }} 남음 · {{ k.pods }}개 실행 중
메모리 {{ k.totalGiB }} 중 {{ k.freeGiB }} GiB 남음
연산 {{ k.totalCores }} 중 {{ k.freeCores }} 남음 · {{ k.pods }}개 실행 중
조회 중…
{{ cu.cardText }}
{{ cu.capLabel }}조회 {{ cu.at }} · 10초마다 갱신 · 스냅샷이며 예약이 아닙니다
vLLM 엔진 설정 고급 옵션{{ engineSummary }}
입력한 설정은 실제 vLLM 실행에 적용됩니다. 빈 항목은 엔진 또는 플랫폼 기본값을 사용합니다.
병렬 구성 TP {{ engineTP }} · PP 1 · DP 1선택한 GPU 수에 맞춰 자동 설정합니다. 다중 노드는 기존 Ray 실행 구성을 사용합니다.
FP8 KV 캐시는 모델·하드웨어에 따라 지원과 정확도가 달라집니다. 현재 메모리 추천은 보수적인 기존 KV 추정값을 유지하며, 배포 후 실제 로딩을 확인하세요.
{{ engineError }}
예상 GPU 비용 = 주문 단가 × 실행 시간. 연결 볼륨 비용은 포함하지 않습니다. 가용성은 조회 시점 기준이며 예약이 아닙니다. 생성 직전 서버가 다시 검증합니다. 연산 제한값은 처리량 보장값이 아닙니다.
실패하면 어떻게 하고, 언제까지 돌리나요?
작업은 명령을 한 번 실행하고 끝납니다. 실패하면 새 파드로 처음부터 다시 시도합니다.
재시도 횟수
{{ retryNote }}
최대 실행 시간
작업이 시작된 뒤 모든 시도를 합쳐 이 시간을 넘으면 중단되고 실패(JOB_DEADLINE)로 끝납니다. 대기열에서 기다린 시간은 포함하지 않습니다.
결과물저장되지 않습니다. 결과는 코드에서 외부 저장소로 올리세요.
로그시도마다 로그 끝부분(64 KiB)만 보존됩니다. 작업 상세에서 시도별로 봅니다.
체크포인트 재개지원하지 않습니다. 재시도와 다시 실행은 처음부터 실행합니다.
다시 실행끝난 작업은 같은 명세로 새 작업을 만듭니다. 단가는 새 주문 시점 기준입니다.
누가 어떻게 접속하나요?
비밀정보→ 환경변수 등록한 비밀정보가 없습니다. 프로젝트와 권한에서 등록합니다 값은 화면과 API에 보이지 않고, 컨테이너 안에서만 환경변수로 읽힙니다. {{ secretNote }}
접속 공개 범위
인증SSO(OIDC) 인증 프록시 경유 · 브라우저 터미널·파일도 객체 권한 검사
얼마가 들고 언제 종료되나요?
단가 버전·쿼터·용량을 생성 직전 다시 확인합니다.
이미지{{ batchImage }}
실행 명령
{{ cmdPreview }}
환경변수{{ envPreview }}
재시도{{ retryNote }}
최대 실행 시간{{ rtLabel }}. 넘으면 실패(JOB_DEADLINE)
결과물은 저장되지 않습니다. 로그 끝부분(64 KiB)만 보존됩니다. 결과는 코드에서 외부 저장소로 올리세요.
체크포인트 재개는 지원하지 않습니다. 재시도는 처음부터 다시 실행합니다.
체크포인트 재개는 지원하지 않습니다. 재시도는 처음부터 다시 실행합니다.
자동 종료 (10분 전 예고 · 언제든 상세에서 변경)
{{ idleSummary }}
생성 전 확인
{{ c.k }}{{ c.v }}
{{ budgetMsg }}