Jev 1.13 카드
실시간 모델 카드, 별칭, 가격 및 제한.
현재 제공되는 모델은 Jev 1.13이며 버전 ID는 jev-1.13.0입니다. TypeSafe의 카드에 있는 모든 모델은 POST /v1/systemone으로 제공되며, 요청의 model 필드에서 호출을 처리할 이름을 선택합니다. jev-latest은 SDK 기본값이며 현재 jev-1.13.0으로 해석됩니다. jev-preview도 현재 같은 ID를 가리키며, TypeSafe에 따르면 사용 가능한 프리뷰 빌드는 없습니다. 이 카드에 맞춰 임계값을 조정했다면 버전 ID를 고정하세요.
가격, 컨텍스트 및 호출 제한
입력 가격은 토큰 10억 개당 $42, 100만 개당 $0.042입니다. 출력 토큰은 무료입니다. 문서에 명시된 초당 250,000토큰 또는 분당 1,200개 요청을 초과하면 429 요청 과다 오류가 반환됩니다. 공식 SDK는 백오프로 재시도하며 retry-after가 있으면 이를 따릅니다. TypeSafe은 수요가 높고 GPU 계약이 체결되는 동안 제한이 동적으로 조정되며 예고 없이 바뀔 수 있다고 안내합니다. 맞춤형 및 엔터프라이즈 플랜은 sales@typesafe.ai를 통해 한도를 높일 수 있습니다.
요청당 컨텍스트는 64k 토큰입니다. 이와 별도로 state과 가장 긴 질문을 합쳐 32k 토큰의 한도가 적용됩니다. Jev은 state을 한 번 입력받고 모든 질문을 병렬로 평가하므로, 64k 창에는 state과 모든 질문을 합친 내용이 들어갑니다. 관련 없는 세부 정보로 state이 길어질수록 정확도가 떨어지며, 이 실패 유형은 jaggedness 페이지에 나와 있습니다. 창고 전체를 한 필드에 욱여넣지 말고, speculative fan-out을 사용해 작은 질문을 여러 개 묶으세요.
입력은 텍스트만 지원합니다. 문자열, JSON 객체 또는 텍스트 값 배열을 사용할 수 있습니다. 이미지, 오디오, 동영상은 입력할 수 없습니다. 호출 전에 텍스트가 아닌 데이터를 필드로 전처리하세요. 주 학습 언어는 영어입니다. CJK를 포함한 다른 언어는 정확도가 더 낮으므로 비영어 대기열을 자동화하기 전에 confidence을 측정하세요.
Jev 1.13
- 모델 ID
- jev-1.13.0
- role
- versioned-id
- 입력 토큰 100만 개당 가격(USD)
- 0.042
- 청구된 출력
- false
- 초당 토큰 수
- 250000
- 분당 요청 수
- 1200
- 컨텍스트 토큰 수
- 64000
- state와 가장 긴 질문의 토큰 수 합계
- 32000
- input
- text-only
jev-latest
- 모델 ID
- jev-latest
- role
- stable-alias
- 참조 대상
- jev-1.13.0
- SDK 기본값
- true
jev-preview
- 모델 ID
- jev-preview
- role
- preview-alias
- 참조 대상
- jev-1.13.0
- 미리 보기 빌드 제공 여부
- false
별칭과 모델 목록 조회
별칭은 버전 ID로 해석되는 모델 이름입니다. 다른 이름과 마찬가지로 model 필드에 넣어 보내세요. jev-latest은 가장 최근의 공식 안정 릴리스를 뜻합니다. jev-preview은 공식 여부와 관계없이 가장 최근 릴리스를 뜻하며, 프리뷰 빌드가 있으면 jev-latest보다 앞섭니다. 현재 두 이름 모두 jev-1.13.0을 가리킵니다.
새 릴리스가 배포되면 별칭이 이동하므로 코드 변경이 없어도 그 별칭의 답변이 달라질 수 있습니다. 응답의 model 필드는 실제로 답변한 버전 ID를 반환합니다. 이 ID를 기록하세요. confidence 임계값을 jev-1.13.0에 맞춰 조정했다면 다시 조정할 때까지 jev-1.13.0을 계속 보내세요.
GET /v1/models는 계정에서 보낼 수 있는 이름과 설명 및 출시일을 반환합니다. 현재는 별칭도 표시합니다. jev-1.13.0 같은 버전 ID는 목록에 표시되지 않아도 model 필드에서 사용할 수 있습니다.
데이터 처리 및 맞춤 설정
Jev은 고객 데이터로 미세 조정하거나 LoRA를 적용하지 않습니다. 고객의 요청이나 응답으로 학습하지도 않습니다. 모든 계정에 동일한 RLCD 가중치가 제공됩니다. state 콘텐츠, 지시, 기준과 코드 조합을 통해 용도에 특화할 수 있습니다. TypeSafe의 법률 문서 색인에는 DPA, 개인정보 처리방침, 엔터프라이즈 고객용 데이터 무보존 정책이 포함됩니다.
종단 간 응답 시간은 70ms-500ms이며 대부분의 쿼리는 약 100ms라고 명시되어 있습니다. 이 범위는 출시 자료에 공개된 주장이지, 이 위키에서 자체 측정한 지연 시간 SLO가 아닙니다. 호출 제한 안내도 함께 확인하세요. TypeSafe이 얼리 액세스를 확장하는 동안 처리량과 RPM은 바뀔 수 있습니다.
운영 환경에서 보낼 이름
지난주에 조정한 게이트가 다음 주에도 같은 의미를 유지해야 한다면 jev-1.13.0을 보내세요. TypeSafe의 현재 공식 릴리스를 사용하고 별칭이 이동할 때마다 confidence 히스토그램을 다시 검토할 계획이라면 jev-latest을 보내세요. 비공식 빌드도 받아들일 준비가 된 경우에만 jev-preview을 보내세요. 현재는 jev-latest과 같은 대상을 가리킵니다.
모든 호출에서 response.model을 기록하세요. 별칭을 보냈더라도 이 필드에는 실제로 답변한 버전 ID가 들어갑니다. 429 오류나 예상 밖의 Noul을 디버깅할 때 requestId와 연결하세요. 엔드포인트가 jev-1.13.0을 허용하더라도 GET /v1/models에는 항상 표시되지는 않습니다.
입력 비용만 계산하세요. 출력 토큰은 무료이므로 완료 토큰에도 요금이 붙는 채팅 모델보다 fan-out이 저렴합니다. $0.042/MTok으로 초당 10회 질의하는 Doom 방식의 루프는 출시 당시 이 비용 구조를 보여 준 예시입니다. 그래도 1,200 RPM과 초당 250,000 토큰 제한을 지켜야 하며, 얼리 액세스 기간에는 이 수치가 예고 없이 변경될 수 있습니다.
영업팀이 맞춤형 한도를 제시하더라도 TypeSafe이 docs.typesafe.ai/models에 게시하기 전까지는 이 카드에 반영되지 않습니다. 그때까지 공개 수치는 초당 250,000토큰과 분당 1,200개 요청이며, 예고 없이 바뀔 수 있다는 명시적 경고가 붙습니다. 엔터프라이즈 데이터 무보존은 법률 문서 색인의 주제이지 모델 카드에서 켜고 끄는 옵션이 아닙니다.
이 카드에서 가장 강력한 언어는 여전히 영어입니다. CJK 티켓을 처리한다면 confidence 게이트를 더 엄격하게 유지하고 사람을 제외하기 전에 자체 대기열을 표본 검사하세요. 모델은 해당 문자를 입력으로 받습니다. 정확도 안내는 측정이 필요한 이유이지 숨겨진 403 오류를 뜻하지 않습니다.
별칭 이동은 릴리스 이벤트입니다. TypeSafe이 새 버전 ID를 출시하면 모델 페이지를 다시 읽고 게이트가 여전히 유효한지 판단하세요. 이 페이지의 카드는 Jev 1.13에 관한 것이며 1.14를 보장하지 않습니다.
이 카드에서는 출력 토큰이 계속 무료입니다. 따라서 질문을 추가로 묶는 편이 두 번째 생성 호출보다 대체로 저렴합니다.
출처