Fiche Jev 1.13

Fiche active du modèle, alias, tarifs et limites.

Le modèle actif est Jev 1.13, avec l’identifiant versionné jev-1.13.0. Tous les modèles figurant sur la fiche de TypeSafe sont servis par POST /v1/systemone ; le champ model de la requête sélectionne le nom qui traitera l’appel. jev-latest est la valeur par défaut du SDK et correspond actuellement à jev-1.13.0. jev-preview pointe actuellement vers le même identifiant ; TypeSafe indique qu’aucune version préliminaire n’est disponible. Fixez l’identifiant versionné si vos seuils ont été réglés à partir de cette fiche.

Tarifs, contexte et limites de débit

L'entrée coûte $42 par milliard de jetons, soit $0.042 par million. Les jetons de sortie sont gratuits. Une requête dépassant la limite documentée de 250,000 jetons par seconde ou de 1,200 requêtes par minute renvoie 429 Trop de requêtes. Les SDK officiels réessaient avec un délai croissant et respectent retry-after lorsqu'il est présent. TypeSafe prévient que les limites s'ajustent dynamiquement tant que la demande reste forte et que les accords sur les GPU se concrétisent, et qu'elles peuvent changer sans préavis. Les offres personnalisées et d'entreprise permettent de relever le plafond via sales@typesafe.ai.

La fenêtre de contexte est de 64k tokens par requête. Un second budget de 32k tokens s’applique à l’état cumulé avec la question la plus longue. Jev ingère l’état une seule fois et évalue toutes les questions en parallèle par rapport à celui-ci ; la fenêtre de 64k couvre donc l’état et l’ensemble des questions. Lorsque l’état s’enrichit de détails sans rapport, la précision diminue — ce mode d’échec figure sur la page jaggedness. Regroupez de nombreuses petites questions avec speculative fan-out au lieu d’entasser tout l’entrepôt dans un seul champ.

Seul le texte est accepté en entrée : une chaîne, un objet JSON ou un tableau de valeurs textuelles. Aucune image ni entrée audio ou vidéo. Convertissez les contenus non textuels en champs avant l’appel. L’anglais est la principale langue d’entraînement. Les autres langues, dont les langues CJK, sont traitées avec une précision moindre ; mesurez donc la confiance avant d’automatiser une file non anglophone.

Jev 1.13 model card: price, rate limits, context, text-only input
Fiche du modèle Jev 1.13 : tarif, limites de débit, contexte, entrée text-only.

Jev 1.13

Identifiant du modèle
jev-1.13.0
role
versioned-id
Prix par million de tokens d’entrée (USD)
0.042
sortie facturée
false
jetons par seconde
250000
requêtes par minute
1200
jetons de contexte
64000
Jetons de l’état plus ceux de la question la plus longue
32000
input
text-only

jev-latest

Identifiant du modèle
jev-latest
role
stable-alias
pointe vers
jev-1.13.0
Valeur par défaut du SDK
true

jev-preview

Identifiant du modèle
jev-preview
role
preview-alias
pointe vers
jev-1.13.0
Version préliminaire disponible
false

Alias et liste des modèles

Un alias est un nom de modèle qui correspond à un identifiant versionné. Envoyez-le dans le champ model comme n’importe quel autre nom. jev-latest désigne la dernière version officielle stable. jev-preview désigne la version la plus récente, officielle ou non, et prend de l’avance sur jev-latest lorsqu’une version préliminaire existe. Pour le moment, les deux noms pointent vers jev-1.13.0.

Un alias change lorsqu’une nouvelle version paraît ; les réponses qu’il produit peuvent donc évoluer sans modification de votre code. Le champ model de la réponse indique l’identifiant versionné qui a répondu. Consignez cet identifiant. Si les seuils de confiance ont été réglés sur jev-1.13.0, continuez d’envoyer jev-1.13.0 jusqu’à leur prochain réglage.

GET /v1/models renvoie les noms que votre compte peut envoyer, avec leur description et leur date de sortie. Il répertorie actuellement les alias. Les identifiants versionnés comme jev-1.13.0 sont acceptés dans le champ model, qu’ils figurent ou non dans cette liste.

Traitement et personnalisation des données

Jev n’est ni affiné ni adapté par LoRA avec les données des clients. Il n’est pas entraîné sur leurs requêtes ou leurs réponses. Les mêmes poids de RLCD servent tous les comptes. Vous le spécialisez au moyen du contenu de l’état, des instructions, des critères et de la composition dans le code. L’index juridique de TypeSafe couvre l’accord de traitement des données, la politique de confidentialité et l’absence de conservation des données des entreprises clientes.

Le temps de réponse de bout en bout annoncé est de 70ms-500ms, la plupart des requêtes prenant environ 100ms. Cette plage est une affirmation publiée dans les documents de lancement, pas un objectif de latence fondé sur les propres mesures de ce wiki. À rapprocher de la remarque sur les limites de débit : le débit et les requêtes par minute peuvent évoluer pendant que TypeSafe étend son accès anticipé.

Quel nom envoyer en production

Envoyez jev-1.13.0 lorsque les seuils réglés la semaine dernière doivent conserver le même sens la semaine suivante. Envoyez jev-latest pour utiliser la version officielle actuelle de TypeSafe, si vous comptez réexaminer les histogrammes de confiance après chaque changement d’alias. N’envoyez jev-preview que si vous acceptez une version non officielle ; aujourd’hui, il pointe vers la même cible que jev-latest.

Consignez response.model à chaque appel. Ce champ contient l’identifiant versionné qui a réellement répondu, même si vous avez envoyé un alias. Associez-le à requestId lorsque vous analysez une erreur 429 ou un résultat Noul surprenant. GET /v1/models ne répertorie pas toujours jev-1.13.0, même si le point de terminaison l’accepte.

Ne facturez que l’entrée. Les tokens de sortie sont gratuits ; fan-out coûte donc peu par rapport à un modèle conversationnel qui facture la complétion. Une boucle de type Doom à 10 requêtes/seconde et $0.042/MTok illustre ce modèle économique lors du lancement. Respectez néanmoins les limites de 1,200 RPM et de 250,000 tokens par seconde, et attendez-vous à ce que ces valeurs changent sans préavis pendant l’accès anticipé.

Lorsqu’un commercial annonce une limite personnalisée, elle ne figure pas sur cette fiche tant que TypeSafe ne la publie pas sur docs.typesafe.ai/models. D’ici là, les valeurs publiques restent 250,000 jetons par seconde et 1,200 requêtes par minute, avec l’avertissement explicite qu’elles peuvent changer sans préavis. L’absence de conservation des données d’entreprise relève de l’index juridique, pas d’une option de la fiche du modèle.

L’anglais reste la langue la mieux prise en charge sur cette fiche. Si vous traitez des tickets en langues CJK, appliquez des seuils de confiance plus stricts et échantillonnez votre propre file avant de retirer les humains du processus. Le modèle acceptera les caractères ; la note sur la précision justifie cette mesure, elle ne signale pas une erreur 403 cachée.

Le changement d’un alias constitue un événement de publication. Relisez la page des modèles lorsque TypeSafe publie un nouvel identifiant versionné, puis vérifiez si vos seuils restent valables. La fiche de cette page concerne Jev 1.13 et ne constitue pas une promesse pour 1.14.

Les jetons de sortie restent gratuits sur cette fiche. C’est pourquoi ajouter des questions à un même lot revient généralement moins cher qu’un second appel génératif.

Sources