Jaggedness Jev 1.13
Saring mode kegagalan Jev 1.13 sebelum merilis pertanyaan.
Cari
Keluarga
9 mode kegagalan
Pembacaan harfiah
Tuliskan kondisi yang tepat dalam instruksi dan kriteria.
Matematika dan angka
Lakukan aritmetika dan penghitungan dalam kode.
Perbandingan tanggal dan waktu
Ekstrak komponennya dengan Choice; bandingkan dalam kode.
Indireksi
Kurangi rantai rujukan; sebutkan keadaan yang relevan.
Keadaan besar yang dipenuhi detail tak relevan
Saring terlebih dahulu; kirim hanya yang diperlukan pertanyaan.
Konten adversarial
Tulis kriteria yang presisi dan uji kasus batas.
Instruksi dan kriteria yang bertentangan
Selaraskan kriteria dengan instruksi.
Invarian struktural yang dianggap masuk akal
Jangan mengasumsikan identitas Noul dan Choice.
Pembuatan teks
Gunakan model generatif; jangan rangkai Choice untuk menulis teks.
Tidak ada mode kegagalan yang cocok.
Jev 1.13 cepat, terkalibrasi, dan unggul dalam penilaian berdasarkan akal sehat, tetapi tidak sempurna. TypeSafe mendokumentasikan sembilan mode kegagalan untuk jev-1.13, terakhir ditinjau pada 17 September 2026. Model ini dapat menafsirkan secara harfiah, lemah dalam presisi numerik, dan tidak andal jika harus melewati beberapa lapis rujukan. Saring daftar berdasarkan nama atau alternatif yang disarankan, lalu jauhkan aritmetika, tanggal, dan pembuatan teks dari pertanyaan yang dikirim.
Cara menggunakan daftar ini
Pencarian mencocokkan nama mode dan teks alternatif. Family adalah jev-1.13-failure-mode untuk setiap baris; appliesTo adalah jev-1.13. Kosongkan pencarian untuk kembali ke seluruh sembilan mode. TypeSafe menyatakan banyak kelemahan ini akan diperbaiki pada versi berikutnya. Untuk saat ini, perlakukan kolom alternatif sebagai kontrak bagi pertanyaan produksi.
Pembacaan harfiah: Jev menjawab pertanyaan yang Anda tulis, bukan yang Anda maksud. Kata pembatas cakupan, negasi, dan kondisi tersirat dibaca apa adanya. Ketika Anda harus menjelaskan maksud sebenarnya, masukkan penjelasan itu ke dalam instruksi dan kriteria. Pecah penafsiran yang tidak terhindarkan menjadi dua pertanyaan harfiah, lalu gabungkan hasilnya melalui kode.
Matematika dan angka: Jev bukan kalkulator. Penghitungan karakter, kemunculan istilah, atau daftar panjang tidak andal dan makin buruk seiring membesarnya himpunan. Warna heksadesimal dan pengodean tingkat rendah memberikan hasil di bawah nama berbahasa Inggris. Jangan merekonstruksi besaran pasti dengan menginterpolasi tingkat Score. Kerjakan aritmetika dalam kode; telusuri kandidat dan ajukan satu pertanyaan semantik untuk masing-masing, lalu jumlahkan sendiri.
Tanggal, lapisan rujukan, status, dan pembuatan teks
Perbandingan tanggal dan waktu: Jev membaca tanggal sebagai teks, bukan besaran berurutan. Tanggal mana yang lebih dahulu, jarak antar-tanggal, atau apakah suatu tanggal masuk dalam rentang tertentu tidak dapat diandalkan, terutama jika format dan kuartalnya beragam. Ekstrak bulan, hari, dan tahun dengan Choice — termasuk opsi tidak disebutkan — lalu susun dan bandingkan melalui kode.
Indireksi: negasi ganda dan pertanyaan tentang properti dari suatu properti mengurangi akurasi. Kurangi rantai rujukan dan sebutkan keadaan yang relevan. Keadaan besar yang dipenuhi detail tak relevan menjadi pengalih perhatian; saring terlebih dahulu. Konten adversarial dalam keadaan dapat mengarahkan jawaban karena keadaan adalah data, bukan pengguna tepercaya. Tulis kriteria yang presisi dan uji kasus batas. Instruksi dan kriteria yang bertentangan membingungkan model; selaraskan keduanya dan jangan petakan benar menjadi tidak.
Invarian struktural yang dianggap masuk akal tidak dijamin. Noul dan Choice untuk pertanyaan pengembalian dana yang sama dapat berbeda pendapat, dan jumlah suatu Noul beserta negasinya tidak harus satu. Ajukan setiap keputusan dengan satu cara saja. Pembuatan teks berada di luar cakupan: merangkai Choice untuk menulis teks itu lambat dan hasilnya buruk. Gunakan model generatif atau regex untuk mengusulkan opsi, lalu biarkan Jev memilih.
Sebelum menerapkan pertanyaan
Baca instruksinya dengan lantang. Jika Anda perlu kalimat tambahan untuk menjelaskannya kepada rekan kerja, masukkan kalimat itu ke dalam instruksi. Cantumkan kasus batas dalam kriteria, termasuk opsi tidak ada/tidak disebutkan secara eksplisit pada Choice yang mengekstrak tanggal atau enum.
Cari kata kerja yang Anda gunakan dalam daftar ini: menghitung, membandingkan, membuat, merujuk berantai, menumpahkan data. Matematika dan angka, perbandingan tanggal dan waktu, pembuatan teks, indireksi, serta keadaan besar adalah masalah yang paling umum. Konten adversarial perlu diperhatikan jika keadaan memuat teks pengguna tak tepercaya yang berusaha membenarkan labelnya sendiri.
Pertahankan kesembilan catatan dalam fixture pengujian Anda. Pengujian unit yang hanya memeriksa kasus normal Choice akan melewatkan perbedaan hasil antara Noul dan Choice. TypeSafe terakhir meninjau katalog ini pada 17 September 2026; versi Jev berikutnya mungkin memperpendek daftar ini, tetapi jev-1.13.0 masih memuat kesembilannya.
Tampilkan daftar sembilan baris ini di samping peninjauan prompt Anda. Filter di halaman menggunakan daftar yang sama: cari nama atau baris alternatifnya, lalu pertahankan famili jev-1.13-failure-mode. Jika kegagalan produksi tidak termasuk dalam kesembilan ini, itu tetap kegagalan, tetapi bukan sisi rawan jev-1.13 yang terdokumentasi.
Pembacaan harfiah adalah kegagalan yang pertama kali akan Anda lihat: model melakukan tepat seperti yang Anda tulis. Matematika gagal ketika seseorang memintanya menghitung. Pembuatan teks gagal ketika seseorang merangkai Choice untuk menulis prosa. Enam mode lainnya biasanya ditemukan setelah minggu pertama di produksi.
Saat terjadi kegagalan, tentukan modenya sebelum menulis ulang prompt. Jika Anda tidak dapat menentukannya, mungkin Anda menemukan sisi rawan baru, atau keadaan masih mencampurkan kebijakan dan tiket dalam satu string.
Tag famili pada setiap baris adalah jev-1.13-failure-mode. Nilai appliesTo adalah jev-1.13. Keduanya merupakan filter, bukan mode tambahan.
Sumber