jsonl-bench
LLM çağının veri türleri (ajan transkriptleri, API logları) için araçtan bağımsız bir sıkıştırma benchmark’ı. Sıralama ölçütü: korpus genelinde toplam sıkıştırılmış boyut. Kayıpsızlık için bayt-birebir roundtrip zorunludur.
GitHub’da kaynak koduProje Hakkında
Sıkıştırma araçlarını karşılaştırmanın en adil yolu, herkesin aynı veriyle ve aynı kuralla ölçüm yapmasıdır. jsonl-bench, LLM çağının verisi (ajan transkriptleri, API logları) üzerinde araçtan bağımsız, tekrarlanabilir bir sıralama sağlar: kazanan, korpusun tamamında en küçük toplam çıktıyı üreten araçtır — ve her aracın çıktısı bozulmadan geri açılabilmelidir.
Korpus repoda tutulmaz; sabit tohumlardan yerelde yeniden üretilir, böylece sonuçlar herkeste birebir aynıdır. Not: bu korpus sentetiktir; mutlak oranlar gerçek veriye genellenmez — dürüstlük açısından bu açıkça belirtilir.
Nasıl Çalışır
Araçtan bağımsız
Herhangi bir sıkıştırma aracı (kütüphane veya CLI) tek bir listeye eklenerek yarışa dahil edilebilir; benchmark belirli bir araca bağlı değildir.
Tek ölçüt: toplam boyut
Sıralama, korpus genelinde toplam sıkıştırılmış boyuta göre yapılır. Bayt-birebir roundtrip (kayıpsızlık) zorunludur.
Deterministik korpus
Korpus repoda saklanmaz; sabit tohumlardan yerelde yeniden üretilir (SHA256SUMS ile doğrulanır). Böylece herkes aynı veriyle ölçüm yapar.
PR ile araç ekleme
Yeni bir araç, run_bench.py içindeki TOOLS listesine bir komut/çağrı ekleyen tek bir PR ile katılır. Araç herkesçe kurulabilir olmalıdır.
Kullanılan Teknolojiler
Kod tamamen açık
jsonl-bench açık kaynak olarak GitHub’da yayımlanmıştır. Kuralları inceleyebilir, kendi aracınızı bir PR ile ekleyebilir ve sonuçları yerelde yeniden üretebilirsiniz.