Riset RekapCAT10 September 20269 menit baca

Seberapa representatif rekap nilai berbasis komunitas?

Temuan utama

Rekap mandiri menggambarkan bentuk distribusi resmi dengan cukup baik, tetapi posisinya bergeser ke atas: rata-rata 26,6 poin lebih tinggi (d = 0,40).

Dataset
Rekap Resmi & Rekap Mandiri Tendik 2026
Snapshot data
10 September 2026 · metodologi v1.0
Bagikan:WhatsAppTelegramXFacebookRSS

Pertanyaan penelitian

Rekap nilai berbasis komunitas selalu menghadapi satu keberatan yang sama: yang mengisi hanya sebagian peserta, jadi apakah angkanya bisa dipercaya? Selama ini keberatan itu hanya bisa dijawab dengan dugaan, karena tidak ada pembanding.

Pada PPPK Tendik Sekolah Rakyat 2026 pembandingnya akhirnya ada. RekapCAT menyimpan dua himpunan data untuk event yang sama: nilai yang diinput peserta sendiri sebelum pengumuman, dan nilai resmi seluruh peserta setelah pengumuman terbit. Riset ini menguji satu pertanyaan spesifik: seberapa jauh distribusi rekap mandiri menyimpang dari distribusi resmi?

Dataset

Nilai resmi dianalisis
89.407

peserta yang hadir CAT

Nilai mandiri dianalisis
10.573

entri berskor valid

Cakupan rekap mandiri
11.83%

dari peserta hadir

Snapshot data
10 September 2026

Dari 102.860 baris resmi, 13.453 bernilai nol dan seluruhnya berstatus TH (tidak hadir). Baris itu dikeluarkan karena nol di sana berarti "tidak mengikuti ujian", bukan "mendapat nilai nol". Dari 17.662 baris mandiri, 7.086 belum berisi nilai (peserta baru mengklaim entrinya) dan 3 baris melampaui plafon 670 sehingga jelas salah input. Semuanya juga dikeluarkan.

Data sumber

Angka resmi berasal dari pengumuman hasil seleksi kompetensi instansi yang dihimpun dan distrukturkan RekapCAT. Daftar dokumen sumber ada pada halaman Sumber Data event ini. RekapCAT bukan penyelenggara seleksi dan bukan sumber resmi.

Metodologi

  • Unit analisis: satu baris nilai per peserta per sumber data.
  • Variabel: nilai total CAT mentah (skala maksimum 670).
  • Eksklusi: nilai nol pada kedua sumber, dan nilai di atas 670 pada rekap mandiri.
  • Statistik: mean, median, simpangan baku, sembilan persentil, dan distribusi kumulatif pada grid 10 poin.
  • Ukuran perbedaan: selisih rata-rata terstandar (Cohen's d) dengan simpangan baku gabungan, serta jarak kumulatif maksimum antar-dua distribusi (statistik gaya Kolmogorov–Smirnov) pada grid tersebut.
Catatan metodologi

Fokus riset ini adalah besar perbedaan, bukan signifikansi statistik. Dengan N hampir 90 ribu, hampir semua selisih akan "signifikan" — yang berguna bagi pembaca adalah seberapa besar pergeserannya dalam satuan nilai CAT.

Temuan 1 — pusat distribusi bergeser ke atas

Statistik ringkas dua sumber data, PPPK Tendik SR 2026
StatistikRekap ResmiRekap MandiriSelisih
N89.40710.573
Rata-rata451,63478,22+26,59
Median460486+26
Simpangan baku66,6958,91-7,78
Persentil 10359400+41
Persentil 25409446+37
Persentil 75501519+18
Persentil 90531546+15
Persentil 99574582+8

Pergeseran terjadi di seluruh badan distribusi, bukan hanya di ujung. Selisihnya paling lebar di bawah — persentil 10 berbeda 41 poin — dan menyempit di atas — persentil 99 hanya berbeda 8 poin. Artinya yang paling jarang muncul di rekap mandiri adalah peserta bernilai rendah, sedangkan peserta bernilai sangat tinggi hampir sama terwakilinya.

Perhitungan RekapCAT

Selisih rata-rata terstandar: d = 0.4 (simpangan baku gabungan 65.91). Menurut konvensi umum, ini termasuk perbedaan kecil-menengah — nyata, tetapi jauh dari "dua populasi yang berbeda".

Temuan 2 — bentuk distribusi tetap serupa

Distribusi kumulatif nilai: resmi vs mandiri
Rekap ResmiRekap Mandiri
0%25%50%75%100%250340430490550610

Sumbu X: nilai total CAT. Sumbu Y: persen peserta dengan nilai ≤ x.

Kedua kurva memiliki bentuk sigmoid yang sama dan tidak pernah berpotongan setelah nilai 220: kurva mandiri selalu berada di kanan. Jarak vertikal terbesarnya 17.3 poin persen, terjadi di sekitar nilai 470. Dengan kata lain, rekap mandiri bukan distribusi yang "acak-acakan" — ia adalah distribusi resmi yang digeser ke kanan.

Sebaran nilai per rentang (persentase dalam masing-masing sumber)
Rekap ResmiRekap Mandiri
< 3508,18%2,97%350–39913,19%7,03%400–44922,87%17%450–49929,9%33,16%500–52412,94%18,17%525–5498,39%13,15%550–5743,6%6,68%575–5990,87%1,48%≥ 6000,06%0,37%
Jumlah dan persentase peserta per rentang nilai
RentangResmi% ResmiMandiri% Mandiri
< 3507.3108.18%3142.97%
350–39911.79613.19%7437.03%
400–44920.44522.87%1.79717.00%
450–49926.73529.90%3.50633.16%
500–52411.56612.94%1.92118.17%
525–5497.4988.39%1.39013.15%
550–5743.2213.60%7066.68%
575–5997820.87%1571.48%
≥ 600540.06%390.37%

Rentang di bawah 400 mencakup 21.37% peserta pada data resmi, tetapi hanya 10.00% pada rekap mandiri — kurang dari separuhnya. Sebaliknya, rentang 500 ke atas mengisi 25.86% data resmi tetapi 39.85% data mandiri.

Temuan 3 — nilai yang diinput peserta sendiri akurat

Pertanyaan berbeda dari representativitas: ketika peserta yang sama muncul di kedua sumber, apakah angka yang ia ketik sendiri cocok dengan angka resmi?

Peserta ada di dua sumber
17.424
Punya nilai di keduanya
10.415
Nilai persis sama
97.73%
Selisih absolut median
0 poin

Dari 10.415 peserta yang punya nilai di kedua sumber, 10.179 (97.73%) mengetik angka yang persis sama dengan pengumuman resmi. Ini temuan penting dan agak berlawanan dengan dugaan umum: masalah rekap komunitas bukan peserta yang membesarkan nilai, melainkan peserta yang tidak mengisi sama sekali.

Keterbatasan

Sisa selisih didominasi kasus peserta mengisi entri jauh sebelum nilai final terbit atau salah ketik satu digit, bukan pola pembesaran sistematis — hanya 148 peserta yang nilai mandirinya lebih tinggi dari nilai resmi.

Interpretasi

Interpretasi

Rekap mandiri PPPK Tendik SR 2026 layak dipakai untuk membaca bentuk persaingan — urutan rentang nilai, posisi relatif antar-peserta, dan sebaran umum tetap terjaga. Yang tidak boleh dilakukan adalah membaca angka absolut rekap mandiri sebagai perkiraan populasi: batas nilai yang terlihat pada rekap mandiri kira-kira 25–30 poin lebih tinggi daripada batas yang sesungguhnya berlaku di seluruh peserta.

Konsekuensi praktisnya sederhana. Peserta yang membandingkan dirinya dengan rekap mandiri cenderung merasa posisinya lebih lemah dari kenyataan. Peserta yang berada di persentil 50 rekap mandiri kira-kira setara persentil 65–70 populasi resmi.

Keterbatasan

Keterbatasan
  • Hasil ini berlaku untuk satu event. Event lain dengan pola partisipasi berbeda dapat memberi angka berbeda.
  • Rekap mandiri berstatus pending pada mayoritas entri (17.568 dari 17.662); moderasi manual tidak mencakup seluruh baris.
  • Pencocokan antar-sumber memakai identitas peserta internal, bukan identitas pribadi. Peserta yang salah mengetik nomor tidak tercocokkan dan tidak masuk analisis Temuan 3.
  • Statistik jarak kumulatif dihitung pada grid 10 poin, sehingga nilainya perkiraan bawah dari jarak sebenarnya.

Provenans. Seluruh angka pada halaman ini dihitung dari data yang tersimpan di RekapCAT pada 10 September 2026 dan disimpan sebagai snapshot agregat, tanpa data pribadi peserta. RekapCAT bukan penyelenggara seleksi dan bukan sumber resmi; metrik turunan RekapCAT tidak menggantikan keputusan instansi. Metode lengkap ada pada Metodologi dan Metodologi Statistik.

Bagikan:WhatsAppTelegramXFacebookRSS

Bacaan terkait