Seberapa representatif rekap nilai berbasis komunitas?
Rekap mandiri menggambarkan bentuk distribusi resmi dengan cukup baik, tetapi posisinya bergeser ke atas: rata-rata 26,6 poin lebih tinggi (d = 0,40).
- Dataset
- Rekap Resmi & Rekap Mandiri Tendik 2026
- Snapshot data
- 10 September 2026 · metodologi v1.0
Pertanyaan penelitian
Rekap nilai berbasis komunitas selalu menghadapi satu keberatan yang sama: yang mengisi hanya sebagian peserta, jadi apakah angkanya bisa dipercaya? Selama ini keberatan itu hanya bisa dijawab dengan dugaan, karena tidak ada pembanding.
Pada PPPK Tendik Sekolah Rakyat 2026 pembandingnya akhirnya ada. RekapCAT menyimpan dua himpunan data untuk event yang sama: nilai yang diinput peserta sendiri sebelum pengumuman, dan nilai resmi seluruh peserta setelah pengumuman terbit. Riset ini menguji satu pertanyaan spesifik: seberapa jauh distribusi rekap mandiri menyimpang dari distribusi resmi?
Dataset
- Nilai resmi dianalisis
- 89.407
- Nilai mandiri dianalisis
- 10.573
- Cakupan rekap mandiri
- 11.83%
- Snapshot data
- 10 September 2026
peserta yang hadir CAT
entri berskor valid
dari peserta hadir
Dari 102.860 baris resmi, 13.453 bernilai nol dan seluruhnya berstatus TH (tidak hadir). Baris itu dikeluarkan karena nol di sana berarti "tidak mengikuti ujian", bukan "mendapat nilai nol". Dari 17.662 baris mandiri, 7.086 belum berisi nilai (peserta baru mengklaim entrinya) dan 3 baris melampaui plafon 670 sehingga jelas salah input. Semuanya juga dikeluarkan.
Angka resmi berasal dari pengumuman hasil seleksi kompetensi instansi yang dihimpun dan distrukturkan RekapCAT. Daftar dokumen sumber ada pada halaman Sumber Data event ini. RekapCAT bukan penyelenggara seleksi dan bukan sumber resmi.
Metodologi
- Unit analisis: satu baris nilai per peserta per sumber data.
- Variabel: nilai total CAT mentah (skala maksimum 670).
- Eksklusi: nilai nol pada kedua sumber, dan nilai di atas 670 pada rekap mandiri.
- Statistik: mean, median, simpangan baku, sembilan persentil, dan distribusi kumulatif pada grid 10 poin.
- Ukuran perbedaan: selisih rata-rata terstandar (Cohen's d) dengan simpangan baku gabungan, serta jarak kumulatif maksimum antar-dua distribusi (statistik gaya Kolmogorov–Smirnov) pada grid tersebut.
Fokus riset ini adalah besar perbedaan, bukan signifikansi statistik. Dengan N hampir 90 ribu, hampir semua selisih akan "signifikan" — yang berguna bagi pembaca adalah seberapa besar pergeserannya dalam satuan nilai CAT.
Temuan 1 — pusat distribusi bergeser ke atas
| Statistik | Rekap Resmi | Rekap Mandiri | Selisih |
|---|---|---|---|
| N | 89.407 | 10.573 | — |
| Rata-rata | 451,63 | 478,22 | +26,59 |
| Median | 460 | 486 | +26 |
| Simpangan baku | 66,69 | 58,91 | -7,78 |
| Persentil 10 | 359 | 400 | +41 |
| Persentil 25 | 409 | 446 | +37 |
| Persentil 75 | 501 | 519 | +18 |
| Persentil 90 | 531 | 546 | +15 |
| Persentil 99 | 574 | 582 | +8 |
Pergeseran terjadi di seluruh badan distribusi, bukan hanya di ujung. Selisihnya paling lebar di bawah — persentil 10 berbeda 41 poin — dan menyempit di atas — persentil 99 hanya berbeda 8 poin. Artinya yang paling jarang muncul di rekap mandiri adalah peserta bernilai rendah, sedangkan peserta bernilai sangat tinggi hampir sama terwakilinya.
Selisih rata-rata terstandar: d = 0.4 (simpangan baku gabungan 65.91). Menurut konvensi umum, ini termasuk perbedaan kecil-menengah — nyata, tetapi jauh dari "dua populasi yang berbeda".
Temuan 2 — bentuk distribusi tetap serupa
Sumbu X: nilai total CAT. Sumbu Y: persen peserta dengan nilai ≤ x.
Kedua kurva memiliki bentuk sigmoid yang sama dan tidak pernah berpotongan setelah nilai 220: kurva mandiri selalu berada di kanan. Jarak vertikal terbesarnya 17.3 poin persen, terjadi di sekitar nilai 470. Dengan kata lain, rekap mandiri bukan distribusi yang "acak-acakan" — ia adalah distribusi resmi yang digeser ke kanan.
| Rentang | Resmi | % Resmi | Mandiri | % Mandiri |
|---|---|---|---|---|
| < 350 | 7.310 | 8.18% | 314 | 2.97% |
| 350–399 | 11.796 | 13.19% | 743 | 7.03% |
| 400–449 | 20.445 | 22.87% | 1.797 | 17.00% |
| 450–499 | 26.735 | 29.90% | 3.506 | 33.16% |
| 500–524 | 11.566 | 12.94% | 1.921 | 18.17% |
| 525–549 | 7.498 | 8.39% | 1.390 | 13.15% |
| 550–574 | 3.221 | 3.60% | 706 | 6.68% |
| 575–599 | 782 | 0.87% | 157 | 1.48% |
| ≥ 600 | 54 | 0.06% | 39 | 0.37% |
Rentang di bawah 400 mencakup 21.37% peserta pada data resmi, tetapi hanya 10.00% pada rekap mandiri — kurang dari separuhnya. Sebaliknya, rentang 500 ke atas mengisi 25.86% data resmi tetapi 39.85% data mandiri.
Temuan 3 — nilai yang diinput peserta sendiri akurat
Pertanyaan berbeda dari representativitas: ketika peserta yang sama muncul di kedua sumber, apakah angka yang ia ketik sendiri cocok dengan angka resmi?
- Peserta ada di dua sumber
- 17.424
- Punya nilai di keduanya
- 10.415
- Nilai persis sama
- 97.73%
- Selisih absolut median
- 0 poin
Dari 10.415 peserta yang punya nilai di kedua sumber, 10.179 (97.73%) mengetik angka yang persis sama dengan pengumuman resmi. Ini temuan penting dan agak berlawanan dengan dugaan umum: masalah rekap komunitas bukan peserta yang membesarkan nilai, melainkan peserta yang tidak mengisi sama sekali.
Sisa selisih didominasi kasus peserta mengisi entri jauh sebelum nilai final terbit atau salah ketik satu digit, bukan pola pembesaran sistematis — hanya 148 peserta yang nilai mandirinya lebih tinggi dari nilai resmi.
Interpretasi
Rekap mandiri PPPK Tendik SR 2026 layak dipakai untuk membaca bentuk persaingan — urutan rentang nilai, posisi relatif antar-peserta, dan sebaran umum tetap terjaga. Yang tidak boleh dilakukan adalah membaca angka absolut rekap mandiri sebagai perkiraan populasi: batas nilai yang terlihat pada rekap mandiri kira-kira 25–30 poin lebih tinggi daripada batas yang sesungguhnya berlaku di seluruh peserta.
Konsekuensi praktisnya sederhana. Peserta yang membandingkan dirinya dengan rekap mandiri cenderung merasa posisinya lebih lemah dari kenyataan. Peserta yang berada di persentil 50 rekap mandiri kira-kira setara persentil 65–70 populasi resmi.
Keterbatasan
- Hasil ini berlaku untuk satu event. Event lain dengan pola partisipasi berbeda dapat memberi angka berbeda.
- Rekap mandiri berstatus pending pada mayoritas entri (17.568 dari 17.662); moderasi manual tidak mencakup seluruh baris.
- Pencocokan antar-sumber memakai identitas peserta internal, bukan identitas pribadi. Peserta yang salah mengetik nomor tidak tercocokkan dan tidak masuk analisis Temuan 3.
- Statistik jarak kumulatif dihitung pada grid 10 poin, sehingga nilainya perkiraan bawah dari jarak sebenarnya.
Provenans. Seluruh angka pada halaman ini dihitung dari data yang tersimpan di RekapCAT pada 10 September 2026 dan disimpan sebagai snapshot agregat, tanpa data pribadi peserta. RekapCAT bukan penyelenggara seleksi dan bukan sumber resmi; metrik turunan RekapCAT tidak menggantikan keputusan instansi. Metode lengkap ada pada Metodologi dan Metodologi Statistik.
Bacaan terkait
- RisetSiapa yang membagikan nilai CAT-nya?Kecenderungan membagikan nilai naik konsisten seiring nilai resmi: 4,39% pada persentil 0–10 hingga 18,54% pada persentil 90–100.
- AnalisisMengapa data PPPK Tendik SR 2025 dan 2026 tidak bisa dibandingkan langsungVerdict: tidak dapat dibandingkan secara langsung — arsip 2025 memuat empat skala nilai maksimum berbeda dan struktur kelompok yang tidak sepadan dengan 2026.
- RisetDistribusi nilai resmi PPPK Tendik Sekolah Rakyat 2026Setengah peserta yang hadir berada di rentang 409–501; hanya 25,9% mencapai 500 dan 4,5% mencapai 550.
