Program studi
Empat program studi yang menata tingkatan bukti platform: cakupan, keluarga tolok ukur, jajaran solver, metodologi, dan status gerbang klaim.
Bukti platform ditata sebagai empat program studi, satu untuk setiap tingkatan bukti: inti, kecepatan, kualitas, dan platform. Tingkatan-tingkatan itu bersarang: program inti menerima bukti inti dan publik; program kecepatan menambahkan bukti kecepatan; program kualitas menambahkan bukti kualitas; dan program platform menyajikan seluruh bidang publik. Setiap program membatasi dengan tepat apa yang boleh diungkapkan tingkatan buktinya, sehingga program tingkatan lebih rendah tidak pernah mengungkap mekanisme tingkatan lebih tinggi.
Etalase di bawah membaca setiap jajaran, keluarga tolok ukur, kohort perbandingan, rincian metodologi, dan status gerbang klaim dari bundel program yang telah dikomit, sehingga angka-angka tetap mutakhir seiring platform berkembang tanpa teks yang disunting secara manual. Tidak ada klaim perbandingan yang dipublikasikan sampai gerbang sebuah program terbuka; ekspor yang dipublikasikan hari ini hanya membawa bukti pengembangan asap.
Four study programs organize the platform’s evidence tiers. Every roster, family list, methodology row, and claim-gate status below is build-inlined metadata from the committed catalog; no comparative claim is published until a program’s claim gate opens.
The foundational comparison tier over the baseline solver field.
Publication surface: Evidence-grade exports and the public portal's core catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, public.
Claim gates
- gate closedfoundation track beats the comparison cohort with Holm-corrected significance before any superiority claim
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-core | ga-int(registry-internal) |
| — | brkga(registry-internal) |
| — | eda(registry-internal) |
| — | tabu-search(registry-internal) |
Methodology
- Objectives
- makespan
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity → targeted
Planned figures & tables
Figures
- Convergence trajectory
- Solver rankings
- Critical-difference diagram
Tables
- Solver summary
- Pairwise comparisons
- Effect sizes
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The time-bounded comparison tier focused on runtime behavior.
Publication surface: Evidence-grade exports and the public portal's speed catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, public.
Claim gates
- gate closedspeed track reaches matched quality at a smaller budget than the comparison cohort under both stopping protocols
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-fast | iterated-greedy(registry-internal) |
| — | alns(registry-internal) |
| — | vns(registry-internal) |
Methodology
- Objectives
- makespan, lateness
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity
Planned figures & tables
Figures
- Convergence trajectory
- Performance profile
- Solver rankings
Tables
- Solver summary
- Pairwise comparisons
- Budget speedup
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The solution-quality comparison tier focused on objective value.
Publication surface: Evidence-grade exports and the public portal's quality catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, quality, public.
Claim gates
- gate closedprecision track beats the comparison cohort on the primary quality indicator with Holm-corrected significance
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-summit | memetic(registry-internal) |
| — | nsga3 |
Methodology
- Objectives
- makespan, cost, composite
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity → targeted
Planned figures & tables
Figures
- Convergence trajectory
- Pareto frontier
- Critical-difference diagram
Tables
- Solver summary
- Quality indicators
- Mechanism ablation
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The reproducibility and tooling tier over the full evidence set.
Publication surface: Evidence-grade exports, the public portal, and release notes.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, quality, platform, public.
Claim gates
- gate closedplatform track routes any unsupported platform claim to limitations or future work rather than overclaiming
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
- gate openCoverage and reproducibility statements are supported by artifact inspection.
platform-comparison.json feature rows are artifact-inspected.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-core | — |
| ndso-fast | — |
| ndso-summit | — |
Comparison basis: the rival-framework matrix published as platform-comparison.json.
Methodology
- Objectives
- makespan, cost
- Statistics
- feature-coverage, distribution-distance-bridge
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- comparative → pilot
Planned figures & tables
Figures
- Feature-richness matrix
- Distribution-distance calibration
Tables
- Feature coverage
- Framework comparison
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
Future program candidates
Candidate programs staged for a future evidence tier — each doubles as a worked example of the add-a-program recipe.
Constraint-and-robustness extension candidate
rcpspflow-shopDefer / retire rule: defer until a robustness-bearing campaign produces a labeled corpus; retire if no advantage clears the gate after one campaign
Top-level policy: Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Program inti
Program inti mempelajari kinerja tujuan dasar pada bidang solver dasar — perbandingan yang mendasari semua yang lain. Keluarga tolok ukurnya adalah penjadwalan mesin, job shop, dan job shop fleksibel, dan ia mengadu komposisi inti asli dengan kohort perbandingan konstruktif dan metaheuristik. Metodologinya memadukan uji peringkat bertanda Wilcoxon, omnibus Friedman dengan koreksi pasca Holm, analisis perbedaan kritis Nemenyi, serta ukuran efek Vargha–Delaney A12 dan delta Cliff dengan interval keyakinan BCa, atas setidaknya 30 jalur independen per sel stokastik. Gerbang perbandingannya tetap tertutup sampai kampanye perbandingan penuh melewati gerbang statistik.
Program kecepatan
Program kecepatan mempelajari efisiensi waktu jalan dan setiap saat di bawah penghentian yang disepadankan — jejak setiap saat, profil kinerja, dan gerbang kualitas sepadan pada anggaran lebih kecil. Keluarga tolok ukurnya adalah flow shop dan penjadwalan proyek dengan sumber daya terbatas, dan kohort perbandingannya adalah serakah iteratif, ALNS, dan VNS. Ia menerapkan metodologi non-parametrik dan ambang jalur yang sama dengan program inti.
Program kualitas
Program kualitas mempelajari kualitas solusi dan indikator multi-tujuan — celah tujuan, tampilan garis depan Pareto dan perbedaan kritis, tabel indikator kualitas, dan ablasi. Keluarga tolok ukurnya adalah penjadwalan proyek dengan sumber daya terbatas dan job shop fleksibel, dan kohort perbandingannya adalah pencarian memetik dan NSGA-III. Ia mempertahankan disiplin statistik dan ambang jalur yang sama dengan program-program di atas.
Program platform
Program platform menyajikan bidang terluas yang diterbitkan platform — jajaran terkurasi lintas keluarga yang mewakili setiap keluarga solver dalam registri, bukan setiap solver terdaftar, dengan cakupan fitur, label jarak distribusi, serta bukti reproduksibilitas dan perkakas. Selaras dengan tampilan inspeksi platform, klaim yang tidak didukung dialihkan ke keterbatasan alih-alih dilebih-lebihkan. Sikap cakupan dan reproduksibilitasnya kini didukung oleh inspeksi artefak, sebuah sikap kemampuan dan bukan klaim kinerja; gerbang perbandingannya tetap tertutup seperti yang lain.
Menambahkan program studi
Program studi baru mengikuti jalur tutup-saat-gagal yang sama seperti yang ditampilkan etalase untuk setiap program yang ada. Baris kandidat masa depan di etalase adalah contoh yang dikerjakan.
-
Daftarkan tingkatan. Tambahkan satu entri tingkatan ke registri tingkatan beserta nilai tingkatan buktinya; uji kontrak registri memaksakan kelengkapan.
-
Deklarasikan jalur bukti. Tambahkan jalur bukti ke atlas eksperimen — keluarga tolok ukurnya, jajaran, kohort, statistik, gerbang, dan ambang jalur — atau mulai dulu sebagai kandidat masa depan.
-
Siapkan ruang kerja. Buat direktori ruang kerja program dengan resepnya, ditambah satu konfigurasi pilot dan satu perbandingan:
New-Item -ItemType Directory -Path .\experiments\programs\<id> Copy-Item .\experiments\configs\core-pilot.json ` .\experiments\configs\<id>-pilot.json Copy-Item .\experiments\configs\core-comparative.json ` .\experiments\configs\<id>-comparative.json -
Jalankan. Jalankan kampanye pilot untuk tingkatan baru, lalu kurasi bundel bertingkat dengan alat baris perintah analytica:
uv run python experiments\scripts\regenerate.py ` --config .\experiments\configs\<id>-pilot.json --tier <id> -
Publikasikan. Regenerasi portal agar program muncul di sini secara otomatis; gerbang kesegaran menggagalkan build jika regenerasi dilewati:
uv run python tools\build_site_assets.py -
Dokumentasikan. Tambahkan bagian program ke halaman ini dan cerminkan di semua bahasa.
Navigasi
- Bundel bukti — ekspor bertingkat yang dikurasi tiap program.
- Kampanye yang dapat direproduksi — ruang kerja yang menjalankan kampanye di balik tiap program.
- Penjelajah hasil — bukti jalur yang tersaring pengungkapan.
- Unduhan — bundel bukti yang dipublikasikan.
- Sitasi — cara menyitasi platform dan materi pendampingnya.
- Inspeksi platform — sikap cakupan dan reproduksibilitas yang diperiksa artefak yang diringkas program platform.