Studienprogramme
Die vier Studienprogramme, die die Evidenzstufen der Plattform gliedern: Umfang, Benchmark-Familien, Solver-Aufgebote, Methodik und Status der Aussage-Schranken.
Die Evidenz der Plattform ist in vier Studienprogramme gegliedert, je eines pro Evidenzstufe: Kern, Geschwindigkeit, Qualität und Plattform. Die Stufen schachteln sich ineinander: Das Kernprogramm lässt Kern- und öffentliche Evidenz zu; das Geschwindigkeitsprogramm fügt die der Geschwindigkeit hinzu; das Qualitätsprogramm fügt die der Qualität hinzu; und das Plattformprogramm zeigt das vollständige öffentliche Feld. Jedes Programm grenzt genau ab, was seine Evidenzstufe offenlegen darf, sodass ein Programm niedrigerer Stufe niemals einen Mechanismus höherer Stufe preisgibt.
Die Vitrine unten liest jedes Aufgebot, jede Benchmark-Familie, Vergleichskohorte, jedes Methodikdetail und jeden Status der Aussage-Schranke aus dem bereits eingecheckten Programmpaket, sodass die Zahlen aktuell bleiben, während sich die Plattform weiterentwickelt, ohne handbearbeiteten Text. Keine vergleichende Aussage wird veröffentlicht, bevor die Schranke eines Programms öffnet; die heute veröffentlichten Exporte tragen nur Rauch-Entwicklungsevidenz.
Four study programs organize the platform’s evidence tiers. Every roster, family list, methodology row, and claim-gate status below is build-inlined metadata from the committed catalog; no comparative claim is published until a program’s claim gate opens.
The foundational comparison tier over the baseline solver field.
Publication surface: Evidence-grade exports and the public portal's core catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, public.
Claim gates
- gate closedfoundation track beats the comparison cohort with Holm-corrected significance before any superiority claim
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-core | ga-int(registry-internal) |
| — | brkga(registry-internal) |
| — | eda(registry-internal) |
| — | tabu-search(registry-internal) |
Methodology
- Objectives
- makespan
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity → targeted
Planned figures & tables
Figures
- Convergence trajectory
- Solver rankings
- Critical-difference diagram
Tables
- Solver summary
- Pairwise comparisons
- Effect sizes
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The time-bounded comparison tier focused on runtime behavior.
Publication surface: Evidence-grade exports and the public portal's speed catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, public.
Claim gates
- gate closedspeed track reaches matched quality at a smaller budget than the comparison cohort under both stopping protocols
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-fast | iterated-greedy(registry-internal) |
| — | alns(registry-internal) |
| — | vns(registry-internal) |
Methodology
- Objectives
- makespan, lateness
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity
Planned figures & tables
Figures
- Convergence trajectory
- Performance profile
- Solver rankings
Tables
- Solver summary
- Pairwise comparisons
- Budget speedup
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The solution-quality comparison tier focused on objective value.
Publication surface: Evidence-grade exports and the public portal's quality catalog.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, quality, public.
Claim gates
- gate closedprecision track beats the comparison cohort on the primary quality indicator with Holm-corrected significance
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-summit | memetic(registry-internal) |
| — | nsga3 |
Methodology
- Objectives
- makespan, cost, composite
- Statistics
- wilcoxon-signed-rank, friedman-omnibus, holm-post-hoc, nemenyi-critical-difference, vargha-delaney-a12, cliffs-delta, bca-bootstrap-ci
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- ablation → comparative → pilot → sensitivity → targeted
Planned figures & tables
Figures
- Convergence trajectory
- Pareto frontier
- Critical-difference diagram
Tables
- Solver summary
- Quality indicators
- Mechanism ablation
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
The reproducibility and tooling tier over the full evidence set.
Publication surface: Evidence-grade exports, the public portal, and release notes.
metadata-only
Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Admitted evidence labels: core, speed, quality, platform, public.
Claim gates
- gate closedplatform track routes any unsupported platform claim to limitations or future work rather than overclaiming
No campaign at the statistical-power floor has produced disclosure-filtered comparative evidence on the public surface; published bundles carry smoke-development evidence only.
- gate openCoverage and reproducibility statements are supported by artifact inspection.
platform-comparison.json feature rows are artifact-inspected.
Benchmark families
Solver roster & comparison cohort
| Solver roster | Comparison cohort |
|---|---|
| ndso-core | — |
| ndso-fast | — |
| ndso-summit | — |
Comparison basis: the rival-framework matrix published as platform-comparison.json.
Methodology
- Objectives
- makespan, cost
- Statistics
- feature-coverage, distribution-distance-bridge
- Run-count floor
- ≥30 independent runs per stochastic cell before comparative analysis.
- Campaign plan
- comparative → pilot
Planned figures & tables
Figures
- Feature-richness matrix
- Distribution-distance calibration
Tables
- Feature coverage
- Framework comparison
Evidence pointers
release-gated
A companion write-up is published only from an approved, disclosure-filtered evidence bundle after this program's claim gate and the release gates open.
Future program candidates
Candidate programs staged for a future evidence tier — each doubles as a worked example of the add-a-program recipe.
Constraint-and-robustness extension candidate
rcpspflow-shopDefer / retire rule: defer until a robustness-bearing campaign produces a labeled corpus; retire if no advantage clears the gate after one campaign
Top-level policy: Each study program scopes what its evidence tier may reveal; no comparative claim is published until its claim gate opens.
Kernprogramm
Das Kernprogramm untersucht die grundlegende Zielleistung über dem Basis-Solver-Feld – den Vergleich, der alle anderen trägt. Seine Benchmark-Familien sind Maschinen-Scheduling, Job-Shop und flexibles Job-Shop, und es stellt die native Kern-Komposition einer konstruktiven und metaheuristischen Vergleichskohorte gegenüber. Seine Methodik verbindet den Wilcoxon-Vorzeichen-Rang-Test, einen Friedman-Omnibus mit Holm-Nachkorrektur, die Nemenyi-Analyse der kritischen Differenz sowie die Effektgrößen Vargha–Delaney A12 und Cliffs Delta mit BCa-Konfidenzintervallen, über mindestens 30 unabhängige Läufe je stochastischer Zelle. Seine vergleichende Schranke bleibt geschlossen, bis eine vollständige Vergleichskampagne die statistischen Schranken besteht.
Geschwindigkeitsprogramm
Das Geschwindigkeitsprogramm untersucht die Laufzeit- und Anytime-Effizienz bei angeglichener Terminierung – Anytime-Spuren, Leistungsprofile und eine Schranke für angeglichene Qualität bei kleinerem Budget. Seine Benchmark-Familien sind Flow-Shop und ressourcenbeschränkte Projektplanung, und seine Vergleichskohorte ist iteriertes Greedy, ALNS und VNS. Es wendet dieselbe nichtparametrische Methodik und dieselbe Laufuntergrenze an wie das Kernprogramm.
Qualitätsprogramm
Das Qualitätsprogramm untersucht die Lösungsqualität und Mehrziel-Indikatoren – Ziellücken, Pareto-Front- und Kritische-Differenz-Ansichten, Qualitätsindikator-Tabellen und Ablation. Seine Benchmark-Familien sind die ressourcenbeschränkte Projektplanung und das flexible Job-Shop, und seine Vergleichskohorte ist memetische Suche und NSGA-III. Es behält dieselbe statistische Disziplin und Laufuntergrenze wie die vorherigen Programme.
Plattformprogramm
Das Plattformprogramm zeigt das breiteste Feld, das die Plattform veröffentlicht – ein kuratiertes familienübergreifendes Aufgebot, das jede Solver-Familie der Registry vertritt statt jeden registrierten Solver, mit Merkmalsabdeckung, Verteilungsabstands-Etiketten sowie Reproduzierbarkeits- und Werkzeugevidenz. Im Einklang mit der Ansicht der Plattforminspektion wird eine nicht gestützte Aussage in die Einschränkungen geleitet statt überzogen. Seine Abdeckungs- und Reproduzierbarkeitshaltung wird heute durch Artefaktinspektion gestützt, eine Fähigkeitshaltung und keine Leistungsaussage; seine vergleichenden Schranken bleiben wie die anderen geschlossen.
Ein Studienprogramm hinzufügen
Ein neues Studienprogramm folgt demselben fehlerschließenden Pfad, den die Vitrine für jedes bestehende zeigt. Die Zukunftskandidaten-Zeile der Vitrine ist das ausgearbeitete Beispiel.
-
Stufe registrieren. Fügen Sie dem Stufenregister einen Stufeneintrag samt seinem Evidenzstufen-Wert hinzu; die Vertragstests des Registers erzwingen die Vollständigkeit.
-
Evidenzspur deklarieren. Fügen Sie dem Experiment-Atlas eine Evidenzspur hinzu – ihre Benchmark-Familien, Aufgebot, Kohorte, Statistiken, Schranke und Laufuntergrenze – oder starten Sie sie zunächst als Zukunftskandidat.
-
Arbeitsbereich aufsetzen. Erstellen Sie das Arbeitsbereich-Verzeichnis des Programms mit seinem Rezept sowie eine Pilot- und eine Vergleichskonfiguration:
New-Item -ItemType Directory -Path .\experiments\programs\<id> Copy-Item .\experiments\configs\core-pilot.json ` .\experiments\configs\<id>-pilot.json Copy-Item .\experiments\configs\core-comparative.json ` .\experiments\configs\<id>-comparative.json -
Ausführen. Führen Sie die Pilotkampagne für die neue Stufe aus und kuratieren Sie dann das gestufte Paket mit dem Analytica-Kommandozeilenwerkzeug:
uv run python experiments\scripts\regenerate.py ` --config .\experiments\configs\<id>-pilot.json --tier <id> -
Veröffentlichen. Regenerieren Sie das Portal, sodass das Programm hier automatisch erscheint; die Frische-Schranke lässt den Build fehlschlagen, wenn die Regeneration ausgelassen wird:
uv run python tools\build_site_assets.py -
Dokumentieren. Fügen Sie den Abschnitt des Programms zu dieser Seite hinzu und spiegeln Sie ihn in den Sprachen.
Navigation
- Evidenzpakete – die gestuften Exporte, die jedes Programm kuratiert.
- Reproduzierbare Kampagnen – der Arbeitsbereich, der die Kampagnen hinter jedem Programm ausführt.
- Ergebnis-Explorer – die offenlegungsgefilterte Laufevidenz.
- Downloads – die veröffentlichten Evidenzpakete.
- Zitation – wie man die Plattform und ihre Begleitmaterialien zitiert.
- Plattforminspektion – die artefaktinspizierte Abdeckungs- und Reproduzierbarkeitshaltung, die das Plattformprogramm zusammenfasst.