| .. | ||
| polish_baseline | ||
| benchmark_class_f1.csv | ||
| benchmark_hybrids.csv | ||
| benchmark_summary.csv | ||
| negative_control.csv | ||
| README.md | ||
| robustness_deltas.csv | ||
| robustness_runs.csv | ||
| robustness_summary.csv | ||
| severity_runs.csv | ||
| severity_summary.csv | ||
Zarchiwizowane eksperymenty — nie raportować jako finalny model
Pliki w tym katalogu pochodzą z etapów wyszukiwania architektury. Pozostają wyłącznie jako ślad eksperymentalny.
| Artefakt | Co mierzył | Status |
|---|---|---|
benchmark_* |
bazowe raw/relative/combined + Logistic/Extra Trees | superseded |
robustness_* |
stary label combined+Logistic i severity raw+Extra Trees | superseded |
severity_* |
ranking kandydatów severity ze starszym modelem label | candidate search |
negative_control.csv |
kontrola starego eksperymentu severity | superseded |
polish_baseline/ |
snapshot bazowy przed finalnym polishingiem | superseded |
Finalny pipeline to final_pipeline.py. Jego jedyną walidacją raportowaną do jury jest ml_polish_benchmark.py, a aktualne wyniki znajdują się w katalogu głównym:
ml_polish_summary.csv,ml_polish_runs.csv,ml_polish_negative_control.csv.
Nie porównuj liczb z tego katalogu bezpośrednio z finalnymi metrykami — dotyczą różnych architektur.