@@ -51,6 +51,8 @@ def main() -> None:
5151 evaluator_notes = observations .get ("evaluator_notes" , [])
5252 caveats = observations .get ("caveats" , [])
5353 evidence = observations .get ("evidence" , [])
54+ artifact_class = observations .get ("artifact_class" )
55+ confidence_level = observations .get ("confidence_level" )
5456 metric_weights = config .get ("metric_weights" , {})
5557 metric_scores = build_metric_scores (metric_weights , scenario_scores , metric_overrides )
5658 scenario_coverage = round (
@@ -74,6 +76,7 @@ def main() -> None:
7476 "Benchmarking Persistent AI and Digital Twin as a Service Systems" ,
7577 ),
7678 "artifact_type" : "benchmark_result" ,
79+ "artifact_class" : artifact_class ,
7780 "system_name" : args .system_name ,
7881 "system_version" : args .system_version ,
7982 "date_evaluated" : args .date_evaluated ,
@@ -103,6 +106,7 @@ def main() -> None:
103106 "evaluator_notes" : evaluator_notes ,
104107 "caveats" : caveats ,
105108 "evidence" : evidence ,
109+ "confidence_level" : confidence_level ,
106110 }
107111
108112 write_json (args .output , payload )
0 commit comments