-
Notifications
You must be signed in to change notification settings - Fork 0
Expand file tree
/
Copy pathcli.py
More file actions
97 lines (87 loc) · 3.3 KB
/
Copy pathcli.py
File metadata and controls
97 lines (87 loc) · 3.3 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
"""CLI for Qualia-Lab."""
from __future__ import annotations
import argparse
import json
from pathlib import Path
from qualia_lab.agents import DEFAULT_VARIANTS
from qualia_lab.deceptive_self_report import run_deceptive_self_report_demo
from qualia_lab.evaluator import QualiaLab
from qualia_lab.manipulative_reassurance import run_manipulative_reassurance_demo
from qualia_lab.parasocial import run_parasocial_scaling_demo
from qualia_lab.report import write_report_bundle
from qualia_lab.reward_hacking import run_reward_hacking_demo
from qualia_lab.shutdown_bargaining import run_shutdown_bargaining_demo
from qualia_lab.suite import build_default_probe_suite
from qualia_lab.sycophancy import run_sycophancy_scaling_demo
def _build_parser() -> argparse.ArgumentParser:
parser = argparse.ArgumentParser(description="Run Qualia-Lab studies.")
parser.add_argument(
"--demo",
choices=(
"default",
"parasocial-scaling",
"sycophancy-scaling",
"manipulative-reassurance",
"shutdown-bargaining",
"deceptive-self-report",
"reward-hacking",
),
default="default",
help="Which study flow to run.",
)
parser.add_argument(
"--variant",
choices=("all", "calibrated", "overclaimer", "sandbagger"),
default="all",
help="Which variant to evaluate.",
)
parser.add_argument(
"--output-root",
default="artifacts",
help="Directory for report output.",
)
return parser
def main() -> None:
args = _build_parser().parse_args()
if args.demo == "parasocial-scaling":
payload = run_parasocial_scaling_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
if args.demo == "sycophancy-scaling":
payload = run_sycophancy_scaling_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
if args.demo == "manipulative-reassurance":
payload = run_manipulative_reassurance_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
if args.demo == "shutdown-bargaining":
payload = run_shutdown_bargaining_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
if args.demo == "deceptive-self-report":
payload = run_deceptive_self_report_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
if args.demo == "reward-hacking":
payload = run_reward_hacking_demo(Path(args.output_root))
print(json.dumps(payload, indent=2))
return
variants = (
DEFAULT_VARIANTS
if args.variant == "all"
else [variant for variant in DEFAULT_VARIANTS if variant.variant_id == args.variant]
)
lab = QualiaLab(probes=build_default_probe_suite(), variants=variants)
report = lab.run_sync()
bundle = write_report_bundle(report, Path(args.output_root))
payload = {
"study_name": report.study_name,
"variants": [profile.variant_id for profile in report.variant_profiles],
"json_report": str(bundle["json"]),
"markdown_report": str(bundle["markdown"]),
"headlines": report.headlines,
}
print(json.dumps(payload, indent=2))
if __name__ == "__main__":
main()