{"$k":["studySlug","chartId","series","point","metric","label","value","unit","display","n","ci","spanKind","context"],"$r":[["swe-bench-verified","swebench-same-instance-leaderboard","Resolved rate","Claude 4.5 Opus (high)","swebench-same-instance-leaderboard","Resolved rate on the same 33 SWE-bench Verified instances",0.7273,"rate","73% (24/33)",33,[0.5578,0.8493],"ci95","effort high · public mini-SWE-agent v2 run, same instances"],["swe-bench-verified","swebench-model-calls","Mean calls","Claude 4.5 Opus (high)","swebench-model-calls","Model calls per instance",35.9,"calls","35.9",33,"\u0001","\u0001","effort high · public mini-SWE-agent v2 run, same instances"],["cost-thought-experiments","cost-per-resolved-agent-vs-panel","Cost per resolved instance","Claude 4.5 Opus (high)","cost-per-resolved-agent-vs-panel","Recorded cost per resolved instance: Agent vs the public panel",1.184,"usd","$1.18",24,"\u0001","\u0001","effort high · public mini-SWE-agent v2 run, same instances"]]}