{"id":"https://openalex.org/W7167060742","doi":"https://doi.org/10.48550/arxiv.2607.00164","title":"Verifiable Rewards for Calibrated Probabilistic Forecasting","display_name":"Verifiable Rewards for Calibrated Probabilistic Forecasting","publication_year":2026,"publication_date":"2026-06-30","ids":{"openalex":"https://openalex.org/W7167060742","doi":"https://doi.org/10.48550/arxiv.2607.00164"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2607.00164","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00164","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2607.00164","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5103955944","display_name":"Sadanand Singh","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Singh, Sadanand","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5011561995","display_name":"Allam Reddy","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Reddy, Allam","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5082043200","display_name":"Manan Chopra","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Chopra, Manan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11674","display_name":"Sports Analytics and Performance","score":0.8374000191688538,"subfield":{"id":"https://openalex.org/subfields/2002","display_name":"Economics and Econometrics"},"field":{"id":"https://openalex.org/fields/20","display_name":"Economics, Econometrics and Finance"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},"topics":[{"id":"https://openalex.org/T11674","display_name":"Sports Analytics and Performance","score":0.8374000191688538,"subfield":{"id":"https://openalex.org/subfields/2002","display_name":"Economics and Econometrics"},"field":{"id":"https://openalex.org/fields/20","display_name":"Economics, Econometrics and Finance"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T12101","display_name":"Advanced Bandit Algorithms Research","score":0.01940000057220459,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T12026","display_name":"Explainable Artificial Intelligence (XAI)","score":0.017999999225139618,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/verifiable-secret-sharing","display_name":"Verifiable secret sharing","score":0.7501999735832214},{"id":"https://openalex.org/keywords/brier-score","display_name":"Brier score","score":0.6983000040054321},{"id":"https://openalex.org/keywords/outcome","display_name":"Outcome (game theory)","score":0.6712999939918518},{"id":"https://openalex.org/keywords/scoring-rule","display_name":"Scoring rule","score":0.6697999835014343},{"id":"https://openalex.org/keywords/probabilistic-logic","display_name":"Probabilistic logic","score":0.6118999719619751},{"id":"https://openalex.org/keywords/calibration","display_name":"Calibration","score":0.5540000200271606},{"id":"https://openalex.org/keywords/estimator","display_name":"Estimator","score":0.5302000045776367},{"id":"https://openalex.org/keywords/baseline","display_name":"Baseline (sea)","score":0.43309998512268066},{"id":"https://openalex.org/keywords/testbed","display_name":"Testbed","score":0.4325000047683716}],"concepts":[{"id":"https://openalex.org/C85847156","wikidata":"https://www.wikidata.org/wiki/Q59015987","display_name":"Verifiable secret sharing","level":3,"score":0.7501999735832214},{"id":"https://openalex.org/C35405484","wikidata":"https://www.wikidata.org/wiki/Q4967066","display_name":"Brier score","level":2,"score":0.6983000040054321},{"id":"https://openalex.org/C148220186","wikidata":"https://www.wikidata.org/wiki/Q7111912","display_name":"Outcome (game theory)","level":2,"score":0.6712999939918518},{"id":"https://openalex.org/C63002673","wikidata":"https://www.wikidata.org/wiki/Q2260590","display_name":"Scoring rule","level":2,"score":0.6697999835014343},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6620000004768372},{"id":"https://openalex.org/C49937458","wikidata":"https://www.wikidata.org/wiki/Q2599292","display_name":"Probabilistic logic","level":2,"score":0.6118999719619751},{"id":"https://openalex.org/C165838908","wikidata":"https://www.wikidata.org/wiki/Q736777","display_name":"Calibration","level":2,"score":0.5540000200271606},{"id":"https://openalex.org/C185429906","wikidata":"https://www.wikidata.org/wiki/Q1130160","display_name":"Estimator","level":2,"score":0.5302000045776367},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5274999737739563},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.4383000135421753},{"id":"https://openalex.org/C12725497","wikidata":"https://www.wikidata.org/wiki/Q810247","display_name":"Baseline (sea)","level":2,"score":0.43309998512268066},{"id":"https://openalex.org/C31395832","wikidata":"https://www.wikidata.org/wiki/Q1318674","display_name":"Testbed","level":2,"score":0.4325000047683716},{"id":"https://openalex.org/C149782125","wikidata":"https://www.wikidata.org/wiki/Q160039","display_name":"Econometrics","level":1,"score":0.39899998903274536},{"id":"https://openalex.org/C122282355","wikidata":"https://www.wikidata.org/wiki/Q7246855","display_name":"Probabilistic forecasting","level":3,"score":0.39169999957084656},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.3346000015735626},{"id":"https://openalex.org/C48798503","wikidata":"https://www.wikidata.org/wiki/Q877546","display_name":"Reputation","level":2,"score":0.3179999887943268},{"id":"https://openalex.org/C130648207","wikidata":"https://www.wikidata.org/wiki/Q6007562","display_name":"Imprecise probability","level":3,"score":0.287200003862381},{"id":"https://openalex.org/C2777152325","wikidata":"https://www.wikidata.org/wiki/Q108163","display_name":"Proposition","level":2,"score":0.2833999991416931},{"id":"https://openalex.org/C7493553","wikidata":"https://www.wikidata.org/wiki/Q1520777","display_name":"Certainty","level":2,"score":0.2775999903678894},{"id":"https://openalex.org/C2780695315","wikidata":"https://www.wikidata.org/wiki/Q3799040","display_name":"Unobservable","level":2,"score":0.26339998841285706},{"id":"https://openalex.org/C73602740","wikidata":"https://www.wikidata.org/wiki/Q7795822","display_name":"Thompson sampling","level":3,"score":0.26249998807907104},{"id":"https://openalex.org/C97399411","wikidata":"https://www.wikidata.org/wiki/Q825367","display_name":"Coin flipping","level":2,"score":0.2614000141620636},{"id":"https://openalex.org/C170061395","wikidata":"https://www.wikidata.org/wiki/Q5468164","display_name":"Forecast skill","level":2,"score":0.2556999921798706},{"id":"https://openalex.org/C2779110517","wikidata":"https://www.wikidata.org/wiki/Q1240788","display_name":"Supervisor","level":2,"score":0.25529998540878296},{"id":"https://openalex.org/C162376815","wikidata":"https://www.wikidata.org/wiki/Q2158281","display_name":"Frequentist inference","level":4,"score":0.2531999945640564}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2607.00164","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00164","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2607.00164","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00164","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"score":0.7958351373672485,"id":"https://metadata.un.org/sdg/16","display_name":"Peace, Justice and strong institutions"}],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Reinforcement":[0],"learning":[1],"with":[2,84,155],"verifiable":[3],"rewards":[4],"can":[5],"in":[6,30],"principle":[7],"train":[8],"calibrated":[9,181],"probabilistic":[10],"forecasters,":[11],"since":[12],"a":[13,48,52,82,89,102,116,120,146,165,183,191],"proper":[14],"scoring":[15],"rule":[16],"such":[17],"as":[18,81,88,199,208],"the":[19,33,63,67,70,85,92,98,106,110,131,137,140,169,172,195,203,217,222,230],"Brier":[20,197],"score":[21,198],"is":[22,28,66,72,101,179],"computed":[23],"from":[24,126,228],"outcomes":[25],"alone":[26],"and":[27,41,69,105,134,178,190],"minimized":[29],"expectation":[31],"by":[32,142,175],"true":[34],"probability.":[35],"In":[36],"practice":[37],"it":[38,150],"degrades":[39],"calibration,":[40],"existing":[42],"remedies":[43],"address":[44],"epistemic":[45],"uncertainty,":[46],"where":[47,62],"model's":[49],"confidence":[50],"accompanies":[51],"verifiably":[53],"correct":[54],"or":[55,145,162],"incorrect":[56],"answer.":[57],"We":[58,114],"study":[59],"aleatoric":[60],"forecasting,":[61],"forecast":[64,231],"itself":[65],"output":[68],"label":[71,132],"one":[73],"stochastic":[74],"outcome,":[75],"taking":[76],"NFL":[77],"in-game":[78,210],"win":[79,123],"probability":[80],"testbed":[83],"betting":[86,173],"market":[87,174],"reference.":[90],"Rewarding":[91],"realized":[93],"per-play":[94],"outcome":[95,100],"fails,":[96],"because":[97],"single":[99],"noisy":[103],"target":[104],"policy":[107],"gradient":[108,138,147],"corrupts":[109],"chain":[111,223],"of":[112,171,224],"thought.":[113],"introduce":[115],"verifiable,":[117],"label-free":[118],"reward,":[119],"state-conditioned":[121],"empirical":[122],"rate":[124],"estimated":[125],"past":[127],"outcomes,":[128],"that":[129],"removes":[130],"noise,":[133],"we":[135],"keep":[136],"off":[139],"reasoning,":[141],"direct":[143,176],"prediction":[144,177],"mask,":[148],"so":[149],"cannot":[151],"be":[152],"corrupted.":[153],"Trained":[154],"this":[156,200],"reward":[157],"alone,":[158],"without":[159],"human":[160],"labels":[161],"supervised":[163],"fine-tuning,":[164],"7B":[166],"model":[167,189],"reaches":[168],"calibration":[170],"better":[180],"than":[182,220],"zero-shot":[184],"frontier":[185,188],"model.":[186],"That":[187],"tabular":[192],"estimator":[193],"reach":[194],"same":[196],"model,":[201],"identifying":[202],"market's":[204],"small":[205],"remaining":[206],"edge":[207],"live":[209],"information":[211],"beyond":[212],"their":[213],"shared":[214],"inputs.":[215],"Masking":[216],"gradient,":[218],"rather":[219],"dropping":[221],"thought,":[225],"preserves":[226],"reasoning":[227],"which":[229,233],"follows,":[232],"ordinary":[234],"chain-of-thought":[235],"training":[236],"corrupts.":[237]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-07-03T00:00:00"}
