{"id":"https://openalex.org/W7163545155","doi":"https://doi.org/10.48550/arxiv.2606.04845","title":"Bayesian learning for the stochastic shortest path problem","display_name":"Bayesian learning for the stochastic shortest path problem","publication_year":2026,"publication_date":"2026-06-03","ids":{"openalex":"https://openalex.org/W7163545155","doi":"https://doi.org/10.48550/arxiv.2606.04845"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2606.04845","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.04845","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2606.04845","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5137903138","display_name":"Chon Wai Ho","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Ho, Chon Wai","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5035598384","display_name":"Sumeetpal S. Singh","orcid":"https://orcid.org/0000-0002-5430-1496"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Singh, Sumeetpal S.","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5137818302","display_name":"Jiaqi Guo","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Guo, Jiaqi","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T12814","display_name":"Gaussian Processes and Bayesian Inference","score":0.3472000062465668,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T12814","display_name":"Gaussian Processes and Bayesian Inference","score":0.3472000062465668,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12056","display_name":"Markov Chains and Monte Carlo Methods","score":0.1573999971151352,"subfield":{"id":"https://openalex.org/subfields/2613","display_name":"Statistics and Probability"},"field":{"id":"https://openalex.org/fields/26","display_name":"Mathematics"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11612","display_name":"Stochastic Gradient Optimization Techniques","score":0.06469999998807907,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/posterior-probability","display_name":"Posterior probability","score":0.49480000138282776},{"id":"https://openalex.org/keywords/bayesian-probability","display_name":"Bayesian probability","score":0.47269999980926514},{"id":"https://openalex.org/keywords/shortest-path-problem","display_name":"Shortest path problem","score":0.43950000405311584},{"id":"https://openalex.org/keywords/markov-decision-process","display_name":"Markov decision process","score":0.37439998984336853},{"id":"https://openalex.org/keywords/benchmark","display_name":"Benchmark (surveying)","score":0.3677000105381012},{"id":"https://openalex.org/keywords/gaussian-process","display_name":"Gaussian process","score":0.3560999929904938},{"id":"https://openalex.org/keywords/markov-process","display_name":"Markov process","score":0.3310999870300293},{"id":"https://openalex.org/keywords/gaussian","display_name":"Gaussian","score":0.328900009393692},{"id":"https://openalex.org/keywords/path","display_name":"Path (computing)","score":0.3179999887943268}],"concepts":[{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.5121999979019165},{"id":"https://openalex.org/C57830394","wikidata":"https://www.wikidata.org/wiki/Q278079","display_name":"Posterior probability","level":3,"score":0.49480000138282776},{"id":"https://openalex.org/C107673813","wikidata":"https://www.wikidata.org/wiki/Q812534","display_name":"Bayesian probability","level":2,"score":0.47269999980926514},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.4564000070095062},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.4560999870300293},{"id":"https://openalex.org/C22590252","wikidata":"https://www.wikidata.org/wiki/Q1058754","display_name":"Shortest path problem","level":3,"score":0.43950000405311584},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.38040000200271606},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.37439998984336853},{"id":"https://openalex.org/C185798385","wikidata":"https://www.wikidata.org/wiki/Q1161707","display_name":"Benchmark (surveying)","level":2,"score":0.3677000105381012},{"id":"https://openalex.org/C61326573","wikidata":"https://www.wikidata.org/wiki/Q1496376","display_name":"Gaussian process","level":3,"score":0.3560999929904938},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.3488999903202057},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.334199994802475},{"id":"https://openalex.org/C159886148","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov process","level":2,"score":0.3310999870300293},{"id":"https://openalex.org/C163716315","wikidata":"https://www.wikidata.org/wiki/Q901177","display_name":"Gaussian","level":2,"score":0.328900009393692},{"id":"https://openalex.org/C2777735758","wikidata":"https://www.wikidata.org/wiki/Q817765","display_name":"Path (computing)","level":2,"score":0.3179999887943268},{"id":"https://openalex.org/C177769412","wikidata":"https://www.wikidata.org/wiki/Q278090","display_name":"Prior probability","level":3,"score":0.30790001153945923},{"id":"https://openalex.org/C150325174","wikidata":"https://www.wikidata.org/wiki/Q4335500","display_name":"Optimal decision","level":3,"score":0.299699991941452},{"id":"https://openalex.org/C160234255","wikidata":"https://www.wikidata.org/wiki/Q812535","display_name":"Bayesian inference","level":3,"score":0.29820001125335693},{"id":"https://openalex.org/C115988155","wikidata":"https://www.wikidata.org/wiki/Q3262192","display_name":"Decision problem","level":2,"score":0.2953000068664551},{"id":"https://openalex.org/C2780598303","wikidata":"https://www.wikidata.org/wiki/Q65921492","display_name":"Flexibility (engineering)","level":2,"score":0.29190000891685486},{"id":"https://openalex.org/C207201462","wikidata":"https://www.wikidata.org/wiki/Q182505","display_name":"Bayes' theorem","level":3,"score":0.29010000824928284},{"id":"https://openalex.org/C98763669","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov chain","level":2,"score":0.28450000286102295},{"id":"https://openalex.org/C149441793","wikidata":"https://www.wikidata.org/wiki/Q200726","display_name":"Probability distribution","level":2,"score":0.2732999920845032},{"id":"https://openalex.org/C2776029896","wikidata":"https://www.wikidata.org/wiki/Q3935810","display_name":"Relaxation (psychology)","level":2,"score":0.26980000734329224},{"id":"https://openalex.org/C28901747","wikidata":"https://www.wikidata.org/wiki/Q177571","display_name":"Decision theory","level":2,"score":0.2637999951839447},{"id":"https://openalex.org/C111350023","wikidata":"https://www.wikidata.org/wiki/Q1191869","display_name":"Markov chain Monte Carlo","level":3,"score":0.263700008392334},{"id":"https://openalex.org/C17098449","wikidata":"https://www.wikidata.org/wiki/Q176814","display_name":"Partially observable Markov decision process","level":4,"score":0.25769999623298645},{"id":"https://openalex.org/C71983512","wikidata":"https://www.wikidata.org/wiki/Q7915687","display_name":"Variable-order Bayesian network","level":4,"score":0.2565999925136566}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2606.04845","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.04845","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2606.04845","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.04845","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Sequential":[0],"decision-making":[1,46],"problems":[2],"are":[3],"often":[4],"modelled":[5],"as":[6,95],"a":[7,33,96,99,112,159,164],"Markov":[8],"decision":[9,40,134],"process":[10],"(MDP).":[11],"We":[12,31,142,185,204],"focus":[13],"on":[14,66,132,175],"the":[15,38,45,51,79,93,108,125,137,145,154,178],"stochastic":[16],"shortest":[17],"path":[18],"(SSP)":[19],"problem,":[20],"which":[21,167],"is":[22,75,119,168,200],"an":[23],"infinite-horizon":[24],"undiscounted":[25],"MDP":[26],"with":[27,44,98,206],"absorbing":[28],"terminal":[29],"states.":[30],"develop":[32],"Bayesian":[34,60,198],"framework":[35,189],"to":[36,76,120,195],"learn":[37,50],"optimal":[39,52,150],"strategy":[41],"through":[42,84],"interactions":[43],"task.":[47],"Specifically,":[48,124],"we":[49,62,91,106],"action-value":[53],"function":[54],"$Q^*$,":[55,158],"but":[56],"unlike":[57],"many":[58],"existing":[59],"approaches,":[61],"do":[63],"not":[64],"rely":[65],"unrealistic":[67],"modelling":[68],"assumptions":[69],"and":[70,163],"ad-hoc":[71],"approximations.":[72],"Our":[73],"approach":[74],"directly":[77],"construct":[78],"posterior":[80,94,127,139,147],"beliefs":[81],"for":[82,149,153,208],"$Q^*$":[83],"Bellman's":[85],"optimality":[86],"equations.":[87],"For":[88],"deterministic":[89],"rewards,":[90],"characterise":[92],"distribution":[97],"manifold":[100],"density.":[101],"To":[102],"facilitate":[103],"simpler":[104],"inference,":[105],"relax":[107],"likelihood":[109,161],"so":[110],"that":[111,187],"Lebesgue":[113],"density":[114],"exists.":[115],"The":[116],"flip":[117],"side":[118],"create":[121],"unidentifiability":[122],"issues.":[123],"relaxed":[126],"can":[128],"have":[129],"significant":[130],"mass":[131],"improper":[133],"rules,":[135],"while":[136],"exact":[138,146],"will":[140],"not.":[141],"also":[143],"calculate":[144],"probabilities":[148],"action":[151],"selections":[152],"tabular":[155],"parametrisation":[156],"of":[157,177],"Gaussian":[160,165],"relaxation":[162],"prior,":[166],"useful":[169],"in":[170],"benchmarking":[171],"studies.":[172],"Numerical":[173],"studies":[174],"variants":[176],"Deep":[179],"Sea":[180],"benchmark":[181],"verify":[182],"our":[183,188],"findings.":[184],"demonstrate":[186],"faithfully":[190],"quantifies":[191],"uncertainty":[192],"and,":[193],"compared":[194],"other":[196],"temporal-difference-based":[197],"methodologies,":[199],"more":[201],"data":[202],"efficient.":[203],"conclude":[205],"recommendations":[207],"future":[209],"work.":[210]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-06-05T00:00:00"}
