{"id":"https://openalex.org/W7149168022","doi":"https://doi.org/10.48550/arxiv.2604.02196","title":"Computing the Exact Pareto Front in Average-Cost Multi-Objective Markov Decision Processes","display_name":"Computing the Exact Pareto Front in Average-Cost Multi-Objective Markov Decision Processes","publication_year":2026,"publication_date":"2026-04-02","ids":{"openalex":"https://openalex.org/W7149168022","doi":"https://doi.org/10.48550/arxiv.2604.02196"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2604.02196","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.02196","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2604.02196","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5132842333","display_name":"Jiping Luo","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Luo, Jiping","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5132914842","display_name":"Nikolaos Pappas","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Pappas, Nikolaos","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.8777999877929688,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.8777999877929688,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10848","display_name":"Advanced Multi-Objective Optimization Algorithms","score":0.033399999141693115,"subfield":{"id":"https://openalex.org/subfields/1703","display_name":"Computational Theory and Mathematics"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12101","display_name":"Advanced Bandit Algorithms Research","score":0.01979999989271164,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/regular-polygon","display_name":"Regular polygon","score":0.5551000237464905},{"id":"https://openalex.org/keywords/mixing","display_name":"Mixing (physics)","score":0.5461999773979187},{"id":"https://openalex.org/keywords/vertex","display_name":"Vertex (graph theory)","score":0.5291000008583069},{"id":"https://openalex.org/keywords/markov-chain","display_name":"Markov chain","score":0.4546999931335449},{"id":"https://openalex.org/keywords/markov-process","display_name":"Markov process","score":0.44769999384880066},{"id":"https://openalex.org/keywords/pareto-principle","display_name":"Pareto principle","score":0.44279998540878296},{"id":"https://openalex.org/keywords/boundary","display_name":"Boundary (topology)","score":0.4377000033855438},{"id":"https://openalex.org/keywords/multi-objective-optimization","display_name":"Multi-objective optimization","score":0.40139999985694885}],"concepts":[{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.5774999856948853},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.5641999840736389},{"id":"https://openalex.org/C112680207","wikidata":"https://www.wikidata.org/wiki/Q714886","display_name":"Regular polygon","level":2,"score":0.5551000237464905},{"id":"https://openalex.org/C138777275","wikidata":"https://www.wikidata.org/wiki/Q6884054","display_name":"Mixing (physics)","level":2,"score":0.5461999773979187},{"id":"https://openalex.org/C80899671","wikidata":"https://www.wikidata.org/wiki/Q1304193","display_name":"Vertex (graph theory)","level":3,"score":0.5291000008583069},{"id":"https://openalex.org/C98763669","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov chain","level":2,"score":0.4546999931335449},{"id":"https://openalex.org/C159886148","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov process","level":2,"score":0.44769999384880066},{"id":"https://openalex.org/C137635306","wikidata":"https://www.wikidata.org/wiki/Q182667","display_name":"Pareto principle","level":2,"score":0.44279998540878296},{"id":"https://openalex.org/C62354387","wikidata":"https://www.wikidata.org/wiki/Q875399","display_name":"Boundary (topology)","level":2,"score":0.4377000033855438},{"id":"https://openalex.org/C68781425","wikidata":"https://www.wikidata.org/wiki/Q2052203","display_name":"Multi-objective optimization","level":2,"score":0.40139999985694885},{"id":"https://openalex.org/C28826006","wikidata":"https://www.wikidata.org/wiki/Q33521","display_name":"Applied mathematics","level":1,"score":0.3937999904155731},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.3813999891281128},{"id":"https://openalex.org/C2777551076","wikidata":"https://www.wikidata.org/wiki/Q842332","display_name":"Front (military)","level":2,"score":0.3783000111579895},{"id":"https://openalex.org/C157972887","wikidata":"https://www.wikidata.org/wiki/Q463359","display_name":"Convex optimization","level":3,"score":0.35359999537467957},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.313400000333786},{"id":"https://openalex.org/C18762648","wikidata":"https://www.wikidata.org/wiki/Q42213","display_name":"Work (physics)","level":2,"score":0.30149999260902405},{"id":"https://openalex.org/C48103436","wikidata":"https://www.wikidata.org/wiki/Q599031","display_name":"State (computer science)","level":2,"score":0.29649999737739563},{"id":"https://openalex.org/C2776359362","wikidata":"https://www.wikidata.org/wiki/Q2145286","display_name":"Representation (politics)","level":3,"score":0.2827000021934509},{"id":"https://openalex.org/C38814450","wikidata":"https://www.wikidata.org/wiki/Q7136870","display_name":"Pareto interpolation","level":4,"score":0.26339998841285706},{"id":"https://openalex.org/C520416788","wikidata":"https://www.wikidata.org/wiki/Q5419229","display_name":"Exact solutions in general relativity","level":2,"score":0.2614000141620636},{"id":"https://openalex.org/C28901747","wikidata":"https://www.wikidata.org/wiki/Q177571","display_name":"Decision theory","level":2,"score":0.257999986410141},{"id":"https://openalex.org/C12108790","wikidata":"https://www.wikidata.org/wiki/Q2234833","display_name":"Convex analysis","level":4,"score":0.25029999017715454}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2604.02196","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.02196","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2604.02196","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.02196","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"id":"https://metadata.un.org/sdg/16","display_name":"Peace, Justice and strong institutions","score":0.7688899636268616}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Many":[0],"communication":[1],"and":[2,90,145],"control":[3],"problems":[4],"are":[5],"cast":[6],"as":[7,102],"multi-objective":[8],"Markov":[9],"decision":[10],"processes":[11],"(MOMDPs).":[12],"The":[13,141],"complete":[14],"solution":[15],"to":[16,39,86,124,137,147],"an":[17],"MOMDP":[18],"is":[19,70,100],"the":[20,25,41,59,68,77,107,113,134],"Pareto":[21,143],"front.":[22],"Much":[23],"of":[24,79,106],"literature":[26],"approximates":[27],"this":[28,55],"front":[29,43,61,69,135,144],"via":[30],"scalarization":[31],"into":[32],"single-objective":[33],"MDPs.":[34],"Recent":[35],"work":[36],"has":[37],"begun":[38],"characterize":[40,58],"full":[42],"in":[44,62,94,117],"discounted":[45],"or":[46],"simple":[47],"bi-objective":[48],"settings":[49],"by":[50],"exploiting":[51],"its":[52,110],"geometry.":[53],"In":[54],"work,":[56],"we":[57],"exact":[60,142],"average-cost":[63],"MOMDPs.":[64],"We":[65,120],"show":[66],"that":[67],"a":[71,80,87,103,125,138],"continuous,":[72],"piecewise-linear":[73],"surface":[74],"lying":[75],"on":[76,133],"boundary":[78],"convex":[81,104],"polytope.":[82],"Each":[83,98],"vertex":[84,132],"corresponds":[85,136],"deterministic":[88],"policy,":[89],"adjacent":[91],"vertices":[92],"differ":[93],"exactly":[95],"one":[96],"state.":[97],"edge":[99],"realized":[101],"combination":[105],"policies":[108],"at":[109],"endpoints,":[111],"with":[112],"mixing":[114],"coefficient":[115],"given":[116],"closed":[118],"form.":[119],"apply":[121],"these":[122],"results":[123],"remote":[126],"state":[127],"estimation":[128],"problem,":[129],"where":[130],"each":[131],"threshold":[139],"policy.":[140],"solutions":[146],"certain":[148],"non-convex":[149],"MDPs":[150],"can":[151],"be":[152],"obtained":[153],"without":[154],"explicitly":[155],"solving":[156],"any":[157],"MDP.":[158]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-04-04T00:00:00"}
