{"id":"https://openalex.org/W7140283074","doi":"https://doi.org/10.48550/arxiv.2603.23113","title":"Fault-Tolerant Design and Multi-Objective Model Checking for Real-Time Deep Reinforcement Learning Systems","display_name":"Fault-Tolerant Design and Multi-Objective Model Checking for Real-Time Deep Reinforcement Learning Systems","publication_year":2026,"publication_date":"2026-03-24","ids":{"openalex":"https://openalex.org/W7140283074","doi":"https://doi.org/10.48550/arxiv.2603.23113"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2603.23113","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.23113","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2603.23113","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5060245971","display_name":"Guoxin Su","orcid":"https://orcid.org/0000-0002-2087-4894"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Su, Guoxin","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130613596","display_name":"Thomas Robinson","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Robinson, Thomas","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130554223","display_name":"Hoa Khanh Dam","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Dam, Hoa Khanh","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130592279","display_name":"Li Liu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Liu, Li","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5130553189","display_name":"David S. Rosenblum","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Rosenblum, David S.","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10142","display_name":"Formal Methods in Verification","score":0.7785999774932861,"subfield":{"id":"https://openalex.org/subfields/1703","display_name":"Computational Theory and Mathematics"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10142","display_name":"Formal Methods in Verification","score":0.7785999774932861,"subfield":{"id":"https://openalex.org/subfields/1703","display_name":"Computational Theory and Mathematics"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.08730000257492065,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12072","display_name":"Machine Learning and Algorithms","score":0.03889999911189079,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.6883999705314636},{"id":"https://openalex.org/keywords/model-checking","display_name":"Model checking","score":0.6845999956130981},{"id":"https://openalex.org/keywords/dependability","display_name":"Dependability","score":0.585099995136261},{"id":"https://openalex.org/keywords/markov-decision-process","display_name":"Markov decision process","score":0.5738000273704529},{"id":"https://openalex.org/keywords/scalability","display_name":"Scalability","score":0.5449000000953674},{"id":"https://openalex.org/keywords/formal-verification","display_name":"Formal verification","score":0.5206999778747559},{"id":"https://openalex.org/keywords/process","display_name":"Process (computing)","score":0.48820000886917114},{"id":"https://openalex.org/keywords/formal-methods","display_name":"Formal methods","score":0.46070000529289246},{"id":"https://openalex.org/keywords/automaton","display_name":"Automaton","score":0.44780001044273376}],"concepts":[{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.8062999844551086},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.6883999705314636},{"id":"https://openalex.org/C110251889","wikidata":"https://www.wikidata.org/wiki/Q1569697","display_name":"Model checking","level":2,"score":0.6845999956130981},{"id":"https://openalex.org/C77019957","wikidata":"https://www.wikidata.org/wiki/Q2689057","display_name":"Dependability","level":2,"score":0.585099995136261},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.5738000273704529},{"id":"https://openalex.org/C48044578","wikidata":"https://www.wikidata.org/wiki/Q727490","display_name":"Scalability","level":2,"score":0.5449000000953674},{"id":"https://openalex.org/C111498074","wikidata":"https://www.wikidata.org/wiki/Q173326","display_name":"Formal verification","level":2,"score":0.5206999778747559},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.490200012922287},{"id":"https://openalex.org/C98045186","wikidata":"https://www.wikidata.org/wiki/Q205663","display_name":"Process (computing)","level":2,"score":0.48820000886917114},{"id":"https://openalex.org/C75606506","wikidata":"https://www.wikidata.org/wiki/Q1049183","display_name":"Formal methods","level":2,"score":0.46070000529289246},{"id":"https://openalex.org/C112505250","wikidata":"https://www.wikidata.org/wiki/Q787116","display_name":"Automaton","level":2,"score":0.44780001044273376},{"id":"https://openalex.org/C115903868","wikidata":"https://www.wikidata.org/wiki/Q80993","display_name":"Software engineering","level":1,"score":0.38199999928474426},{"id":"https://openalex.org/C149091818","wikidata":"https://www.wikidata.org/wiki/Q2429814","display_name":"Software system","level":3,"score":0.36010000109672546},{"id":"https://openalex.org/C2779304628","wikidata":"https://www.wikidata.org/wiki/Q3503480","display_name":"Face (sociological concept)","level":2,"score":0.3569999933242798},{"id":"https://openalex.org/C2777904410","wikidata":"https://www.wikidata.org/wiki/Q7397","display_name":"Software","level":2,"score":0.35589998960494995},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.34119999408721924},{"id":"https://openalex.org/C31352089","wikidata":"https://www.wikidata.org/wiki/Q3750474","display_name":"Systems design","level":2,"score":0.3077000081539154},{"id":"https://openalex.org/C25016198","wikidata":"https://www.wikidata.org/wiki/Q781833","display_name":"Temporal logic","level":2,"score":0.3059999942779541},{"id":"https://openalex.org/C116248031","wikidata":"https://www.wikidata.org/wiki/Q214526","display_name":"Automata theory","level":3,"score":0.3009999990463257},{"id":"https://openalex.org/C159886148","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov process","level":2,"score":0.29679998755455017},{"id":"https://openalex.org/C124304363","wikidata":"https://www.wikidata.org/wiki/Q673661","display_name":"Abstraction","level":2,"score":0.2955000102519989},{"id":"https://openalex.org/C47822265","wikidata":"https://www.wikidata.org/wiki/Q854457","display_name":"Complex system","level":2,"score":0.2897000014781952},{"id":"https://openalex.org/C116253237","wikidata":"https://www.wikidata.org/wiki/Q1437424","display_name":"Formal specification","level":2,"score":0.28519999980926514},{"id":"https://openalex.org/C52913732","wikidata":"https://www.wikidata.org/wiki/Q857102","display_name":"Software design","level":4,"score":0.27630001306533813},{"id":"https://openalex.org/C80444323","wikidata":"https://www.wikidata.org/wiki/Q2878974","display_name":"Theoretical computer science","level":1,"score":0.27619999647140503},{"id":"https://openalex.org/C49937458","wikidata":"https://www.wikidata.org/wiki/Q2599292","display_name":"Probabilistic logic","level":2,"score":0.2538999915122986},{"id":"https://openalex.org/C108583219","wikidata":"https://www.wikidata.org/wiki/Q197536","display_name":"Deep learning","level":2,"score":0.25060001015663147}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2603.23113","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.23113","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2603.23113","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.23113","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"score":0.7933070659637451,"display_name":"Peace, Justice and strong institutions","id":"https://metadata.un.org/sdg/16"}],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Deep":[0],"reinforcement":[1],"learning":[2],"(DRL)":[3],"has":[4],"emerged":[5],"as":[6],"a":[7,78,111,121,148],"powerful":[8],"paradigm":[9],"for":[10,81,100,116,126,142],"solving":[11],"complex":[12],"decision-making":[13],"problems.":[14],"However,":[15],"DRL-based":[16],"systems":[17,57],"still":[18],"face":[19],"significant":[20],"dependability":[21],"challenges":[22],"particularly":[23],"in":[24,42,70,158],"real-time":[25,71,85],"environments":[26],"due":[27],"to":[28,46,55,61,110],"the":[29,35,131],"simulation-to-reality":[30],"gap,":[31],"out-of-distribution":[32],"observations,":[33],"and":[34,64,67,83,91,162],"critical":[36],"impact":[37],"of":[38,133],"latency.":[39],"Latency-induced":[40],"faults,":[41],"particular,":[43],"can":[44],"lead":[45],"unsafe":[47],"or":[48],"unstable":[49],"behaviour,":[50],"yet":[51],"existing":[52],"fault-tolerance":[53],"approaches":[54],"DRL":[56,89],"lack":[58],"formal":[59,79,117],"methods":[60],"rigorously":[62],"analyse":[63],"optimise":[65],"performance":[66,135],"safety":[68,140],"simultaneously":[69],"settings.":[72],"To":[73],"address":[74],"this,":[75],"we":[76,145],"propose":[77],"framework":[80],"designing":[82],"analysing":[84],"switching":[86],"mechanisms":[87],"between":[88],"agents":[90],"alternative":[92],"controllers.":[93],"Our":[94],"approach":[95],"leverages":[96],"Timed":[97],"Automata":[98],"(TAs)":[99],"explicit":[101],"switch":[102],"logic":[103],"design,":[104],"which":[105],"is":[106],"then":[107],"syntactically":[108],"converted":[109],"Markov":[112],"Decision":[113],"Process":[114],"(MDP)":[115],"analysis.":[118],"We":[119],"develop":[120],"novel":[122],"convex":[123],"query":[124],"technique":[125],"multi-objective":[127],"model":[128,160],"checking,":[129],"enabling":[130],"optimisation":[132],"soft":[134],"objectives":[136],"while":[137],"ensuring":[138],"hard":[139],"constraints":[141],"MDPs.":[143],"Furthermore,":[144],"present":[146],"MOPMC,":[147],"GPU-accelerated":[149],"software":[150],"tool":[151],"implementing":[152],"this":[153],"technique,":[154],"demonstrating":[155],"superior":[156],"scalability":[157],"both":[159],"size":[161],"objective":[163],"numbers.":[164]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-03-26T00:00:00"}
