{"id":"https://openalex.org/W7160281548","doi":"https://doi.org/10.48550/arxiv.2605.01201","title":"To Do or Not to Do: Ensuring the Safety of Visuomotor Policies Learned from Demonstrations","display_name":"To Do or Not to Do: Ensuring the Safety of Visuomotor Policies Learned from Demonstrations","publication_year":2026,"publication_date":"2026-05-02","ids":{"openalex":"https://openalex.org/W7160281548","doi":"https://doi.org/10.48550/arxiv.2605.01201"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2605.01201","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.01201","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2605.01201","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5135296735","display_name":"Riad Ahmed","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Ahmed, Riad","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5121090398","display_name":"Moniruzzaman Akash","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Akash, Moniruzzaman","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5035462171","display_name":"Momotaz Begum","orcid":"https://orcid.org/0000-0002-1073-2008"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Begum, Momotaz","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.614300012588501,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.614300012588501,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.25429999828338623,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10982","display_name":"Motor Control and Adaptation","score":0.04879999905824661,"subfield":{"id":"https://openalex.org/subfields/2805","display_name":"Cognitive Neuroscience"},"field":{"id":"https://openalex.org/fields/28","display_name":"Neuroscience"},"domain":{"id":"https://openalex.org/domains/1","display_name":"Life Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/operationalization","display_name":"Operationalization","score":0.7192000150680542},{"id":"https://openalex.org/keywords/leverage","display_name":"Leverage (statistics)","score":0.5806000232696533},{"id":"https://openalex.org/keywords/robotics","display_name":"Robotics","score":0.5195000171661377},{"id":"https://openalex.org/keywords/task","display_name":"Task (project management)","score":0.4964999854564667},{"id":"https://openalex.org/keywords/robot","display_name":"Robot","score":0.4553000032901764},{"id":"https://openalex.org/keywords/set","display_name":"Set (abstract data type)","score":0.399399995803833},{"id":"https://openalex.org/keywords/field","display_name":"Field (mathematics)","score":0.38769999146461487},{"id":"https://openalex.org/keywords/domain","display_name":"Domain (mathematical analysis)","score":0.36739999055862427}],"concepts":[{"id":"https://openalex.org/C9354725","wikidata":"https://www.wikidata.org/wiki/Q286017","display_name":"Operationalization","level":2,"score":0.7192000150680542},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.5893999934196472},{"id":"https://openalex.org/C153083717","wikidata":"https://www.wikidata.org/wiki/Q6535263","display_name":"Leverage (statistics)","level":2,"score":0.5806000232696533},{"id":"https://openalex.org/C34413123","wikidata":"https://www.wikidata.org/wiki/Q170978","display_name":"Robotics","level":3,"score":0.5195000171661377},{"id":"https://openalex.org/C2780451532","wikidata":"https://www.wikidata.org/wiki/Q759676","display_name":"Task (project management)","level":2,"score":0.4964999854564667},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.4634000062942505},{"id":"https://openalex.org/C90509273","wikidata":"https://www.wikidata.org/wiki/Q11012","display_name":"Robot","level":2,"score":0.4553000032901764},{"id":"https://openalex.org/C177264268","wikidata":"https://www.wikidata.org/wiki/Q1514741","display_name":"Set (abstract data type)","level":2,"score":0.399399995803833},{"id":"https://openalex.org/C9652623","wikidata":"https://www.wikidata.org/wiki/Q190109","display_name":"Field (mathematics)","level":2,"score":0.38769999146461487},{"id":"https://openalex.org/C36503486","wikidata":"https://www.wikidata.org/wiki/Q11235244","display_name":"Domain (mathematical analysis)","level":2,"score":0.36739999055862427},{"id":"https://openalex.org/C48103436","wikidata":"https://www.wikidata.org/wiki/Q599031","display_name":"State (computer science)","level":2,"score":0.3555999994277954},{"id":"https://openalex.org/C112930515","wikidata":"https://www.wikidata.org/wiki/Q4389547","display_name":"Risk analysis (engineering)","level":1,"score":0.3467000126838684},{"id":"https://openalex.org/C2780009758","wikidata":"https://www.wikidata.org/wiki/Q6804172","display_name":"Measure (data warehouse)","level":2,"score":0.33629998564720154},{"id":"https://openalex.org/C72434380","wikidata":"https://www.wikidata.org/wiki/Q230930","display_name":"State space","level":2,"score":0.33079999685287476},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.30489999055862427},{"id":"https://openalex.org/C126388530","wikidata":"https://www.wikidata.org/wiki/Q1131737","display_name":"Imitation","level":2,"score":0.2985000014305115},{"id":"https://openalex.org/C107457646","wikidata":"https://www.wikidata.org/wiki/Q207434","display_name":"Human\u2013computer interaction","level":1,"score":0.29829999804496765},{"id":"https://openalex.org/C132835097","wikidata":"https://www.wikidata.org/wiki/Q7663745","display_name":"System safety","level":2,"score":0.2944999933242798},{"id":"https://openalex.org/C175154964","wikidata":"https://www.wikidata.org/wiki/Q380077","display_name":"Task analysis","level":3,"score":0.29179999232292175},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.26030001044273376},{"id":"https://openalex.org/C38652104","wikidata":"https://www.wikidata.org/wiki/Q3510521","display_name":"Computer security","level":1,"score":0.2565999925136566},{"id":"https://openalex.org/C127413603","wikidata":"https://www.wikidata.org/wiki/Q11023","display_name":"Engineering","level":0,"score":0.25609999895095825},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.25429999828338623}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2605.01201","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.01201","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2605.01201","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.01201","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Task":[0],"success":[1,149,236],"has":[2],"historically":[3],"been":[4],"the":[5,20,49,64,121,129,146,165,180,224,254,263,269],"primary":[6],"measure":[7,143],"of":[8,23,37,98,133,253],"policy":[9,83,186,249,264],"performance":[10,75,132,265],"in":[11,26,32,48,79,90,100,120,164,172,179,217,272],"imitation":[12],"learning":[13],"(IL)":[14],"research.":[15,92],"This":[16,123],"characteristics":[17],"strictly":[18],"limits":[19],"ubiquitous":[21],"applications":[22],"IL":[24,91,134,153,185,230],"algorithms":[25],"field":[27,50],"robotics":[28],"where":[29],"safety":[30,65,73,84,99,111,130,142,226,256],"assurance,":[31],"addition":[33],"to":[34,52,115,117,175,201,232,261],"task-success,":[35],"is":[36,41,66,76,85,94,112],"paramount":[38],"importance.":[39],"It":[40],"often":[42],"desirable":[43],"for":[44,150,183],"an":[45,184],"IL-powered":[46,118],"robot":[47],"not":[51,67],"roll":[53],"out":[54],"a":[55,60,86,140,151,161,189,213,247,251],"policy,":[56,154],"and":[57,74,131,187,203,219,266],"hence":[58],"score":[59],"poor":[61],"performance,":[62],"if":[63],"guaranteed.":[68],"Although":[69],"this":[70],"trade-off":[71],"between":[72],"well":[77],"investigated":[78],"classical":[80],"control":[81],"literature,":[82],"heavily":[87],"underexplored":[88],"domain":[89],"There":[93],"no":[95],"universal":[96],"definition":[97],"IL.":[101,273],"To":[102],"make":[103],"things":[104],"worst,":[105],"many":[106],"existing":[107],"theoretical":[108],"works":[109],"on":[110,128,192,245],"notoriously":[113],"difficult":[114],"extend":[116],"robots":[119],"field.":[122],"paper":[124],"offers":[125],"important":[126],"insights":[127],"policies.":[135],"We":[136,168,239],"propose":[137],"execution":[138,205],"guarantee,":[139],"policy-agnostic":[141],"that":[144,209],"guarantees":[145],"maximum":[147,234],"task":[148,235],"visuomotor":[152],"despite":[155],"minor":[156],"run-time":[157],"changes,":[158],"from":[159,207],"within":[160],"specific":[162],"region":[163],"state":[166,181],"space.":[167],"leverage":[169],"recent":[170],"advances":[171],"view":[173],"synthesis":[174],"identify":[176],"such":[177],"regions":[178],"space":[182],"explore":[188],"fundamental":[190],"result":[191],"set":[193],"invariance":[194],"-":[195,200,250,258],"namely,":[196],"Nagumo's":[197],"sub-tangentiality":[198],"condition":[199],"prove":[202],"operationalize":[204],"guarantee":[206],"inside":[208],"region.":[210],"Experiments":[211],"with":[212,237],"Franka":[214],"robot,":[215],"both":[216],"simulation":[218],"real":[220],"world,":[221],"demonstrate":[222,241],"how":[223,246],"proposed":[225,255],"analysis":[227,257],"allows":[228],"various":[229],"policies":[231],"achieve":[233],"guarantee.":[238],"also":[240],"some":[242],"interesting":[243],"results":[244],"recovery":[248],"by-product":[252],"can":[259],"help":[260],"increase":[262],"thereby":[267],"mitigating":[268],"safety-performance":[270],"tradeoff":[271]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-05-06T00:00:00"}
