{"id":"https://openalex.org/W7130363454","doi":"https://doi.org/10.48550/arxiv.2602.15351","title":"Feasibility-aware Imitation Learning from Observation with Multimodal Feedback","display_name":"Feasibility-aware Imitation Learning from Observation with Multimodal Feedback","publication_year":2026,"publication_date":"2026-02-17","ids":{"openalex":"https://openalex.org/W7130363454","doi":"https://doi.org/10.48550/arxiv.2602.15351"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2602.15351","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2602.15351","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2602.15351","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5126356066","display_name":"Kei Takahashi","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Takahashi, Kei","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5126337381","display_name":"Hikaru Sasaki","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Sasaki, Hikaru","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5126344609","display_name":"Takamitsu Matsubara","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Matsubara, Takamitsu","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.8680999875068665,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.8680999875068665,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.04919999837875366,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10709","display_name":"Social Robot Interaction and HRI","score":0.019999999552965164,"subfield":{"id":"https://openalex.org/subfields/3207","display_name":"Social Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/imitation","display_name":"Imitation","score":0.6751999855041504},{"id":"https://openalex.org/keywords/haptic-technology","display_name":"Haptic technology","score":0.6710000038146973},{"id":"https://openalex.org/keywords/robot","display_name":"Robot","score":0.6610000133514404},{"id":"https://openalex.org/keywords/robot-learning","display_name":"Robot learning","score":0.4422000050544739},{"id":"https://openalex.org/keywords/control","display_name":"Control (management)","score":0.41440001130104065},{"id":"https://openalex.org/keywords/human\u2013robot-interaction","display_name":"Human\u2013robot interaction","score":0.38690000772476196},{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.3652999997138977},{"id":"https://openalex.org/keywords/robotics","display_name":"Robotics","score":0.3158000111579895}],"concepts":[{"id":"https://openalex.org/C126388530","wikidata":"https://www.wikidata.org/wiki/Q1131737","display_name":"Imitation","level":2,"score":0.6751999855041504},{"id":"https://openalex.org/C152086174","wikidata":"https://www.wikidata.org/wiki/Q3030571","display_name":"Haptic technology","level":2,"score":0.6710000038146973},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6643999814987183},{"id":"https://openalex.org/C90509273","wikidata":"https://www.wikidata.org/wiki/Q11012","display_name":"Robot","level":2,"score":0.6610000133514404},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5536999702453613},{"id":"https://openalex.org/C107457646","wikidata":"https://www.wikidata.org/wiki/Q207434","display_name":"Human\u2013computer interaction","level":1,"score":0.4876999855041504},{"id":"https://openalex.org/C188888258","wikidata":"https://www.wikidata.org/wiki/Q7353390","display_name":"Robot learning","level":4,"score":0.4422000050544739},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.41440001130104065},{"id":"https://openalex.org/C145460709","wikidata":"https://www.wikidata.org/wiki/Q859951","display_name":"Human\u2013robot interaction","level":3,"score":0.38690000772476196},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.3652999997138977},{"id":"https://openalex.org/C34413123","wikidata":"https://www.wikidata.org/wiki/Q170978","display_name":"Robotics","level":3,"score":0.3158000111579895},{"id":"https://openalex.org/C2779436431","wikidata":"https://www.wikidata.org/wiki/Q30672407","display_name":"Policy learning","level":2,"score":0.31470000743865967},{"id":"https://openalex.org/C121050878","wikidata":"https://www.wikidata.org/wiki/Q5135020","display_name":"Cloning (programming)","level":2,"score":0.3075000047683716},{"id":"https://openalex.org/C3020716817","wikidata":"https://www.wikidata.org/wiki/Q4132092","display_name":"Visual feedback","level":2,"score":0.304500013589859},{"id":"https://openalex.org/C2780791683","wikidata":"https://www.wikidata.org/wiki/Q846785","display_name":"Action (physics)","level":2,"score":0.296099990606308},{"id":"https://openalex.org/C13662910","wikidata":"https://www.wikidata.org/wiki/Q193139","display_name":"Trajectory","level":2,"score":0.27970001101493835},{"id":"https://openalex.org/C175154964","wikidata":"https://www.wikidata.org/wiki/Q380077","display_name":"Task analysis","level":3,"score":0.27790001034736633},{"id":"https://openalex.org/C112972136","wikidata":"https://www.wikidata.org/wiki/Q7595718","display_name":"Stability (learning theory)","level":2,"score":0.26829999685287476},{"id":"https://openalex.org/C31972630","wikidata":"https://www.wikidata.org/wiki/Q844240","display_name":"Computer vision","level":1,"score":0.2671000063419342},{"id":"https://openalex.org/C77967617","wikidata":"https://www.wikidata.org/wiki/Q4677561","display_name":"Active learning (machine learning)","level":2,"score":0.2660999894142151},{"id":"https://openalex.org/C65401140","wikidata":"https://www.wikidata.org/wiki/Q7353385","display_name":"Robot control","level":4,"score":0.25699999928474426},{"id":"https://openalex.org/C34585555","wikidata":"https://www.wikidata.org/wiki/Q1368723","display_name":"Learning curve","level":2,"score":0.2506999969482422}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2602.15351","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2602.15351","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2602.15351","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2602.15351","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"display_name":"Peace, Justice and strong institutions","id":"https://metadata.un.org/sdg/16","score":0.4662814736366272}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Imitation":[0],"learning":[1,58,124,152,166,189],"frameworks":[2],"that":[3,159,169,185],"learn":[4,131],"robot":[5,42,79,82],"control":[6],"policies":[7,168],"from":[8,68,75,101],"demonstrators'":[9],"motions":[10,48,93,129,158],"via":[11],"hand-mounted":[12],"demonstration":[13,37],"interfaces":[14],"have":[15],"attracted":[16],"increasing":[17],"attention.":[18],"However,":[19],"due":[20],"to":[21,106,125,145,197],"differences":[22],"in":[23],"physical":[24],"characteristics":[25],"between":[26],"demonstrators":[27],"and":[28,44,121,130,142,183],"robots,":[29,163],"this":[30],"approach":[31],"faces":[32],"two":[33,181],"limitations:":[34],"i)":[35],"the":[36,46,91,102,110,127,139,154,165,198],"data":[38],"do":[39],"not":[40],"include":[41],"actions,":[43],"ii)":[45],"demonstrated":[47,92,148,157],"may":[49],"be":[50],"infeasible":[51,161],"for":[52,118,162],"robots.":[53],"These":[54],"limitations":[55],"make":[56],"policy":[57,123,151],"difficult.":[59],"To":[60],"address":[61],"them,":[62],"we":[63],"propose":[64],"Feasibility-Aware":[65],"Behavior":[66],"Cloning":[67],"Observation":[69],"(FABCO).":[70],"FABCO":[71,186],"integrates":[72],"behavior":[73],"cloning":[74],"observation,":[76],"which":[77],"complements":[78],"actions":[80],"using":[81,96],"dynamics":[83],"models,":[84],"with":[85,177],"feasibility":[86,89,115,137,201],"estimation.":[87],"In":[88],"estimation,":[90],"are":[94,160],"evaluated":[95],"a":[97],"robot-dynamics":[98],"model,":[99],"learned":[100],"robot's":[103,111],"execution":[104],"data,":[105],"assess":[107],"reproducibility":[108],"under":[109],"dynamics.":[112],"The":[113],"estimated":[114],"is":[116],"used":[117],"multimodal":[119],"feedback":[120,135],"feasibility-aware":[122],"improve":[126],"demonstrator's":[128,140],"robust":[132],"policies.":[133],"Multimodal":[134],"provides":[136],"through":[138],"visual":[141],"haptic":[143],"senses":[144],"promote":[146],"feasible":[147],"motions.":[149],"Feasibility-aware":[150],"reduces":[153],"influence":[155],"of":[156,167],"enabling":[164],"robots":[170],"can":[171],"execute":[172],"stably.":[173],"We":[174],"conducted":[175],"experiments":[176],"15":[178],"participants":[179],"on":[180],"tasks":[182],"confirmed":[184],"improves":[187],"imitation":[188],"performance":[190],"by":[191],"more":[192],"than":[193],"3.2":[194],"times":[195],"compared":[196],"case":[199],"without":[200],"feedback.":[202]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-02-19T00:00:00"}
