{"id":"https://openalex.org/W7133650430","doi":"https://doi.org/10.48550/arxiv.2603.03768","title":"Cognition to Control - Multi-Agent Learning for Human-Humanoid Collaborative Transport","display_name":"Cognition to Control - Multi-Agent Learning for Human-Humanoid Collaborative Transport","publication_year":2026,"publication_date":"2026-03-04","ids":{"openalex":"https://openalex.org/W7133650430","doi":"https://doi.org/10.48550/arxiv.2603.03768"},"language":null,"primary_location":{"id":"pmh:doi:10.48550/arxiv.2603.03768","is_oa":true,"landing_page_url":null,"pdf_url":null,"source":{"id":"https://openalex.org/S4406922384","display_name":"Open MIND","issn_l":null,"issn":null,"is_oa":false,"is_in_doaj":false,"is_core":false,"host_organization":null,"host_organization_name":null,"host_organization_lineage":[],"host_organization_lineage_names":[],"type":"repository"},"license":"publisher-specific-oa","license_id":"https://openalex.org/licenses/publisher-specific-oa","version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Article"},"type":"article","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":null,"any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5128142252","display_name":"Hao F. Zhang","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zhang, Hao","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5128201082","display_name":"Ding Zhao","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zhao, Ding","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5128215626","display_name":"H. Eric Tseng","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Tseng, H. Eric","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":0.0,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":{"value":0.23859178,"is_in_top_1_percent":false,"is_in_top_10_percent":false},"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.4788999855518341,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10653","display_name":"Robot Manipulation and Learning","score":0.4788999855518341,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10709","display_name":"Social Robot Interaction and HRI","score":0.2093999981880188,"subfield":{"id":"https://openalex.org/subfields/3207","display_name":"Social Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T11431","display_name":"Action Observation and Synchronization","score":0.09769999980926514,"subfield":{"id":"https://openalex.org/subfields/3207","display_name":"Social Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/deliberation","display_name":"Deliberation","score":0.6481000185012817},{"id":"https://openalex.org/keywords/task","display_name":"Task (project management)","score":0.5530999898910522},{"id":"https://openalex.org/keywords/cognition","display_name":"Cognition","score":0.4706000089645386},{"id":"https://openalex.org/keywords/control","display_name":"Control (management)","score":0.4683000147342682},{"id":"https://openalex.org/keywords/robustness","display_name":"Robustness (evolution)","score":0.44600000977516174},{"id":"https://openalex.org/keywords/hierarchy","display_name":"Hierarchy","score":0.4327999949455261},{"id":"https://openalex.org/keywords/task-analysis","display_name":"Task analysis","score":0.40049999952316284},{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.3939000070095062}],"concepts":[{"id":"https://openalex.org/C2776946740","wikidata":"https://www.wikidata.org/wiki/Q358652","display_name":"Deliberation","level":3,"score":0.6481000185012817},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6136999726295471},{"id":"https://openalex.org/C2780451532","wikidata":"https://www.wikidata.org/wiki/Q759676","display_name":"Task (project management)","level":2,"score":0.5530999898910522},{"id":"https://openalex.org/C107457646","wikidata":"https://www.wikidata.org/wiki/Q207434","display_name":"Human\u2013computer interaction","level":1,"score":0.49309998750686646},{"id":"https://openalex.org/C169900460","wikidata":"https://www.wikidata.org/wiki/Q2200417","display_name":"Cognition","level":2,"score":0.4706000089645386},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.4683000147342682},{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.44600000977516174},{"id":"https://openalex.org/C31170391","wikidata":"https://www.wikidata.org/wiki/Q188619","display_name":"Hierarchy","level":2,"score":0.4327999949455261},{"id":"https://openalex.org/C175154964","wikidata":"https://www.wikidata.org/wiki/Q380077","display_name":"Task analysis","level":3,"score":0.40049999952316284},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.3939000070095062},{"id":"https://openalex.org/C55439883","wikidata":"https://www.wikidata.org/wiki/Q360812","display_name":"Correctness","level":2,"score":0.35030001401901245},{"id":"https://openalex.org/C107257861","wikidata":"https://www.wikidata.org/wiki/Q656316","display_name":"Coordination game","level":2,"score":0.3472000062465668},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.3456999957561493},{"id":"https://openalex.org/C2779227376","wikidata":"https://www.wikidata.org/wiki/Q6505497","display_name":"Layer (electronics)","level":2,"score":0.32690000534057617},{"id":"https://openalex.org/C138020889","wikidata":"https://www.wikidata.org/wiki/Q2349659","display_name":"Collaborative learning","level":2,"score":0.3237000107765198},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.31679999828338623},{"id":"https://openalex.org/C159886148","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov process","level":2,"score":0.3138999938964844},{"id":"https://openalex.org/C93500599","wikidata":"https://www.wikidata.org/wiki/Q7687352","display_name":"Task switching","level":3,"score":0.30489999055862427},{"id":"https://openalex.org/C180747234","wikidata":"https://www.wikidata.org/wiki/Q23373","display_name":"Cognitive psychology","level":1,"score":0.29989999532699585},{"id":"https://openalex.org/C2780598303","wikidata":"https://www.wikidata.org/wiki/Q65921492","display_name":"Flexibility (engineering)","level":2,"score":0.2881999909877777},{"id":"https://openalex.org/C17500928","wikidata":"https://www.wikidata.org/wiki/Q959968","display_name":"Control system","level":2,"score":0.27079999446868896},{"id":"https://openalex.org/C98763669","wikidata":"https://www.wikidata.org/wiki/Q176645","display_name":"Markov chain","level":2,"score":0.25270000100135803}],"mesh":[],"locations_count":2,"locations":[{"id":"pmh:doi:10.48550/arxiv.2603.03768","is_oa":true,"landing_page_url":null,"pdf_url":null,"source":{"id":"https://openalex.org/S4406922384","display_name":"Open MIND","issn_l":null,"issn":null,"is_oa":false,"is_in_doaj":false,"is_core":false,"host_organization":null,"host_organization_name":null,"host_organization_lineage":[],"host_organization_lineage_names":[],"type":"repository"},"license":"publisher-specific-oa","license_id":"https://openalex.org/licenses/publisher-specific-oa","version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Article"},{"id":"doi:10.48550/arxiv.2603.03768","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.03768","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"pmh:doi:10.48550/arxiv.2603.03768","is_oa":true,"landing_page_url":null,"pdf_url":null,"source":{"id":"https://openalex.org/S4406922384","display_name":"Open MIND","issn_l":null,"issn":null,"is_oa":false,"is_in_doaj":false,"is_core":false,"host_organization":null,"host_organization_name":null,"host_organization_lineage":[],"host_organization_lineage_names":[],"type":"repository"},"license":"publisher-specific-oa","license_id":"https://openalex.org/licenses/publisher-specific-oa","version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Article"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Effective":[0],"human-robot":[1,123],"collaboration":[2],"(HRC)":[3],"requires":[4],"translating":[5],"high-level":[6],"intent":[7],"into":[8],"contact-stable":[9],"whole-body":[10,144],"motion":[11],"while":[12,155],"continuously":[13],"adapting":[14],"to":[15,30,172],"a":[16,85,95,109,130,135,143,168,173],"human":[17],"partner.":[18],"Many":[19],"vision-language-action":[20],"(VLA)":[21],"systems":[22],"learn":[23],"end-to-end":[24,196],"mappings":[25],"from":[26],"observations":[27],"and":[28,40,67,75,104,120,141,159,191,195,201],"instructions":[29],"actions,":[31],"but":[32],"they":[33],"often":[34],"emphasize":[35],"reactive":[36],"(System":[37],"1-like)":[38],"behavior":[39],"leave":[41],"under-specified":[42],"how":[43],"sustained":[44],"System":[45,113],"2-style":[46],"deliberation":[47],"can":[48],"be":[49],"integrated":[50],"with":[51,82,134,198],"reliable,":[52],"low-latency":[53],"continuous":[54],"control.":[55],"This":[56],"gap":[57],"is":[58,165],"acute":[59],"in":[60],"multi-agent":[61],"HRC,":[62],"where":[63],"long-horizon":[64,117],"coordination":[65,200],"decisions":[66],"physical":[68],"execution":[69],"must":[70],"co-evolve":[71],"under":[72,122],"contact,":[73],"feasibility,":[74],"safety":[76],"constraints.":[77],"We":[78],"address":[79],"this":[80],"limitation":[81],"cognition-to-control":[83],"(C2C),":[84],"three-layer":[86],"hierarchy":[87],"that":[88,99,147],"makes":[89],"the":[90,149],"deliberation-to-control":[91],"pathway":[92],"explicit:":[93],"(i)":[94],"VLM-based":[96],"grounding":[97],"layer":[98,146,164],"maintains":[100],"persistent":[101],"scene":[102],"referents":[103],"infers":[105],"embodiment-aware":[106],"affordances/constraints;":[107],"(ii)":[108],"deliberative":[110,163],"skill/coordination":[111],"layer-the":[112],"2":[114],"core-that":[115],"optimizes":[116],"skill":[118],"choices":[119],"sequences":[121],"coupling":[124],"via":[125],"decentralized":[126],"MARL":[127],"cast":[128],"as":[129,167],"Markov":[131],"potential":[132,137],"game":[133],"shared":[136],"encoding":[138],"task":[139],"progress;":[140],"(iii)":[142],"control":[145],"executes":[148],"selected":[150],"skills":[151],"at":[152],"high":[153],"frequency":[154],"enforcing":[156],"kinematic/dynamic":[157],"feasibility":[158],"contact":[160],"stability.":[161],"The":[162],"realized":[166],"residual":[169],"policy":[170],"relative":[171],"nominal":[174],"controller,":[175],"internalizing":[176],"partner":[177],"dynamics":[178],"without":[179],"explicit":[180],"role":[181],"assignment.":[182],"Experiments":[183],"on":[184],"collaborative":[185],"manipulation":[186],"tasks":[187],"show":[188],"higher":[189],"success":[190],"robustness":[192],"than":[193],"single-agent":[194],"baselines,":[197],"stable":[199],"emergent":[202],"leader-follower":[203],"behaviors.":[204]},"counts_by_year":[],"updated_date":"2026-07-15T18:14:33.161393","created_date":"2026-03-06T00:00:00"}
