{"id":"https://openalex.org/W7168240939","doi":"https://doi.org/10.48550/arxiv.2607.11624","title":"SKooP: Symmetric Koopman Predictions for Faster and More Generalizable Legged Robot Locomotion with Reinforcement Learning","display_name":"SKooP: Symmetric Koopman Predictions for Faster and More Generalizable Legged Robot Locomotion with Reinforcement Learning","publication_year":2026,"publication_date":"2026-07-13","ids":{"openalex":"https://openalex.org/W7168240939","doi":"https://doi.org/10.48550/arxiv.2607.11624"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2607.11624","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.11624","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2607.11624","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5140639470","display_name":"Evelyn D'Elia","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"D'Elia, Evelyn","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140703905","display_name":"Weishu Zhan","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zhan, Weishu","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140748987","display_name":"Giulio Turrisi","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Turrisi, Giulio","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140638207","display_name":"Giulio Romualdi","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Romualdi, Giulio","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140619678","display_name":"Giuseppe L'Erario","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"L'Erario, Giuseppe","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140642060","display_name":"Raffaello Camoriano","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Camoriano, Raffaello","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5140621616","display_name":"Wei Pan","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Pan, Wei","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5140718956","display_name":"Daniele Pucci","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Pucci, Daniele","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.6901999711990356,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.6901999711990356,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.08370000123977661,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10775","display_name":"Generative Adversarial Networks and Image Synthesis","score":0.051100000739097595,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.755299985408783},{"id":"https://openalex.org/keywords/benchmark","display_name":"Benchmark (surveying)","score":0.602400004863739},{"id":"https://openalex.org/keywords/robot","display_name":"Robot","score":0.5001000165939331},{"id":"https://openalex.org/keywords/autoencoder","display_name":"Autoencoder","score":0.47040000557899475},{"id":"https://openalex.org/keywords/legged-robot","display_name":"Legged robot","score":0.45210000872612},{"id":"https://openalex.org/keywords/sample","display_name":"Sample (material)","score":0.39980000257492065},{"id":"https://openalex.org/keywords/robotics","display_name":"Robotics","score":0.39579999446868896},{"id":"https://openalex.org/keywords/convergence","display_name":"Convergence (economics)","score":0.3865000009536743}],"concepts":[{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.755299985408783},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6302000284194946},{"id":"https://openalex.org/C185798385","wikidata":"https://www.wikidata.org/wiki/Q1161707","display_name":"Benchmark (surveying)","level":2,"score":0.602400004863739},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5906000137329102},{"id":"https://openalex.org/C90509273","wikidata":"https://www.wikidata.org/wiki/Q11012","display_name":"Robot","level":2,"score":0.5001000165939331},{"id":"https://openalex.org/C101738243","wikidata":"https://www.wikidata.org/wiki/Q786435","display_name":"Autoencoder","level":3,"score":0.47040000557899475},{"id":"https://openalex.org/C2779908020","wikidata":"https://www.wikidata.org/wiki/Q1424704","display_name":"Legged robot","level":3,"score":0.45210000872612},{"id":"https://openalex.org/C198531522","wikidata":"https://www.wikidata.org/wiki/Q485146","display_name":"Sample (material)","level":2,"score":0.39980000257492065},{"id":"https://openalex.org/C34413123","wikidata":"https://www.wikidata.org/wiki/Q170978","display_name":"Robotics","level":3,"score":0.39579999446868896},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.39309999346733093},{"id":"https://openalex.org/C2777303404","wikidata":"https://www.wikidata.org/wiki/Q759757","display_name":"Convergence (economics)","level":2,"score":0.3865000009536743},{"id":"https://openalex.org/C18762648","wikidata":"https://www.wikidata.org/wiki/Q42213","display_name":"Work (physics)","level":2,"score":0.37369999289512634},{"id":"https://openalex.org/C158622935","wikidata":"https://www.wikidata.org/wiki/Q660848","display_name":"Nonlinear system","level":2,"score":0.3635999858379364},{"id":"https://openalex.org/C112972136","wikidata":"https://www.wikidata.org/wiki/Q7595718","display_name":"Stability (learning theory)","level":2,"score":0.3183000087738037},{"id":"https://openalex.org/C13687954","wikidata":"https://www.wikidata.org/wiki/Q4826847","display_name":"Autonomous agent","level":2,"score":0.31450000405311584},{"id":"https://openalex.org/C177769412","wikidata":"https://www.wikidata.org/wiki/Q278090","display_name":"Prior probability","level":3,"score":0.31189998984336853},{"id":"https://openalex.org/C118505674","wikidata":"https://www.wikidata.org/wiki/Q42586063","display_name":"Encoder","level":2,"score":0.30219998955726624},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.29760000109672546},{"id":"https://openalex.org/C171036898","wikidata":"https://www.wikidata.org/wiki/Q256355","display_name":"Equivariant map","level":2,"score":0.28700000047683716},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.27059999108314514},{"id":"https://openalex.org/C2780586882","wikidata":"https://www.wikidata.org/wiki/Q7520643","display_name":"Simple (philosophy)","level":2,"score":0.26019999384880066},{"id":"https://openalex.org/C67203356","wikidata":"https://www.wikidata.org/wiki/Q1321905","display_name":"Reinforcement","level":2,"score":0.2529999911785126},{"id":"https://openalex.org/C77405623","wikidata":"https://www.wikidata.org/wiki/Q598451","display_name":"System dynamics","level":2,"score":0.25130000710487366}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2607.11624","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.11624","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2607.11624","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.11624","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Reinforcement":[0],"learning":[1,28],"(RL)":[2],"algorithms":[3],"classically":[4],"suffer":[5],"from":[6],"poor":[7],"sample":[8],"efficiency.":[9],"In":[10,50],"robotics,":[11],"a":[12,70,82,130,194],"recent":[13],"line":[14],"of":[15,32,64,69,85,142,154],"work":[16],"has":[17],"emerged":[18],"addressing":[19],"this":[20,51],"problem":[21],"by":[22],"encoding":[23],"physics":[24],"priors":[25],"in":[26],"the":[27,62,86,90,102,105,121,143,157,164,184],"process.":[29],"However,":[30],"most":[31],"these":[33,155],"approaches":[34],"are":[35,96,167],"validated":[36,138],"on":[37,110,193],"well-defined,":[38],"low-dimensional":[39],"benchmark":[40],"systems":[41],"rather":[42],"than":[43],"high-dimensional":[44],"robots":[45],"with":[46,67],"complex":[47],"nonlinear":[48],"dynamics.":[49],"paper,":[52],"we":[53],"introduce":[54],"\\textit{SKooP":[55],"(Symmetric":[56],"Koopman":[57,71,83,94,145],"Predictions)},":[58],"an":[59],"approach":[60,136],"combining":[61],"advantages":[63],"morphological":[65],"symmetries":[66,119],"those":[68],"model":[72,84],"learned":[73,144,165,185],"via":[74,139],"autoencoder":[75],"to":[76,107,128,150,169],"enhance":[77],"policy":[78],"learning.":[79],"SKooP":[80,135,177],"learns":[81],"system":[87],"dynamics":[88],"alongside":[89],"policy.":[91,133],"The":[92,134],"resulting":[93],"predictions":[95],"used":[97],"as":[98],"privileged":[99],"observations":[100],"for":[101,187],"critic,":[103,123],"allowing":[104],"agent":[106],"learn":[108],"based":[109],"smoother,":[111],"more":[112],"informative":[113],"features.":[114],"We":[115,160],"also":[116,161],"incorporate":[117],"group":[118],"into":[120],"actor,":[122],"encoder":[124],"and":[125,147,182],"decoder":[126],"networks":[127],"produce":[129],"highly":[131],"equivariant":[132],"is":[137],"in-depth":[140],"analysis":[141],"models":[146],"symmetric":[148],"policies":[149,166],"showcase":[151],"how":[152],"each":[153],"influences":[156],"agent's":[158],"performance.":[159],"show":[162,175],"that":[163,176],"transferable":[168],"different":[170],"simulation":[171],"environments.":[172],"Our":[173],"results":[174],"consistently":[178],"reduces":[179],"convergence":[180],"time":[181],"increases":[183],"reward":[186],"multiple":[188],"challenging":[189],"bipedal":[190],"locomotion":[191],"tasks":[192],"quadruped":[195],"robot.":[196],"Project":[197],"page:":[198],"https://evelyd.github.io/SymmetricKoopmanPredictions":[199]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-07-15T00:00:00"}
