{"id":"https://openalex.org/W7148645210","doi":"https://doi.org/10.48550/arxiv.2604.01539","title":"Toward Single-Step MPPI via Differentiable Predictive Control","display_name":"Toward Single-Step MPPI via Differentiable Predictive Control","publication_year":2026,"publication_date":"2026-04-02","ids":{"openalex":"https://openalex.org/W7148645210","doi":"https://doi.org/10.48550/arxiv.2604.01539"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2604.01539","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.01539","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2604.01539","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5065617320","display_name":"Viet-Anh Le","orcid":"https://orcid.org/0000-0002-9829-7150"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Le, Viet-Anh","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5132862940","display_name":"Renukanandan Tumu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Tumu, Renukanandan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5132859567","display_name":"Rahul Mangharam","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Mangharam, Rahul","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10791","display_name":"Advanced Control Systems Optimization","score":0.7303000092506409,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10791","display_name":"Advanced Control Systems Optimization","score":0.7303000092506409,"subfield":{"id":"https://openalex.org/subfields/2207","display_name":"Control and Systems Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.027499999850988388,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11612","display_name":"Stochastic Gradient Optimization Techniques","score":0.02539999969303608,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/model-predictive-control","display_name":"Model predictive control","score":0.507099986076355},{"id":"https://openalex.org/keywords/artificial-neural-network","display_name":"Artificial neural network","score":0.5041000247001648},{"id":"https://openalex.org/keywords/minification","display_name":"Minification","score":0.49619999527931213},{"id":"https://openalex.org/keywords/curse-of-dimensionality","display_name":"Curse of dimensionality","score":0.48350000381469727},{"id":"https://openalex.org/keywords/key","display_name":"Key (lock)","score":0.4471000134944916},{"id":"https://openalex.org/keywords/constraint","display_name":"Constraint (computer-aided design)","score":0.40939998626708984},{"id":"https://openalex.org/keywords/sampling","display_name":"Sampling (signal processing)","score":0.3986999988555908},{"id":"https://openalex.org/keywords/embedding","display_name":"Embedding","score":0.382999986410141}],"concepts":[{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.5658000111579895},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.5245000123977661},{"id":"https://openalex.org/C172205157","wikidata":"https://www.wikidata.org/wiki/Q1782962","display_name":"Model predictive control","level":3,"score":0.507099986076355},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.5041000247001648},{"id":"https://openalex.org/C147764199","wikidata":"https://www.wikidata.org/wiki/Q6865248","display_name":"Minification","level":2,"score":0.49619999527931213},{"id":"https://openalex.org/C111030470","wikidata":"https://www.wikidata.org/wiki/Q1430460","display_name":"Curse of dimensionality","level":2,"score":0.48350000381469727},{"id":"https://openalex.org/C26517878","wikidata":"https://www.wikidata.org/wiki/Q228039","display_name":"Key (lock)","level":2,"score":0.4471000134944916},{"id":"https://openalex.org/C2776036281","wikidata":"https://www.wikidata.org/wiki/Q48769818","display_name":"Constraint (computer-aided design)","level":2,"score":0.40939998626708984},{"id":"https://openalex.org/C140779682","wikidata":"https://www.wikidata.org/wiki/Q210868","display_name":"Sampling (signal processing)","level":3,"score":0.3986999988555908},{"id":"https://openalex.org/C41608201","wikidata":"https://www.wikidata.org/wiki/Q980509","display_name":"Embedding","level":2,"score":0.382999986410141},{"id":"https://openalex.org/C178650346","wikidata":"https://www.wikidata.org/wiki/Q201984","display_name":"Covariance","level":2,"score":0.3646000027656555},{"id":"https://openalex.org/C202615002","wikidata":"https://www.wikidata.org/wiki/Q783507","display_name":"Differentiable function","level":2,"score":0.3578999936580658},{"id":"https://openalex.org/C52740198","wikidata":"https://www.wikidata.org/wiki/Q1539564","display_name":"Importance sampling","level":3,"score":0.35010001063346863},{"id":"https://openalex.org/C2776135515","wikidata":"https://www.wikidata.org/wiki/Q17143721","display_name":"Regularization (linguistics)","level":2,"score":0.34790000319480896},{"id":"https://openalex.org/C91575142","wikidata":"https://www.wikidata.org/wiki/Q1971426","display_name":"Optimal control","level":2,"score":0.3294000029563904},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.32339999079704285},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.3231000006198883},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.3192000091075897},{"id":"https://openalex.org/C13662910","wikidata":"https://www.wikidata.org/wiki/Q193139","display_name":"Trajectory","level":2,"score":0.3125},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.30480000376701355},{"id":"https://openalex.org/C198531522","wikidata":"https://www.wikidata.org/wiki/Q485146","display_name":"Sample (material)","level":2,"score":0.29649999737739563},{"id":"https://openalex.org/C2776401178","wikidata":"https://www.wikidata.org/wiki/Q12050496","display_name":"Feature (linguistics)","level":2,"score":0.26809999346733093},{"id":"https://openalex.org/C110121322","wikidata":"https://www.wikidata.org/wiki/Q865811","display_name":"Distribution (mathematics)","level":2,"score":0.2669000029563904},{"id":"https://openalex.org/C206729178","wikidata":"https://www.wikidata.org/wiki/Q2271896","display_name":"Scheduling (production processes)","level":2,"score":0.2583000063896179},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.257999986410141},{"id":"https://openalex.org/C129848803","wikidata":"https://www.wikidata.org/wiki/Q2564360","display_name":"Sample size determination","level":2,"score":0.2517000138759613}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2604.01539","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.01539","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2604.01539","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.01539","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"display_name":"Peace, Justice and strong institutions","score":0.6120730638504028,"id":"https://metadata.un.org/sdg/16"}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Model":[0],"predictive":[1,13],"path":[2],"integral":[3],"(MPPI)":[4],"is":[5],"a":[6,54,58,70,87,91,101,120],"sampling-based":[7],"method":[8],"for":[9,61],"solving":[10],"complex":[11],"model":[12],"control":[14,149],"(MPC)":[15],"problems,":[16],"but":[17],"its":[18],"real-time":[19],"implementation":[20],"faces":[21],"two":[22],"key":[23],"challenges:":[24],"the":[25,33,39,75,95,111,117,124,132],"computational":[26],"cost":[27],"and":[28,36,45,83,100],"sample":[29],"requirements":[30],"grow":[31],"with":[32,123],"prediction":[34],"horizon,":[35],"manually":[37],"tuning":[38],"sampling":[40,59],"covariance":[41],"requires":[42],"balancing":[43],"exploration":[44],"noise.":[46],"To":[47],"address":[48],"these":[49],"issues,":[50],"we":[51,68],"propose":[52],"Step-MPPI,":[53],"framework":[55],"that":[56],"learns":[57],"distribution":[60,78,113],"efficient":[62],"single-step":[63,128],"lookahead":[64],"MPPI":[65,76,142],"implementation.":[66],"Specifically,":[67],"use":[69],"neural":[71,112],"network":[72],"to":[73],"parameterize":[74],"proposal":[77],"at":[79],"each":[80],"time":[81],"step,":[82],"train":[84],"it":[85],"in":[86,140],"self-supervised":[88],"manner":[89],"over":[90],"long":[92,148],"horizon":[93],"using":[94],"MPC":[96],"cost,":[97],"constraint":[98],"penalties,":[99],"maximum-entropy":[102],"regularization":[103],"term.":[104],"By":[105],"embedding":[106],"long-horizon":[107],"objectives":[108],"into":[109],"training":[110],"policy,":[114],"Step-MPPI":[115,135],"achieves":[116],"foresight":[118],"of":[119,127,134],"multi-step":[121],"optimizer":[122],"millisecond-level":[125],"latency":[126],"lookahead.":[129],"We":[130],"demonstrate":[131],"efficiency":[133],"across":[136],"multiple":[137],"challenging":[138],"tasks":[139],"which":[141],"suffers":[143],"from":[144],"high":[145],"dimensionality":[146],"and/or":[147],"horizons.":[150]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-04-04T00:00:00"}
