{"id":"https://openalex.org/W7162807691","doi":"https://doi.org/10.48550/arxiv.2605.28983","title":"The Hamilton-Jacobi Theory of Deep Learning","display_name":"The Hamilton-Jacobi Theory of Deep Learning","publication_year":2026,"publication_date":"2026-05-27","ids":{"openalex":"https://openalex.org/W7162807691","doi":"https://doi.org/10.48550/arxiv.2605.28983"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2605.28983","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.28983","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2605.28983","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5060148209","display_name":"Jose Marie Antonio Mi\u00f1oza","orcid":"https://orcid.org/0000-0003-2009-4799"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Mi\u00f1oza, Jose Marie Antonio","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5126636091","display_name":"Erika Fille T. Legara","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Legara, Erika Fille T.","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5137349002","display_name":"Christopher P. Monterola","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Monterola, Christopher P.","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.26170000433921814,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.26170000433921814,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11612","display_name":"Stochastic Gradient Optimization Techniques","score":0.19089999794960022,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11273","display_name":"Advanced Graph Neural Networks","score":0.18250000476837158,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/lipschitz-continuity","display_name":"Lipschitz continuity","score":0.6608999967575073},{"id":"https://openalex.org/keywords/minimax","display_name":"Minimax","score":0.5648999810218811},{"id":"https://openalex.org/keywords/scaling","display_name":"Scaling","score":0.5351999998092651},{"id":"https://openalex.org/keywords/discretization","display_name":"Discretization","score":0.48089998960494995},{"id":"https://openalex.org/keywords/deep-learning","display_name":"Deep learning","score":0.3919000029563904},{"id":"https://openalex.org/keywords/artificial-neural-network","display_name":"Artificial neural network","score":0.3747999966144562},{"id":"https://openalex.org/keywords/residual","display_name":"Residual","score":0.3549000024795532},{"id":"https://openalex.org/keywords/robustness","display_name":"Robustness (evolution)","score":0.3434999883174896},{"id":"https://openalex.org/keywords/backpropagation","display_name":"Backpropagation","score":0.3377000093460083}],"concepts":[{"id":"https://openalex.org/C22324862","wikidata":"https://www.wikidata.org/wiki/Q652707","display_name":"Lipschitz continuity","level":2,"score":0.6608999967575073},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.637499988079071},{"id":"https://openalex.org/C149728462","wikidata":"https://www.wikidata.org/wiki/Q751319","display_name":"Minimax","level":2,"score":0.5648999810218811},{"id":"https://openalex.org/C99844830","wikidata":"https://www.wikidata.org/wiki/Q102441924","display_name":"Scaling","level":2,"score":0.5351999998092651},{"id":"https://openalex.org/C73000952","wikidata":"https://www.wikidata.org/wiki/Q17007827","display_name":"Discretization","level":2,"score":0.48089998960494995},{"id":"https://openalex.org/C28826006","wikidata":"https://www.wikidata.org/wiki/Q33521","display_name":"Applied mathematics","level":1,"score":0.40130001306533813},{"id":"https://openalex.org/C108583219","wikidata":"https://www.wikidata.org/wiki/Q197536","display_name":"Deep learning","level":2,"score":0.3919000029563904},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.3747999966144562},{"id":"https://openalex.org/C155512373","wikidata":"https://www.wikidata.org/wiki/Q287450","display_name":"Residual","level":2,"score":0.3549000024795532},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.34549999237060547},{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.3434999883174896},{"id":"https://openalex.org/C155032097","wikidata":"https://www.wikidata.org/wiki/Q798503","display_name":"Backpropagation","level":3,"score":0.3377000093460083},{"id":"https://openalex.org/C134306372","wikidata":"https://www.wikidata.org/wiki/Q7754","display_name":"Mathematical analysis","level":1,"score":0.32339999079704285},{"id":"https://openalex.org/C112680207","wikidata":"https://www.wikidata.org/wiki/Q714886","display_name":"Regular polygon","level":2,"score":0.31869998574256897},{"id":"https://openalex.org/C61445026","wikidata":"https://www.wikidata.org/wiki/Q217608","display_name":"Fixed point","level":2,"score":0.31839999556541443},{"id":"https://openalex.org/C106301342","wikidata":"https://www.wikidata.org/wiki/Q4117933","display_name":"Entropy (arrow of time)","level":2,"score":0.313400000333786},{"id":"https://openalex.org/C79379906","wikidata":"https://www.wikidata.org/wiki/Q3174497","display_name":"Dynamical systems theory","level":2,"score":0.30720001459121704},{"id":"https://openalex.org/C39927690","wikidata":"https://www.wikidata.org/wiki/Q11197","display_name":"Logarithm","level":2,"score":0.3068999946117401},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.30320000648498535},{"id":"https://openalex.org/C130787639","wikidata":"https://www.wikidata.org/wiki/Q5645293","display_name":"Hamiltonian (control theory)","level":2,"score":0.30149999260902405},{"id":"https://openalex.org/C145446738","wikidata":"https://www.wikidata.org/wiki/Q319913","display_name":"Convex function","level":3,"score":0.2994000017642975},{"id":"https://openalex.org/C135450995","wikidata":"https://www.wikidata.org/wiki/Q820272","display_name":"Hill climbing","level":2,"score":0.29420000314712524},{"id":"https://openalex.org/C184050105","wikidata":"https://www.wikidata.org/wiki/Q273163","display_name":"Isotropy","level":2,"score":0.2937000095844269},{"id":"https://openalex.org/C2781067378","wikidata":"https://www.wikidata.org/wiki/Q17027399","display_name":"Interpretability","level":2,"score":0.289900004863739},{"id":"https://openalex.org/C121770821","wikidata":"https://www.wikidata.org/wiki/Q2072471","display_name":"Hamiltonian system","level":2,"score":0.2865999937057495},{"id":"https://openalex.org/C91873725","wikidata":"https://www.wikidata.org/wiki/Q3445816","display_name":"Function approximation","level":3,"score":0.2809000015258789},{"id":"https://openalex.org/C153258448","wikidata":"https://www.wikidata.org/wiki/Q1199743","display_name":"Gradient descent","level":3,"score":0.2639999985694885},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.26170000433921814},{"id":"https://openalex.org/C121864883","wikidata":"https://www.wikidata.org/wiki/Q677916","display_name":"Statistical physics","level":1,"score":0.25609999895095825}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2605.28983","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.28983","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2605.28983","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.28983","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"id":"https://metadata.un.org/sdg/11","display_name":"Sustainable cities and communities","score":0.4311644434928894}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"In":[0],"this":[1],"paper,":[2],"training":[3],"a":[4,11,25,111,161],"neural":[5],"network":[6],"is":[7,40,48,54,62],"identified,":[8],"exactly,":[9],"as":[10,136,176],"search":[12],"through":[13],"Hamilton--Jacobi":[14,27,87],"initial-value":[15],"problems:":[16],"each":[17,81,179],"gradient":[18],"step":[19],"selects":[20],"the":[21,34,38,41,51,58,83,121,137,141],"initial":[22,52],"data":[23,154],"of":[24,86,140],"viscous":[26,106],"equation":[28,139],"whose":[29,170],"Hopf--Cole":[30],"propagator":[31],"best":[32],"fits":[33],"observations;":[35],"at":[36,44],"inference,":[37],"input":[39],"spatial":[42],"point":[43],"which":[45],"that":[46],"solution":[47],"evaluated":[49],"and":[50,67,75,92,160],"condition":[53],"already":[55],"encoded":[56],"in":[57,110],"weights.":[59],"The":[60],"correspondence":[61],"exact":[63],"for":[64,69,127,144],"log-sum-exp":[65],"layers":[66],"structural":[68],"broader":[70],"architectures:":[71],"residual":[72,145],"networks,":[73],"transformers,":[74],"recurrent":[76],"architectures":[77],"(RNNs,":[78],"LSTMs,":[79],"SSMs)":[80],"discretize":[82],"same":[84],"class":[85],"equations,":[88],"with":[89,153],"architecture-dependent":[90],"Hamiltonian":[91,142],"viscosity.":[93],"A":[94],"single":[95],"deformation":[96],"parameter":[97],"$\\varepsilon$":[98,177],"unifies":[99],"all":[100],"four":[101],"perspectives":[102],"(network,":[103],"tropical":[104],"algebra,":[105],"PDE,":[107],"convex":[108],"optimization)":[109],"commutative":[112],"diagram":[113],"closed":[114],"under":[115],"Lipschitz":[116],"conditions.":[117],"Quantitative":[118],"consequences":[119],"include:":[120],"minimax":[122],"optimal":[123],"generalization":[124],"rate":[125],"$O(n^{-1/(d+2)})$":[126],"fixed":[128],"$t$;":[129],"adversarial":[130],"robustness":[131],"controlled":[132],"by":[133],"$\\varepsilon$;":[134],"backpropagation":[135],"co-state":[138],"system":[143],"networks":[146],"(Pontryagin":[147],"Maximum":[148],"Principle);":[149],"scaling":[150],"exponents":[151],"consistent":[152],"intrinsic":[155],"dimension":[156],"via":[157],"PDE":[158],"quadrature;":[159],"closed-form":[162],"$O(N)$":[163],"influence":[164],"function":[165],"(softmax":[166],"attribution":[167,181],"weights":[168],"$\u03c0_j$)":[169],"entropy":[171],"landscape":[172],"undergoes":[173],"fold":[174],"bifurcations":[175],"increases,":[178],"merging":[180],"basins.":[182]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-05-30T00:00:00"}
