{"id":"https://openalex.org/W7138159731","doi":"https://doi.org/10.48550/arxiv.2603.15367","title":"Controlled Langevin Dynamics for Sampling of Feedforward Neural Networks Trained with Minibatches","display_name":"Controlled Langevin Dynamics for Sampling of Feedforward Neural Networks Trained with Minibatches","publication_year":2026,"publication_date":"2026-03-16","ids":{"openalex":"https://openalex.org/W7138159731","doi":"https://doi.org/10.48550/arxiv.2603.15367"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2603.15367","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.15367","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2603.15367","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5129656112","display_name":"Alessandro Zambon","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zambon, Alessandro","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5129686215","display_name":"Francesca Caruso","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Caruso, Francesca","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5041685522","display_name":"Riccardo Zecchina","orcid":"https://orcid.org/0000-0002-1221-5207"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zecchina, Riccardo","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5087634120","display_name":"Guido Tiana","orcid":"https://orcid.org/0000-0001-9868-1809"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Tiana, Guido","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10775","display_name":"Generative Adversarial Networks and Image Synthesis","score":0.3188999891281128,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10775","display_name":"Generative Adversarial Networks and Image Synthesis","score":0.3188999891281128,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11948","display_name":"Machine Learning in Materials Science","score":0.2533999979496002,"subfield":{"id":"https://openalex.org/subfields/2505","display_name":"Materials Chemistry"},"field":{"id":"https://openalex.org/fields/25","display_name":"Materials Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11206","display_name":"Model Reduction and Neural Networks","score":0.14990000426769257,"subfield":{"id":"https://openalex.org/subfields/3109","display_name":"Statistical and Nonlinear Physics"},"field":{"id":"https://openalex.org/fields/31","display_name":"Physics and Astronomy"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/sampling","display_name":"Sampling (signal processing)","score":0.6661999821662903},{"id":"https://openalex.org/keywords/artificial-neural-network","display_name":"Artificial neural network","score":0.6115999817848206},{"id":"https://openalex.org/keywords/langevin-dynamics","display_name":"Langevin dynamics","score":0.603600025177002},{"id":"https://openalex.org/keywords/generalization","display_name":"Generalization","score":0.5257999897003174},{"id":"https://openalex.org/keywords/scalability","display_name":"Scalability","score":0.51910001039505},{"id":"https://openalex.org/keywords/monte-carlo-method","display_name":"Monte Carlo method","score":0.4885999858379364},{"id":"https://openalex.org/keywords/feedforward-neural-network","display_name":"Feedforward neural network","score":0.4555000066757202},{"id":"https://openalex.org/keywords/feed-forward","display_name":"Feed forward","score":0.4512999951839447},{"id":"https://openalex.org/keywords/importance-sampling","display_name":"Importance sampling","score":0.438400000333786}],"concepts":[{"id":"https://openalex.org/C140779682","wikidata":"https://www.wikidata.org/wiki/Q210868","display_name":"Sampling (signal processing)","level":3,"score":0.6661999821662903},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6399000287055969},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.6115999817848206},{"id":"https://openalex.org/C2780004032","wikidata":"https://www.wikidata.org/wiki/Q6485978","display_name":"Langevin dynamics","level":2,"score":0.603600025177002},{"id":"https://openalex.org/C177148314","wikidata":"https://www.wikidata.org/wiki/Q170084","display_name":"Generalization","level":2,"score":0.5257999897003174},{"id":"https://openalex.org/C48044578","wikidata":"https://www.wikidata.org/wiki/Q727490","display_name":"Scalability","level":2,"score":0.51910001039505},{"id":"https://openalex.org/C19499675","wikidata":"https://www.wikidata.org/wiki/Q232207","display_name":"Monte Carlo method","level":2,"score":0.4885999858379364},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.46160000562667847},{"id":"https://openalex.org/C47702885","wikidata":"https://www.wikidata.org/wiki/Q5441227","display_name":"Feedforward neural network","level":3,"score":0.4555000066757202},{"id":"https://openalex.org/C38858127","wikidata":"https://www.wikidata.org/wiki/Q5441228","display_name":"Feed forward","level":2,"score":0.4512999951839447},{"id":"https://openalex.org/C52740198","wikidata":"https://www.wikidata.org/wiki/Q1539564","display_name":"Importance sampling","level":3,"score":0.438400000333786},{"id":"https://openalex.org/C99498987","wikidata":"https://www.wikidata.org/wiki/Q2210247","display_name":"Noise (video)","level":3,"score":0.43369999527931213},{"id":"https://openalex.org/C86582703","wikidata":"https://www.wikidata.org/wiki/Q7617824","display_name":"Stochastic neural network","level":4,"score":0.37929999828338623},{"id":"https://openalex.org/C177264268","wikidata":"https://www.wikidata.org/wiki/Q1514741","display_name":"Set (abstract data type)","level":2,"score":0.3693999946117401},{"id":"https://openalex.org/C192576344","wikidata":"https://www.wikidata.org/wiki/Q194706","display_name":"Boltzmann machine","level":3,"score":0.3662000000476837},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.3605000078678131},{"id":"https://openalex.org/C147764199","wikidata":"https://www.wikidata.org/wiki/Q6865248","display_name":"Minification","level":2,"score":0.35339999198913574},{"id":"https://openalex.org/C165696696","wikidata":"https://www.wikidata.org/wiki/Q11287","display_name":"Exploit","level":2,"score":0.34450000524520874},{"id":"https://openalex.org/C8272713","wikidata":"https://www.wikidata.org/wiki/Q176737","display_name":"Stochastic process","level":2,"score":0.3407000005245209},{"id":"https://openalex.org/C199354608","wikidata":"https://www.wikidata.org/wiki/Q7316287","display_name":"Restricted Boltzmann machine","level":3,"score":0.3343999981880188},{"id":"https://openalex.org/C35304006","wikidata":"https://www.wikidata.org/wiki/Q5962","display_name":"Boltzmann constant","level":2,"score":0.3303000032901764},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.3239000141620636},{"id":"https://openalex.org/C110121322","wikidata":"https://www.wikidata.org/wiki/Q865811","display_name":"Distribution (mathematics)","level":2,"score":0.30149999260902405},{"id":"https://openalex.org/C121864883","wikidata":"https://www.wikidata.org/wiki/Q677916","display_name":"Statistical physics","level":1,"score":0.2971999943256378},{"id":"https://openalex.org/C155032097","wikidata":"https://www.wikidata.org/wiki/Q798503","display_name":"Backpropagation","level":3,"score":0.29190000891685486},{"id":"https://openalex.org/C2778572836","wikidata":"https://www.wikidata.org/wiki/Q380933","display_name":"Space (punctuation)","level":2,"score":0.2777000069618225},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.2721000015735626},{"id":"https://openalex.org/C73586568","wikidata":"https://www.wikidata.org/wiki/Q2600211","display_name":"Parameter space","level":2,"score":0.2676999866962433},{"id":"https://openalex.org/C145912823","wikidata":"https://www.wikidata.org/wiki/Q113558","display_name":"Dynamics (music)","level":2,"score":0.2572000026702881},{"id":"https://openalex.org/C167723999","wikidata":"https://www.wikidata.org/wiki/Q3773214","display_name":"Sampling distribution","level":2,"score":0.2535000145435333},{"id":"https://openalex.org/C98045186","wikidata":"https://www.wikidata.org/wiki/Q205663","display_name":"Process (computing)","level":2,"score":0.250900000333786},{"id":"https://openalex.org/C69357855","wikidata":"https://www.wikidata.org/wiki/Q163214","display_name":"Diffusion","level":2,"score":0.25029999017715454}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2603.15367","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.15367","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2603.15367","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.15367","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Sampling":[0],"the":[1,16,87,104,110,117,144,202],"parameter":[2],"space":[3,204],"of":[4,18,55,69,90,205],"artificial":[5],"neural":[6,71,207],"networks":[7,72,155],"according":[8],"to":[9,25,101,154,174],"a":[10,60,81,178,193],"Boltzmann":[11,67],"distribution":[12],"provides":[13],"insight":[14],"into":[15],"geometry":[17],"low-loss":[19],"solutions":[20],"and":[21,94,98,151,195,200],"offers":[22],"an":[23],"alternative":[24],"conventional":[26],"loss":[27],"minimization":[28],"for":[29,47,198],"training.":[30],"However,":[31],"exact":[32,128],"sampling":[33,68,165],"methods":[34],"such":[35],"as":[36,140,192],"hybrid":[37],"Monte":[38],"Carlo":[39],"(hMC),":[40],"while":[41,135],"formally":[42],"correct,":[43],"become":[44],"computationally":[45],"prohibitive":[46],"realistic":[48],"datasets":[49,76],"because":[50],"they":[51],"require":[52],"repeated":[53],"evaluation":[54],"full-batch":[56],"gradients.":[57],"We":[58,114],"introduce":[59],"pseudo-Langevin":[61],"(pL)":[62],"dynamics":[63,191],"that":[64,103,164],"enables":[65],"efficient":[66],"feed-forward":[70],"trained":[73],"with":[74,124,156],"large":[75,206],"by":[77,119],"using":[78],"minibatches":[79],"in":[80],"controlled":[82,188],"manner.":[83],"The":[84],"method":[85],"exploits":[86],"statistical":[88],"properties":[89],"minibatch":[91,189],"gradient":[92],"noise":[93],"adjusts":[95],"fictitious":[96],"masses":[97],"friction":[99],"coefficients":[100],"ensure":[102],"induced":[105],"stochastic":[106],"process":[107],"samples":[108],"efficiently":[109],"desired":[111],"equilibrium":[112,122],"distribution.":[113],"validate":[115],"numerically":[116],"approach":[118],"comparing":[120],"its":[121],"statistics":[123],"those":[125],"obtained":[126],"from":[127],"hMC":[129,136],"sampling.":[130],"Performance":[131],"benchmarks":[132],"demonstrate":[133],"that,":[134],"rapidly":[137],"becomes":[138],"inefficient":[139],"network":[141],"size":[142],"increases,":[143],"pL":[145],"scheme":[146],"maintains":[147],"high":[148],"computational":[149],"diffusion":[150],"scales":[152],"favorably":[153],"over":[157],"one":[158],"million":[159],"parameters.":[160],"Finally,":[161],"we":[162],"show":[163],"at":[166],"intermediate":[167],"temperatures":[168],"yields":[169],"optimal":[170],"generalization":[171],"performance,":[172],"comparable":[173],"SGD,":[175],"without":[176],"requiring":[177],"validation":[179],"set":[180],"or":[181],"early":[182],"stopping":[183],"procedure.":[184],"These":[185],"results":[186],"establish":[187],"Langevin":[190],"practical":[194],"scalable":[196],"tool":[197],"exploring":[199],"exploiting":[201],"solution":[203],"networks.":[208]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-03-18T00:00:00"}
