{"id":"https://openalex.org/W7161315949","doi":"https://doi.org/10.48550/arxiv.2605.14365","title":"LoMETab: Beyond Rank-1 Ensembles for Tabular Deep Learning","display_name":"LoMETab: Beyond Rank-1 Ensembles for Tabular Deep Learning","publication_year":2026,"publication_date":"2026-05-14","ids":{"openalex":"https://openalex.org/W7161315949","doi":"https://doi.org/10.48550/arxiv.2605.14365"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2605.14365","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.14365","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2605.14365","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5136193555","display_name":"Changryeol Choi","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Choi, Changryeol","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5136262289","display_name":"Hyewon Park","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Park, Hyewon","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5136214292","display_name":"Yujin Kwon","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Kwon, Yujin","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5028432774","display_name":"Gowun Jeong","orcid":"https://orcid.org/0000-0002-4173-3214"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Jeong, Gowun","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11612","display_name":"Stochastic Gradient Optimization Techniques","score":0.17270000278949738,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11612","display_name":"Stochastic Gradient Optimization Techniques","score":0.17270000278949738,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12026","display_name":"Explainable Artificial Intelligence (XAI)","score":0.14329999685287476,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11689","display_name":"Adversarial Robustness in Machine Learning","score":0.11180000007152557,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/pairwise-comparison","display_name":"Pairwise comparison","score":0.8273000121116638},{"id":"https://openalex.org/keywords/generalization","display_name":"Generalization","score":0.6363999843597412},{"id":"https://openalex.org/keywords/multiplicative-function","display_name":"Multiplicative function","score":0.6277999877929688},{"id":"https://openalex.org/keywords/initialization","display_name":"Initialization","score":0.5763000249862671},{"id":"https://openalex.org/keywords/ambiguity","display_name":"Ambiguity","score":0.5163999795913696},{"id":"https://openalex.org/keywords/contrast","display_name":"Contrast (vision)","score":0.4219000041484833},{"id":"https://openalex.org/keywords/benchmark","display_name":"Benchmark (surveying)","score":0.37369999289512634},{"id":"https://openalex.org/keywords/artificial-neural-network","display_name":"Artificial neural network","score":0.301800012588501}],"concepts":[{"id":"https://openalex.org/C184898388","wikidata":"https://www.wikidata.org/wiki/Q1435712","display_name":"Pairwise comparison","level":2,"score":0.8273000121116638},{"id":"https://openalex.org/C177148314","wikidata":"https://www.wikidata.org/wiki/Q170084","display_name":"Generalization","level":2,"score":0.6363999843597412},{"id":"https://openalex.org/C42747912","wikidata":"https://www.wikidata.org/wiki/Q1048447","display_name":"Multiplicative function","level":2,"score":0.6277999877929688},{"id":"https://openalex.org/C114466953","wikidata":"https://www.wikidata.org/wiki/Q6034165","display_name":"Initialization","level":2,"score":0.5763000249862671},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.5751000046730042},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5523999929428101},{"id":"https://openalex.org/C2780522230","wikidata":"https://www.wikidata.org/wiki/Q1140419","display_name":"Ambiguity","level":2,"score":0.5163999795913696},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.4275999963283539},{"id":"https://openalex.org/C2776502983","wikidata":"https://www.wikidata.org/wiki/Q690182","display_name":"Contrast (vision)","level":2,"score":0.4219000041484833},{"id":"https://openalex.org/C185798385","wikidata":"https://www.wikidata.org/wiki/Q1161707","display_name":"Benchmark (surveying)","level":2,"score":0.37369999289512634},{"id":"https://openalex.org/C80444323","wikidata":"https://www.wikidata.org/wiki/Q2878974","display_name":"Theoretical computer science","level":1,"score":0.3540000021457672},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.301800012588501},{"id":"https://openalex.org/C164226766","wikidata":"https://www.wikidata.org/wiki/Q7293202","display_name":"Rank (graph theory)","level":2,"score":0.2957000136375427},{"id":"https://openalex.org/C112972136","wikidata":"https://www.wikidata.org/wiki/Q7595718","display_name":"Stability (learning theory)","level":2,"score":0.28859999775886536},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.2874999940395355},{"id":"https://openalex.org/C2778755073","wikidata":"https://www.wikidata.org/wiki/Q10858537","display_name":"Scale (ratio)","level":2,"score":0.28619998693466187},{"id":"https://openalex.org/C2780586882","wikidata":"https://www.wikidata.org/wiki/Q7520643","display_name":"Simple (philosophy)","level":2,"score":0.2815000116825104},{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.27730000019073486},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.2667999863624573},{"id":"https://openalex.org/C86037889","wikidata":"https://www.wikidata.org/wiki/Q4330127","display_name":"Learning to rank","level":3,"score":0.26339998841285706},{"id":"https://openalex.org/C183115368","wikidata":"https://www.wikidata.org/wiki/Q856577","display_name":"Weighting","level":2,"score":0.26260000467300415},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.2581000030040741},{"id":"https://openalex.org/C108583219","wikidata":"https://www.wikidata.org/wiki/Q197536","display_name":"Deep learning","level":2,"score":0.2524000108242035},{"id":"https://openalex.org/C31170391","wikidata":"https://www.wikidata.org/wiki/Q188619","display_name":"Hierarchy","level":2,"score":0.2515999972820282}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2605.14365","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.14365","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2605.14365","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.14365","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"id":"https://metadata.un.org/sdg/16","display_name":"Peace, Justice and strong institutions","score":0.5053818225860596}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Recent":[0],"tabular":[1,49],"learning":[2],"benchmarks":[3],"increasingly":[4],"show":[5,130],"a":[6,12,35,55,69,231,239],"tight":[7],"performance":[8,220],"cluster":[9],"rather":[10,237],"than":[11,151,238],"clear":[13],"hierarchy":[14],"among":[15],"leading":[16],"methods,":[17],"spanning":[18],"gradient":[19],"boosted":[20],"decision":[21],"trees,":[22],"attention-based":[23],"architectures,":[24],"and":[25,41,91,108,113,156,188,202,213],"implicit":[26,60,235],"ensembles":[27,236],"such":[28],"as":[29,79,136,230],"TabM.":[30],"As":[31],"benchmark":[32],"gains":[33],"plateau,":[34],"complementary":[36],"goal":[37],"is":[38,89,178,221],"to":[39,68,168,200],"understand":[40],"control":[42,161,195],"the":[43,64,104,109,194,224],"mechanisms":[44],"that":[45,116,131,193,218],"make":[46],"simple":[47],"neural":[48],"models":[50],"competitive.":[51],"We":[52],"propose":[53],"LoMETab,":[54],"rank-$r$":[56,70],"generalization":[57,122],"of":[58,171,234],"multiplicative":[59],"ensembles.":[61],"LoMETab":[62,146,229],"lifts":[63],"rank-1":[65,241],"BatchEnsemble/TabM":[66],"modulation":[67],"identity-residual":[71],"Hadamard":[72],"family":[73,233],"by":[74,166],"parameterizing":[75],"each":[76],"member":[77,204],"weight":[78],"$W_k":[80],"=":[81],"W":[82],"\\odot":[83],"(1":[84],"+":[85],"A_kB_k^\\top)$,":[86],"where":[87],"$W$":[88],"shared":[90],"$(A_k,":[92],"B_k)$":[93],"are":[94],"member-specific":[95],"low-rank":[96,154],"factors.":[97],"This":[98],"exposes":[99],"two":[100],"practical":[101],"diversity-control":[102],"axes:":[103],"adapter":[105,210],"rank":[106,211],"$r$":[107,212],"initialization":[110,214],"scale":[111,215],"$\u03c3_{\\mathrm{init}}$,":[112],"we":[114,129],"prove":[115],"for":[117,186,190],"$r":[118],"\\ge":[119],"2$":[120],"this":[121,132],"strictly":[123],"enlarges":[124],"BatchEnsemble's":[125],"hypothesis":[126],"class.":[127],"Empirically,":[128],"added":[133],"capacity":[134],"manifests":[135],"measurable":[137],"predictive":[138,219],"diversity":[139,177],"after":[140],"training:":[141],"on":[142],"representative":[143],"classification":[144,187],"datasets,":[145],"sustains":[147],"higher":[148],"pairwise":[149,163,198],"KL":[150,199],"an":[152],"additive":[153],"ablation,":[155],"$(r,":[157,225],"\u03c3_{\\mathrm{init}})$":[158,226],"provides":[159],"broad":[160],"over":[162,209,223],"KL,":[164],"varying":[165],"up":[167],"several":[169],"orders":[170],"magnitude":[172],"across":[173],"configurations.":[174],"The":[175],"induced":[176],"reflected":[179],"in":[180],"task-appropriate":[181],"output-level":[182,203],"measures:":[183],"argmax":[184],"disagreement":[185],"ambiguity":[189],"regression,":[191],"indicating":[192],"extends":[196],"beyond":[197],"decision-":[201],"variation.":[205],"Finally,":[206],"experiments":[207],"sweeping":[208],"$\u03c3_{\\mathrm{init}}$":[216],"reveal":[217],"dataset-dependent":[222],"grid,":[227],"supporting":[228],"controllable":[232],"fixed":[240],"construction.":[242]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-05-16T00:00:00"}
