{"id":"https://openalex.org/W7163125848","doi":"https://doi.org/10.48550/arxiv.2606.00759","title":"Distributed GNEP Algorithms without Multiplier Sharing and Applications to Multi-Robot Coordination and Contextual Bandit-Based Active Learning","display_name":"Distributed GNEP Algorithms without Multiplier Sharing and Applications to Multi-Robot Coordination and Contextual Bandit-Based Active Learning","publication_year":2026,"publication_date":"2026-05-30","ids":{"openalex":"https://openalex.org/W7163125848","doi":"https://doi.org/10.48550/arxiv.2606.00759"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2606.00759","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.00759","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2606.00759","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5059570260","display_name":"Sicheng Yin","orcid":"https://orcid.org/0009-0009-8791-9709"},"institutions":[],"countries":[],"is_corresponding":true,"raw_author_name":"Yin, Shao-An","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":["https://openalex.org/A5059570260"],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T12101","display_name":"Advanced Bandit Algorithms Research","score":0.9241999983787537,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},"topics":[{"id":"https://openalex.org/T12101","display_name":"Advanced Bandit Algorithms Research","score":0.9241999983787537,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T11031","display_name":"Game Theory and Applications","score":0.012500000186264515,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.011099999770522118,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/active-learning","display_name":"Active learning (machine learning)","score":0.4871000051498413},{"id":"https://openalex.org/keywords/convergence","display_name":"Convergence (economics)","score":0.46299999952316284},{"id":"https://openalex.org/keywords/nash-equilibrium","display_name":"Nash equilibrium","score":0.4629000127315521},{"id":"https://openalex.org/keywords/lagrange-multiplier","display_name":"Lagrange multiplier","score":0.45809999108314514},{"id":"https://openalex.org/keywords/distributed-algorithm","display_name":"Distributed algorithm","score":0.4366999864578247},{"id":"https://openalex.org/keywords/focus","display_name":"Focus (optics)","score":0.4101000130176544},{"id":"https://openalex.org/keywords/multiplier","display_name":"Multiplier (economics)","score":0.3882000148296356},{"id":"https://openalex.org/keywords/monotone-polygon","display_name":"Monotone polygon","score":0.35510000586509705}],"concepts":[{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.733299970626831},{"id":"https://openalex.org/C77967617","wikidata":"https://www.wikidata.org/wiki/Q4677561","display_name":"Active learning (machine learning)","level":2,"score":0.4871000051498413},{"id":"https://openalex.org/C2777303404","wikidata":"https://www.wikidata.org/wiki/Q759757","display_name":"Convergence (economics)","level":2,"score":0.46299999952316284},{"id":"https://openalex.org/C46814582","wikidata":"https://www.wikidata.org/wiki/Q23389","display_name":"Nash equilibrium","level":2,"score":0.4629000127315521},{"id":"https://openalex.org/C73684929","wikidata":"https://www.wikidata.org/wiki/Q598870","display_name":"Lagrange multiplier","level":2,"score":0.45809999108314514},{"id":"https://openalex.org/C130120984","wikidata":"https://www.wikidata.org/wiki/Q2835898","display_name":"Distributed algorithm","level":2,"score":0.4366999864578247},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.42480000853538513},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.414000004529953},{"id":"https://openalex.org/C192209626","wikidata":"https://www.wikidata.org/wiki/Q190909","display_name":"Focus (optics)","level":2,"score":0.4101000130176544},{"id":"https://openalex.org/C124584101","wikidata":"https://www.wikidata.org/wiki/Q1053266","display_name":"Multiplier (economics)","level":2,"score":0.3882000148296356},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.37940001487731934},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.367000013589859},{"id":"https://openalex.org/C2834757","wikidata":"https://www.wikidata.org/wiki/Q4925424","display_name":"Monotone polygon","level":2,"score":0.35510000586509705},{"id":"https://openalex.org/C189693848","wikidata":"https://www.wikidata.org/wiki/Q6031064","display_name":"Information exchange","level":2,"score":0.33730000257492065},{"id":"https://openalex.org/C32407928","wikidata":"https://www.wikidata.org/wiki/Q2733833","display_name":"Best response","level":3,"score":0.32580000162124634},{"id":"https://openalex.org/C112680207","wikidata":"https://www.wikidata.org/wiki/Q714886","display_name":"Regular polygon","level":2,"score":0.3199000060558319},{"id":"https://openalex.org/C2778079155","wikidata":"https://www.wikidata.org/wiki/Q288500","display_name":"Potential game","level":3,"score":0.3156000077724457},{"id":"https://openalex.org/C80444323","wikidata":"https://www.wikidata.org/wiki/Q2878974","display_name":"Theoretical computer science","level":1,"score":0.3091000020503998},{"id":"https://openalex.org/C73000952","wikidata":"https://www.wikidata.org/wiki/Q17007827","display_name":"Discretization","level":2,"score":0.29660001397132874},{"id":"https://openalex.org/C113336015","wikidata":"https://www.wikidata.org/wiki/Q574010","display_name":"Complete information","level":2,"score":0.28369998931884766},{"id":"https://openalex.org/C157972887","wikidata":"https://www.wikidata.org/wiki/Q463359","display_name":"Convex optimization","level":3,"score":0.27390000224113464},{"id":"https://openalex.org/C2776854237","wikidata":"https://www.wikidata.org/wiki/Q6031064","display_name":"Information sharing","level":2,"score":0.26589998602867126},{"id":"https://openalex.org/C145446738","wikidata":"https://www.wikidata.org/wiki/Q319913","display_name":"Convex function","level":3,"score":0.2531000077724457}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2606.00759","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.00759","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2606.00759","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.00759","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Recent":[0],"advances":[1],"in":[2,16,129,143,154,197],"artificial":[3],"intelligence":[4],"have":[5],"expanded":[6],"the":[7,95,112,117,122,135,150,210,219],"focus":[8],"from":[9],"classical":[10],"optimization":[11],"to":[12,26,38,42,102,109,173,207],"include":[13],"equilibrium":[14,114],"analysis":[15,74],"noncooperative":[17],"games.":[18],"Many":[19],"such":[20],"games":[21,79],"involve":[22],"shared":[23,86],"constraints,":[24],"leading":[25],"Generalized":[27],"Nash":[28],"Equilibrium":[29],"Problems":[30],"(GNEPs).":[31],"Existing":[32,178],"distributed":[33,53],"algorithms":[34,55],"typically":[35,163],"require":[36],"agents":[37],"exchange":[39,66],"Lagrange":[40],"multipliers":[41],"enforce":[43],"consensus":[44],"and":[45,56,84,132,168],"compute":[46],"variational-GNEs":[47],"(v-GNEs).":[48],"This":[49],"work":[50,139],"introduces":[51],"fully":[52],"continuous-time":[54,96],"establishes":[57],"convergence":[58],"without":[59],"requiring":[60],"multiplier":[61],"exchange,":[62],"thereby":[63],"reducing":[64],"information":[65],"per":[67],"iteration":[68],"while":[69],"improving":[70],"privacy":[71],"preservation.":[72],"The":[73,98,119,216],"focuses":[75],"on":[76,116,188,224],"strongly":[77],"monotone":[78],"with":[80,111,145],"convex":[81],"individual":[82],"constraints":[83],"linear":[85],"constraints.":[87],"I":[88,202],"also":[89],"propose":[90,203],"several":[91],"discretization":[92],"schemes":[93],"for":[94],"algorithms.":[97],"proposed":[99,123,220],"approach":[100,221],"converges":[101],"general":[103],"GNEs,":[104],"rather":[105],"than":[106],"being":[107],"restricted":[108],"v-GNEs,":[110],"attained":[113],"depending":[115],"initialization.":[118],"effectiveness":[120,217],"of":[121,149,191,218],"method":[124],"is":[125,158,222],"demonstrated":[126,223],"through":[127],"applications":[128],"multi-robot":[130],"coordination":[131],"placement.":[133],"In":[134,199],"second":[136],"part,":[137],"this":[138,175,200],"includes":[140],"research":[141],"conducted":[142],"collaboration":[144],"Amazon":[146],"scientists.":[147],"One":[148],"most":[151,211],"challenging":[152],"problems":[153],"real-world":[155],"machine":[156],"learning":[157,171,181,214],"labeled":[159],"data":[160],"collection,":[161],"which":[162,193],"requires":[164],"substantial":[165],"human":[166],"effort":[167],"cost.":[169],"Active":[170],"aims":[172],"reduce":[174],"labeling":[176],"requirement.":[177],"handcrafted":[179],"active":[180,213],"strategies,":[182],"however,":[183],"generally":[184],"perform":[185],"well":[186],"only":[187],"specific":[189],"types":[190],"datasets,":[192],"are":[194],"often":[195],"unknown":[196],"advance.":[198],"work,":[201],"using":[204],"contextual":[205],"bandits":[206],"adaptively":[208],"select":[209],"suitable":[212],"strategy.":[215],"publicly":[225],"available":[226],"external":[227],"datasets.":[228]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-06-03T00:00:00"}
