{"id":"https://openalex.org/W7134934930","doi":"https://doi.org/10.48550/arxiv.2603.09022","title":"MEMO: Memory-Augmented Model Context Optimization for Robust Multi-Turn Multi-Agent LLM Games","display_name":"MEMO: Memory-Augmented Model Context Optimization for Robust Multi-Turn Multi-Agent LLM Games","publication_year":2026,"publication_date":"2026-03-09","ids":{"openalex":"https://openalex.org/W7134934930","doi":"https://doi.org/10.48550/arxiv.2603.09022"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2603.09022","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.09022","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2603.09022","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":null,"display_name":"Xie, Yunfei","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Xie, Yunfei","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5128740091","display_name":"Kevin Wang","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wang, Kevin","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5128795783","display_name":"Bobby Cheng","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Cheng, Bobby","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5053623485","display_name":"Jianzhu Yao","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Yao, Jianzhu","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5110738653","display_name":"Zhizhou Sha","orcid":"https://orcid.org/0009-0004-2494-1945"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Sha, Zhizhou","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5128711280","display_name":"Alexander Duffy","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Duffy, Alexander","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5035229194","display_name":"Yihan Xi","orcid":"https://orcid.org/0000-0002-3509-8058"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Xi, Yihan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5070368916","display_name":"Hongyuan Mei","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Mei, Hongyuan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5073326796","display_name":"Cheston Tan","orcid":"https://orcid.org/0000-0003-1248-4906"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Tan, Cheston","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5128744105","display_name":"Chen Wei","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wei, Chen","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5053980484","display_name":"Pramod Viswanath","orcid":"https://orcid.org/0000-0003-3171-8667"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Viswanath, Pramod","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5128773501","display_name":"Zhangyang Wang","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wang, Zhangyang","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11574","display_name":"Artificial Intelligence in Games","score":0.7052000164985657,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11574","display_name":"Artificial Intelligence in Games","score":0.7052000164985657,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.11550000309944153,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10731","display_name":"Educational Games and Gamification","score":0.019600000232458115,"subfield":{"id":"https://openalex.org/subfields/3204","display_name":"Developmental and Educational Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/robustness","display_name":"Robustness (evolution)","score":0.7195000052452087},{"id":"https://openalex.org/keywords/context","display_name":"Context (archaeology)","score":0.6118999719619751},{"id":"https://openalex.org/keywords/negotiation","display_name":"Negotiation","score":0.5699999928474426},{"id":"https://openalex.org/keywords/prior-probability","display_name":"Prior probability","score":0.5698999762535095},{"id":"https://openalex.org/keywords/selection","display_name":"Selection (genetic algorithm)","score":0.45019999146461487},{"id":"https://openalex.org/keywords/repeated-game","display_name":"Repeated game","score":0.41519999504089355}],"concepts":[{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.7195000052452087},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6970999836921692},{"id":"https://openalex.org/C2779343474","wikidata":"https://www.wikidata.org/wiki/Q3109175","display_name":"Context (archaeology)","level":2,"score":0.6118999719619751},{"id":"https://openalex.org/C199776023","wikidata":"https://www.wikidata.org/wiki/Q202875","display_name":"Negotiation","level":2,"score":0.5699999928474426},{"id":"https://openalex.org/C177769412","wikidata":"https://www.wikidata.org/wiki/Q278090","display_name":"Prior probability","level":3,"score":0.5698999762535095},{"id":"https://openalex.org/C81917197","wikidata":"https://www.wikidata.org/wiki/Q628760","display_name":"Selection (genetic algorithm)","level":2,"score":0.45019999146461487},{"id":"https://openalex.org/C202556891","wikidata":"https://www.wikidata.org/wiki/Q1584646","display_name":"Repeated game","level":3,"score":0.41519999504089355},{"id":"https://openalex.org/C196083921","wikidata":"https://www.wikidata.org/wiki/Q7915758","display_name":"Variance (accounting)","level":2,"score":0.3919000029563904},{"id":"https://openalex.org/C164407509","wikidata":"https://www.wikidata.org/wiki/Q5384490","display_name":"Equilibrium selection","level":4,"score":0.33250001072883606},{"id":"https://openalex.org/C149782125","wikidata":"https://www.wikidata.org/wiki/Q160039","display_name":"Econometrics","level":1,"score":0.3296000063419342},{"id":"https://openalex.org/C2778334786","wikidata":"https://www.wikidata.org/wiki/Q1586270","display_name":"Variation (astronomy)","level":2,"score":0.3215999901294708},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.3077999949455261},{"id":"https://openalex.org/C53833338","wikidata":"https://www.wikidata.org/wiki/Q1061424","display_name":"Context switch","level":2,"score":0.29670000076293945},{"id":"https://openalex.org/C177142836","wikidata":"https://www.wikidata.org/wiki/Q44455","display_name":"Game theory","level":2,"score":0.2815999984741211},{"id":"https://openalex.org/C112972136","wikidata":"https://www.wikidata.org/wiki/Q7595718","display_name":"Stability (learning theory)","level":2,"score":0.2799000144004822},{"id":"https://openalex.org/C42475967","wikidata":"https://www.wikidata.org/wiki/Q194292","display_name":"Operations research","level":1,"score":0.2655999958515167},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.265500009059906},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.2630000114440918}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2603.09022","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.09022","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2603.09022","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.09022","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"display_name":"Peace, Justice and strong institutions","id":"https://metadata.un.org/sdg/16","score":0.4203638732433319}],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Multi-turn,":[0],"multi-agent":[1,23,155],"LLM":[2,156],"game":[3,157],"evaluations":[4],"often":[5],"exhibit":[6],"substantial":[7,162],"run-to-run":[8],"variance.":[9],"In":[10],"long-horizon":[11],"interactions,":[12],"small":[13],"early":[14],"deviations":[15],"compound":[16],"across":[17,34,148],"turns":[18],"and":[19,30,51,69,84,102,109,127,159,176,191],"are":[20],"amplified":[21],"by":[22,42,66],"coupling.":[24],"This":[25],"biases":[26],"win":[27,119],"rate":[28,120],"estimates":[29],"makes":[31],"rankings":[32,147],"unreliable":[33],"repeated":[35],"tournaments.":[36],"Prompt":[37],"choice":[38],"worsens":[39],"this":[40],"further":[41],"producing":[43],"different":[44],"effective":[45,183],"policies.":[46],"We":[47],"address":[48],"both":[49],"instability":[50],"underperformance":[52],"with":[53,97],"MEMO":[54,116,169],"(Memory-augmented":[55],"MOdel":[56],"context":[57,65,167],"optimization),":[58],"a":[59,73],"self-play":[60,82,136],"framework":[61],"that":[62,77,154],"optimizes":[63],"inference-time":[64],"coupling":[67],"retention":[68],"exploration.":[70],"Retention":[71],"maintains":[72],"persistent":[74],"memory":[75],"bank":[76],"stores":[78],"structured":[79],"insights":[80],"from":[81,121,128],"trajectories":[83],"injects":[85],"them":[86],"as":[87],"priors":[88],"during":[89],"later":[90],"play.":[91],"Exploration":[92],"runs":[93],"tournament-style":[94],"prompt":[95,149],"evolution":[96],"uncertainty-aware":[98],"selection":[99],"via":[100],"TrueSkill,":[101],"uses":[103],"prioritized":[104],"replay":[105],"to":[106,123,130],"revisit":[107],"rare":[108],"decisive":[110],"states.":[111],"Across":[112],"five":[113],"text-based":[114],"games,":[115,178],"raises":[117],"mean":[118],"25.1%":[122],"49.5%":[124],"for":[125,132,164],"GPT-4o-mini":[126],"20.9%":[129],"44.3%":[131],"Qwen-2.5-7B-Instruct,":[133],"using":[134],"$2,000$":[135],"games":[137],"per":[138],"task.":[139],"Run-to-run":[140],"variance":[141],"also":[142],"drops,":[143],"giving":[144],"more":[145,182],"stable":[146],"variations.":[150],"These":[151],"results":[152],"suggest":[153],"performance":[158],"robustness":[160],"have":[161],"room":[163],"improvement":[165],"through":[166],"optimization.":[168],"achieves":[170],"the":[171],"largest":[172],"gains":[173],"in":[174,184],"negotiation":[175],"imperfect-information":[177],"while":[179],"RL":[180],"remains":[181],"perfect-information":[185],"settings.":[186],"All":[187],"code":[188],"is":[189],"open-source":[190],"available":[192],"here:":[193],"https://github.com/openverse-ai/MEMO":[194]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-03-12T00:00:00"}
