{"id":"https://openalex.org/W7161031977","doi":"https://doi.org/10.48550/arxiv.2605.11042","title":"Towards Model-Free Learning in Dynamic Population Games: An Application to Karma Economies","display_name":"Towards Model-Free Learning in Dynamic Population Games: An Application to Karma Economies","publication_year":2026,"publication_date":"2026-05-11","ids":{"openalex":"https://openalex.org/W7161031977","doi":"https://doi.org/10.48550/arxiv.2605.11042"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2605.11042","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.11042","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2605.11042","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5094255460","display_name":"Matteo Cederle","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Cederle, Matteo","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5018168527","display_name":"Saverio Bolognani","orcid":"https://orcid.org/0000-0002-7935-1385"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Bolognani, Saverio","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5026617079","display_name":"Gian Antonio Susto","orcid":"https://orcid.org/0000-0001-5739-9639"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Susto, Gian Antonio","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11031","display_name":"Game Theory and Applications","score":0.6399000287055969,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},"topics":[{"id":"https://openalex.org/T11031","display_name":"Game Theory and Applications","score":0.6399000287055969,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T11182","display_name":"Auction Theory and Applications","score":0.0786999985575676,"subfield":{"id":"https://openalex.org/subfields/1803","display_name":"Management Science and Operations Research"},"field":{"id":"https://openalex.org/fields/18","display_name":"Decision Sciences"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.06279999762773514,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/karma","display_name":"Karma","score":0.7645000219345093},{"id":"https://openalex.org/keywords/population","display_name":"Population","score":0.5882999897003174},{"id":"https://openalex.org/keywords/nash-equilibrium","display_name":"Nash equilibrium","score":0.560699999332428},{"id":"https://openalex.org/keywords/convergence","display_name":"Convergence (economics)","score":0.47029998898506165},{"id":"https://openalex.org/keywords/joins","display_name":"Joins","score":0.4341999888420105},{"id":"https://openalex.org/keywords/order","display_name":"Order (exchange)","score":0.4041000008583069},{"id":"https://openalex.org/keywords/repeated-game","display_name":"Repeated game","score":0.36890000104904175}],"concepts":[{"id":"https://openalex.org/C547328371","wikidata":"https://www.wikidata.org/wiki/Q132196","display_name":"Karma","level":3,"score":0.7645000219345093},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6453999876976013},{"id":"https://openalex.org/C2908647359","wikidata":"https://www.wikidata.org/wiki/Q2625603","display_name":"Population","level":2,"score":0.5882999897003174},{"id":"https://openalex.org/C46814582","wikidata":"https://www.wikidata.org/wiki/Q23389","display_name":"Nash equilibrium","level":2,"score":0.560699999332428},{"id":"https://openalex.org/C2777303404","wikidata":"https://www.wikidata.org/wiki/Q759757","display_name":"Convergence (economics)","level":2,"score":0.47029998898506165},{"id":"https://openalex.org/C2778692605","wikidata":"https://www.wikidata.org/wiki/Q4041866","display_name":"Joins","level":2,"score":0.4341999888420105},{"id":"https://openalex.org/C182306322","wikidata":"https://www.wikidata.org/wiki/Q1779371","display_name":"Order (exchange)","level":2,"score":0.4041000008583069},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.3831000030040741},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.3698999881744385},{"id":"https://openalex.org/C202556891","wikidata":"https://www.wikidata.org/wiki/Q1584646","display_name":"Repeated game","level":3,"score":0.36890000104904175},{"id":"https://openalex.org/C9652623","wikidata":"https://www.wikidata.org/wiki/Q190109","display_name":"Field (mathematics)","level":2,"score":0.3546999990940094},{"id":"https://openalex.org/C164407509","wikidata":"https://www.wikidata.org/wiki/Q5384490","display_name":"Equilibrium selection","level":4,"score":0.35429999232292175},{"id":"https://openalex.org/C144237770","wikidata":"https://www.wikidata.org/wiki/Q747534","display_name":"Mathematical economics","level":1,"score":0.33719998598098755},{"id":"https://openalex.org/C162324750","wikidata":"https://www.wikidata.org/wiki/Q8134","display_name":"Economics","level":0,"score":0.3255000114440918},{"id":"https://openalex.org/C22171661","wikidata":"https://www.wikidata.org/wiki/Q1074380","display_name":"Stochastic game","level":2,"score":0.310699999332428},{"id":"https://openalex.org/C73795354","wikidata":"https://www.wikidata.org/wiki/Q287618","display_name":"Sequential game","level":3,"score":0.29899999499320984},{"id":"https://openalex.org/C188198153","wikidata":"https://www.wikidata.org/wiki/Q1613840","display_name":"Limiting","level":2,"score":0.29440000653266907},{"id":"https://openalex.org/C32407928","wikidata":"https://www.wikidata.org/wiki/Q2733833","display_name":"Best response","level":3,"score":0.2784000039100647},{"id":"https://openalex.org/C145071142","wikidata":"https://www.wikidata.org/wiki/Q1411116","display_name":"Fictitious play","level":3,"score":0.27320000529289246},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.26109999418258667},{"id":"https://openalex.org/C175983524","wikidata":"https://www.wikidata.org/wiki/Q1615834","display_name":"Subgame perfect equilibrium","level":3,"score":0.2563000023365021},{"id":"https://openalex.org/C175444787","wikidata":"https://www.wikidata.org/wiki/Q39072","display_name":"Microeconomics","level":1,"score":0.25369998812675476}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2605.11042","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.11042","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2605.11042","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.11042","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Dynamic":[0],"Population":[1],"Games":[2],"(DPGs)":[3],"provide":[4],"a":[5,29,57,79,100,104,116,136,141,149,201,205],"tractable":[6],"framework":[7],"for":[8,45,132,225],"modeling":[9],"strategic":[10],"interactions":[11],"in":[12,56,63,90,98,200],"large":[13],"populations":[14],"of":[15,26,31,50,124,140,145,154,176,219],"self-interested":[16],"agents,":[17],"and":[18,54,114,148,164,192],"have":[19,68],"been":[20],"successfully":[21],"applied":[22],"to":[23,71,198,204,208],"the":[24,51,96,125,160,167,173,178,209,217],"design":[25],"Karma":[27,91,105,220],"economies,":[28],"class":[30],"fair":[32,226],"non-monetary":[33],"resource":[34,227],"allocation":[35],"mechanisms.":[36],"Despite":[37],"their":[38,61,72],"appealing":[39],"theoretical":[40],"properties,":[41],"existing":[42],"computational":[43],"tools":[44,224],"DPGs":[46],"assume":[47],"full":[48],"knowledge":[49,123],"game":[52,126],"model":[53],"operate":[55],"centralized":[58],"fashion,":[59,203],"limiting":[60],"applicability":[62],"realistic":[64],"settings":[65],"where":[66,157],"agents":[67,197],"access":[69],"only":[70],"own":[73],"private":[74],"experience.":[75],"This":[76],"paper":[77],"takes":[78],"step":[80],"towards":[81],"addressing":[82],"this":[83],"gap":[84],"by":[85],"studying":[86],"model-free":[87,202],"equilibrium":[88],"learning":[89,177],"DPGs.":[92],"First,":[93],"we":[94,134,171],"analyze":[95],"setting":[97],"which":[99],"novel":[101],"agent":[102],"joins":[103],"DPG":[106],"already":[107],"at":[108],"its":[109],"Stationary":[110],"Nash":[111],"Equilibrium":[112],"(SNE)":[113],"learns":[115],"policy":[117,194],"via":[118],"Deep":[119],"Q-Networks":[120],"(DQN)":[121],"without":[122],"model.":[127],"Leveraging":[128],"recent":[129],"convergence":[130],"results":[131],"DQN,":[133],"establish":[135],"suboptimality":[137],"bound":[138],"consisting":[139],"DQN":[142],"approximation":[143],"error":[144,153],"order":[146,155],"$O(1/\\sqrt{N_s})$":[147],"mean":[150],"field":[151],"perturbation":[152],"$O(1/N)$,":[156],"$N_s$":[158],"is":[159,166],"replay":[161],"buffer":[162],"size":[163],"$N$":[165],"population":[168],"size.":[169],"Second,":[170],"consider":[172],"challenging":[174],"problem":[175],"SNE":[179],"from":[180],"scratch.":[181],"We":[182],"show":[183],"empirically":[184],"that":[185],"combining":[186],"deep":[187],"RL":[188],"with":[189],"fictitious":[190],"play":[191],"smoothed":[193],"iteration":[195],"allows":[196],"converge,":[199],"configuration":[206],"close":[207],"centrally":[210],"computed":[211],"SNE.":[212],"Together,":[213],"these":[214],"contributions":[215],"support":[216],"vision":[218],"economies":[221],"as":[222],"practical":[223],"allocation.":[228]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-05-14T00:00:00"}
