{"id":"https://openalex.org/W7167091355","doi":"https://doi.org/10.48550/arxiv.2607.00190","title":"Play Like Champions: Counterfactual Feedback Generation in Latent Space","display_name":"Play Like Champions: Counterfactual Feedback Generation in Latent Space","publication_year":2026,"publication_date":"2026-06-30","ids":{"openalex":"https://openalex.org/W7167091355","doi":"https://doi.org/10.48550/arxiv.2607.00190"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2607.00190","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00190","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2607.00190","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5089532410","display_name":"Andrzej Bia\u0142ecki","orcid":"https://orcid.org/0000-0003-3668-4638"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Bia\u0142ecki, Andrzej","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5119522498","display_name":"Adam MASTALERZ","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Mastalerz, Adam","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5139889942","display_name":"Han Zhou","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zhou, Han","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11574","display_name":"Artificial Intelligence in Games","score":0.8335000276565552,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11574","display_name":"Artificial Intelligence in Games","score":0.8335000276565552,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.04089999943971634,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12026","display_name":"Explainable Artificial Intelligence (XAI)","score":0.01590000092983246,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/counterfactual-thinking","display_name":"Counterfactual thinking","score":0.7444999814033508},{"id":"https://openalex.org/keywords/autoencoder","display_name":"Autoencoder","score":0.609000027179718},{"id":"https://openalex.org/keywords/tree-traversal","display_name":"Tree traversal","score":0.5371999740600586},{"id":"https://openalex.org/keywords/amateur","display_name":"Amateur","score":0.4871000051498413},{"id":"https://openalex.org/keywords/representation","display_name":"Representation (politics)","score":0.45719999074935913},{"id":"https://openalex.org/keywords/range","display_name":"Range (aeronautics)","score":0.38589999079704285},{"id":"https://openalex.org/keywords/focus","display_name":"Focus (optics)","score":0.38109999895095825},{"id":"https://openalex.org/keywords/outcome","display_name":"Outcome (game theory)","score":0.3781999945640564},{"id":"https://openalex.org/keywords/conversation","display_name":"Conversation","score":0.3716999888420105}],"concepts":[{"id":"https://openalex.org/C108650721","wikidata":"https://www.wikidata.org/wiki/Q1783253","display_name":"Counterfactual thinking","level":2,"score":0.7444999814033508},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6643000245094299},{"id":"https://openalex.org/C101738243","wikidata":"https://www.wikidata.org/wiki/Q786435","display_name":"Autoencoder","level":3,"score":0.609000027179718},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.6057000160217285},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.5684000253677368},{"id":"https://openalex.org/C140745168","wikidata":"https://www.wikidata.org/wiki/Q1210082","display_name":"Tree traversal","level":2,"score":0.5371999740600586},{"id":"https://openalex.org/C2778044066","wikidata":"https://www.wikidata.org/wiki/Q455595","display_name":"Amateur","level":2,"score":0.4871000051498413},{"id":"https://openalex.org/C2776359362","wikidata":"https://www.wikidata.org/wiki/Q2145286","display_name":"Representation (politics)","level":3,"score":0.45719999074935913},{"id":"https://openalex.org/C204323151","wikidata":"https://www.wikidata.org/wiki/Q905424","display_name":"Range (aeronautics)","level":2,"score":0.38589999079704285},{"id":"https://openalex.org/C192209626","wikidata":"https://www.wikidata.org/wiki/Q190909","display_name":"Focus (optics)","level":2,"score":0.38109999895095825},{"id":"https://openalex.org/C148220186","wikidata":"https://www.wikidata.org/wiki/Q7111912","display_name":"Outcome (game theory)","level":2,"score":0.3781999945640564},{"id":"https://openalex.org/C2777200299","wikidata":"https://www.wikidata.org/wiki/Q52943","display_name":"Conversation","level":2,"score":0.3716999888420105},{"id":"https://openalex.org/C94822996","wikidata":"https://www.wikidata.org/wiki/Q1777902","display_name":"Satisficing","level":2,"score":0.3709000051021576},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.32429999113082886},{"id":"https://openalex.org/C2778572836","wikidata":"https://www.wikidata.org/wiki/Q380933","display_name":"Space (punctuation)","level":2,"score":0.3197999894618988},{"id":"https://openalex.org/C107457646","wikidata":"https://www.wikidata.org/wiki/Q207434","display_name":"Human\u2013computer interaction","level":1,"score":0.3133000135421753},{"id":"https://openalex.org/C176777502","wikidata":"https://www.wikidata.org/wiki/Q4774623","display_name":"Anticipation (artificial intelligence)","level":2,"score":0.30820000171661377},{"id":"https://openalex.org/C2777735758","wikidata":"https://www.wikidata.org/wiki/Q817765","display_name":"Path (computing)","level":2,"score":0.30160000920295715},{"id":"https://openalex.org/C13662910","wikidata":"https://www.wikidata.org/wiki/Q193139","display_name":"Trajectory","level":2,"score":0.28450000286102295},{"id":"https://openalex.org/C2780440489","wikidata":"https://www.wikidata.org/wiki/Q5227278","display_name":"Data-driven","level":2,"score":0.273499995470047},{"id":"https://openalex.org/C59404180","wikidata":"https://www.wikidata.org/wiki/Q17013334","display_name":"Feature learning","level":2,"score":0.2671999931335449},{"id":"https://openalex.org/C114073186","wikidata":"https://www.wikidata.org/wiki/Q2631895","display_name":"Automated planning and scheduling","level":2,"score":0.26570001244544983},{"id":"https://openalex.org/C86251818","wikidata":"https://www.wikidata.org/wiki/Q816754","display_name":"Benchmarking","level":2,"score":0.25940001010894775},{"id":"https://openalex.org/C106189395","wikidata":"https://www.wikidata.org/wiki/Q176789","display_name":"Markov decision process","level":3,"score":0.2590999901294708},{"id":"https://openalex.org/C186886427","wikidata":"https://www.wikidata.org/wiki/Q5441213","display_name":"Feedback loop","level":2,"score":0.25609999895095825},{"id":"https://openalex.org/C177148314","wikidata":"https://www.wikidata.org/wiki/Q170084","display_name":"Generalization","level":2,"score":0.2556000053882599},{"id":"https://openalex.org/C2522767166","wikidata":"https://www.wikidata.org/wiki/Q2374463","display_name":"Data science","level":1,"score":0.2549000084400177},{"id":"https://openalex.org/C126042441","wikidata":"https://www.wikidata.org/wiki/Q1324888","display_name":"Frame (networking)","level":2,"score":0.2542000114917755},{"id":"https://openalex.org/C100776233","wikidata":"https://www.wikidata.org/wiki/Q2532492","display_name":"Bridge (graph theory)","level":2,"score":0.25270000100135803}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2607.00190","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00190","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2607.00190","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2607.00190","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Recent":[0],"advances":[1],"in":[2,62,139,210],"reinforcement":[3],"learning":[4],"have":[5,20,132,168],"produced":[6],"superhuman":[7],"agents":[8,25],"across":[9],"a":[10,17,59,102,122,144,182,216,242],"wide":[11],"range":[12],"of":[13,38,45,100,184,234],"competitive":[14],"games.":[15],"As":[16,126],"byproduct,":[18],"researchers":[19],"begun":[21],"studying":[22],"how":[23],"these":[24],"play,":[26],"extracting":[27],"behavioral":[28],"representations,":[29],"analyzing":[30],"decision":[31],"structure,":[32],"and":[33,72,159,170,196,250],"modeling":[34],"the":[35,135,245],"latent":[36],"geometry":[37],"expert":[39,91,212],"performance.":[40],"However,":[41],"this":[42],"growing":[43],"body":[44],"work":[46],"has":[47,76],"overwhelmingly":[48],"focused":[49],"on":[50,110,149,175,257],"defeating":[51],"human":[52,68,262],"players":[53,230],"rather":[54],"than":[55],"providing":[56],"feedback,":[57],"leaving":[58],"critical":[60],"gap":[61],"creating":[63],"model":[64,114,137,148,259],"solutions":[65,260],"to":[66,79,113,202,228],"improve":[67],"players.":[69],"Unlike":[70],"chess":[71],"Go,":[73],"where":[74],"AI":[75],"become":[77],"integral":[78],"player":[80,115],"training,":[81],"real-time":[82],"strategy":[83],"(RTS)":[84],"games":[85],"lack":[86],"principled":[87],"frameworks":[88],"for":[89,104,128,261],"translating":[90],"knowledge":[92],"into":[93],"actionable":[94],"feedback.":[95],"We":[96,108,142],"introduce":[97],"Latent":[98],"Maps":[99],"Performance,":[101],"framework":[103],"counterfactual":[105,155],"path":[106],"generation.":[107],"focus":[109,256],"StarCraft~II":[111],"data":[112,178],"improvement":[116,205],"as":[117],"an":[118],"algorithmic":[119],"recourse":[120],"within":[121],"learned":[123],"representation":[124],"space.":[125],"inspiration":[127],"our":[129,165],"work,":[130],"we":[131,167,237,248],"looked":[133],"at":[134,225,231],"championship":[136],"used":[138],"sports":[140],"science.":[141],"trained":[143],"Guided":[145],"Variational":[146],"Autoencoder":[147],"23,305":[150],"professional":[151],"tournament":[152],"replays,":[153,186],"enabling":[154],"traversal":[156,173],"between":[157,244],"losing":[158],"winning":[160,220],"gameplay":[161],"profiles.":[162],"To":[163],"fulfill":[164],"goal,":[166],"devised":[169],"verified":[171],"four":[172],"strategies":[174],"out-of-distribution":[176],"(OOD)":[177],"randomly":[179],"sampled":[180],"from":[181],"dataset":[183],"amateur":[185],"namely":[187],"linear":[188],"interpolation,":[189],"iterative":[190],"optimal":[191],"transport,":[192],"density-regularized":[193],"gradient":[194],"ascent,":[195],"neural":[197],"flow":[198],"matching,":[199],"each":[200],"designed":[201],"generate":[203],"multi-step":[204],"trajectories":[206],"that":[207,239,252],"remain":[208],"grounded":[209],"observed":[211],"behavior":[213],"while":[214],"moving":[215],"player's":[217],"profile":[218],"toward":[219],"configurations.":[221],"Feedback":[222],"is":[223,241],"extracted":[224],"multiple":[226],"granularities":[227],"support":[229],"different":[232],"stages":[233],"improvement.":[235,263],"Finally,":[236],"conclude":[238],"there":[240],"trade-off":[243],"path-finding":[246],"methods":[247],"employ":[249],"hope":[251],"future":[253],"research":[254],"will":[255],"developing":[258]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-07-03T00:00:00"}
