{"id":"https://openalex.org/W7130570672","doi":"https://doi.org/10.1109/ictc66702.2025.11388085","title":"Multi-Agent Cooperation via Graph Convolutional Reinforcement Learning","display_name":"Multi-Agent Cooperation via Graph Convolutional Reinforcement Learning","publication_year":2025,"publication_date":"2025-10-14","ids":{"openalex":"https://openalex.org/W7130570672","doi":"https://doi.org/10.1109/ictc66702.2025.11388085"},"language":null,"primary_location":{"id":"doi:10.1109/ictc66702.2025.11388085","is_oa":false,"landing_page_url":"https://doi.org/10.1109/ictc66702.2025.11388085","pdf_url":null,"source":null,"license":null,"license_id":null,"version":"publishedVersion","is_accepted":true,"is_published":true,"raw_source_name":"2025 16th International Conference on Information and Communication Technology Convergence (ICTC)","raw_type":"proceedings-article"},"type":"conference-paper","indexed_in":["crossref"],"open_access":{"is_oa":false,"oa_status":"closed","oa_url":null,"any_repository_has_fulltext":false},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5114243483","display_name":"Chaemoon Im","orcid":"https://orcid.org/0009-0009-7270-7332"},"institutions":[{"id":"https://openalex.org/I197347611","display_name":"Korea University","ror":"https://ror.org/047dqcg40","country_code":"KR","type":"education","lineage":["https://openalex.org/I197347611"]}],"countries":["KR"],"is_corresponding":false,"raw_author_name":"Chaemoon Im","raw_affiliation_strings":["Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea"],"raw_orcid":null,"affiliations":[{"raw_affiliation_string":"Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea","institution_ids":["https://openalex.org/I197347611"]}]},{"author_position":"middle","author":{"id":"https://openalex.org/A5030921798","display_name":"JW Choe","orcid":null},"institutions":[{"id":"https://openalex.org/I197347611","display_name":"Korea University","ror":"https://ror.org/047dqcg40","country_code":"KR","type":"education","lineage":["https://openalex.org/I197347611"]}],"countries":["KR"],"is_corresponding":false,"raw_author_name":"Jaeyoung Choe","raw_affiliation_strings":["Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea"],"raw_orcid":null,"affiliations":[{"raw_affiliation_string":"Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea","institution_ids":["https://openalex.org/I197347611"]}]},{"author_position":"last","author":{"id":"https://openalex.org/A5041027404","display_name":"Junsu Kim","orcid":"https://orcid.org/0000-0001-9583-7978"},"institutions":[{"id":"https://openalex.org/I197347611","display_name":"Korea University","ror":"https://ror.org/047dqcg40","country_code":"KR","type":"education","lineage":["https://openalex.org/I197347611"]}],"countries":["KR"],"is_corresponding":false,"raw_author_name":"Joongheon Kim","raw_affiliation_strings":["Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea"],"raw_orcid":null,"affiliations":[{"raw_affiliation_string":"Korea University,Department of Electrical and Computer Engineering,Seoul,Republic of Korea","institution_ids":["https://openalex.org/I197347611"]}]}],"institutions":[],"countries_distinct_count":1,"institutions_distinct_count":1,"corresponding_author_ids":[],"corresponding_institution_ids":["https://openalex.org/I197347611"],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":"158","last_page":"160"},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.598800003528595,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.598800003528595,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11273","display_name":"Advanced Graph Neural Networks","score":0.07050000131130219,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11431","display_name":"Action Observation and Synchronization","score":0.014299999922513962,"subfield":{"id":"https://openalex.org/subfields/3207","display_name":"Social Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.7937999963760376},{"id":"https://openalex.org/keywords/graph","display_name":"Graph","score":0.6251000165939331},{"id":"https://openalex.org/keywords/convolutional-neural-network","display_name":"Convolutional neural network","score":0.46369999647140503},{"id":"https://openalex.org/keywords/reinforcement","display_name":"Reinforcement","score":0.3472999930381775},{"id":"https://openalex.org/keywords/temporal-difference-learning","display_name":"Temporal difference learning","score":0.31029999256134033},{"id":"https://openalex.org/keywords/directed-graph","display_name":"Directed graph","score":0.2962999939918518}],"concepts":[{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.7937999963760376},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.7098000049591064},{"id":"https://openalex.org/C132525143","wikidata":"https://www.wikidata.org/wiki/Q141488","display_name":"Graph","level":2,"score":0.6251000165939331},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5630999803543091},{"id":"https://openalex.org/C81363708","wikidata":"https://www.wikidata.org/wiki/Q17084460","display_name":"Convolutional neural network","level":2,"score":0.46369999647140503},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.4399999976158142},{"id":"https://openalex.org/C80444323","wikidata":"https://www.wikidata.org/wiki/Q2878974","display_name":"Theoretical computer science","level":1,"score":0.36800000071525574},{"id":"https://openalex.org/C67203356","wikidata":"https://www.wikidata.org/wiki/Q1321905","display_name":"Reinforcement","level":2,"score":0.3472999930381775},{"id":"https://openalex.org/C196340769","wikidata":"https://www.wikidata.org/wiki/Q7698910","display_name":"Temporal difference learning","level":3,"score":0.31029999256134033},{"id":"https://openalex.org/C146380142","wikidata":"https://www.wikidata.org/wiki/Q1137726","display_name":"Directed graph","level":2,"score":0.2962999939918518},{"id":"https://openalex.org/C157899210","wikidata":"https://www.wikidata.org/wiki/Q1395022","display_name":"Convolutional code","level":3,"score":0.2822999954223633},{"id":"https://openalex.org/C199190896","wikidata":"https://www.wikidata.org/wiki/Q3509276","display_name":"Learning classifier system","level":3,"score":0.2793000042438507},{"id":"https://openalex.org/C192126672","wikidata":"https://www.wikidata.org/wiki/Q1068715","display_name":"Telecommunications network","level":2,"score":0.2554999887943268}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.1109/ictc66702.2025.11388085","is_oa":false,"landing_page_url":"https://doi.org/10.1109/ictc66702.2025.11388085","pdf_url":null,"source":null,"license":null,"license_id":null,"version":"publishedVersion","is_accepted":true,"is_published":true,"raw_source_name":"2025 16th International Conference on Information and Communication Technology Convergence (ICTC)","raw_type":"proceedings-article"}],"best_oa_location":null,"sustainable_development_goals":[{"display_name":"Peace, Justice and strong institutions","score":0.529549777507782,"id":"https://metadata.un.org/sdg/16"}],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":11,"referenced_works":["https://openalex.org/W1996387377","https://openalex.org/W2160458341","https://openalex.org/W2160643434","https://openalex.org/W2306309037","https://openalex.org/W2907492528","https://openalex.org/W2962851073","https://openalex.org/W4231449374","https://openalex.org/W4389370937","https://openalex.org/W4390843813","https://openalex.org/W4392251604","https://openalex.org/W7124263640"],"related_works":[],"abstract_inverted_index":{"Among":[0],"many":[1],"factors":[2],"in":[3,26,73],"group-level":[4],"decision":[5],"making,":[6],"communication":[7,40,59],"between":[8,61],"agents":[9,25],"are":[10],"significant":[11],"to":[12,56],"learn":[13],"cooperative":[14],"behavior,":[15],"because":[16],"it":[17],"determines":[18],"the":[19,24,27,58,62,67,70],"tendency":[20],"of":[21,23,69,75],"actions":[22],"group.":[28],"Unlike":[29],"conventional":[30],"multi-agent":[31],"reinforcement":[32],"learning":[33],"(MARL)":[34],"algorithms":[35],"which":[36,50],"assumes":[37],"ideal,":[38],"static":[39],"environment,":[41],"this":[42],"paper":[43],"proposes":[44],"Graph":[45,52],"Convolutional":[46,53],"Reinforcement":[47],"Learning":[48],"(GCRL),":[49],"utilizes":[51],"Neural":[54],"Network":[55],"analyze":[57],"status":[60],"agents.":[63],"Experiment":[64],"results":[65],"shows":[66],"potential":[68],"proposed":[71],"GCRL,":[72],"terms":[74],"maximized":[76],"reward.":[77]},"counts_by_year":[],"updated_date":"2026-07-14T23:27:15.235271","created_date":"2026-02-20T00:00:00"}
