{"id":"https://openalex.org/W7138911355","doi":"https://doi.org/10.48550/arxiv.2603.16576","title":"REFORGE: Multi-modal Attacks Reveal Vulnerable Concept Unlearning in Image Generation Models","display_name":"REFORGE: Multi-modal Attacks Reveal Vulnerable Concept Unlearning in Image Generation Models","publication_year":2026,"publication_date":"2026-03-17","ids":{"openalex":"https://openalex.org/W7138911355","doi":"https://doi.org/10.48550/arxiv.2603.16576"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2603.16576","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.16576","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2603.16576","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5130184083","display_name":"Yong Zou","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zou, Yong","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130138141","display_name":"Haoran Li","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Li, Haoran","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130007659","display_name":"Fanxiao Li","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Li, Fanxiao","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5111269462","display_name":"Shenyang Wei","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wei, Shenyang","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130200918","display_name":"Yunyun Dong","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Dong, Yunyun","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130029663","display_name":"Li Tang","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Tang, Li","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5130190183","display_name":"Wei Jia Zhou","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zhou, Wei","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5129827528","display_name":"Renyang Liu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Liu, Renyang","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11689","display_name":"Adversarial Robustness in Machine Learning","score":0.5299000144004822,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11689","display_name":"Adversarial Robustness in Machine Learning","score":0.5299000144004822,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10775","display_name":"Generative Adversarial Networks and Image Synthesis","score":0.3889000117778778,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12262","display_name":"Hate Speech and Cyberbullying Detection","score":0.012799999676644802,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/adversarial-system","display_name":"Adversarial system","score":0.8597999811172485},{"id":"https://openalex.org/keywords/robustness","display_name":"Robustness (evolution)","score":0.6851000189781189},{"id":"https://openalex.org/keywords/offensive","display_name":"Offensive","score":0.679099977016449},{"id":"https://openalex.org/keywords/image-manipulation","display_name":"Image manipulation","score":0.37880000472068787},{"id":"https://openalex.org/keywords/masking","display_name":"Masking (illustration)","score":0.3407999873161316},{"id":"https://openalex.org/keywords/threat-model","display_name":"Threat model","score":0.3310000002384186},{"id":"https://openalex.org/keywords/noise","display_name":"Noise (video)","score":0.29670000076293945}],"concepts":[{"id":"https://openalex.org/C37736160","wikidata":"https://www.wikidata.org/wiki/Q1801315","display_name":"Adversarial system","level":2,"score":0.8597999811172485},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.7714999914169312},{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.6851000189781189},{"id":"https://openalex.org/C176856949","wikidata":"https://www.wikidata.org/wiki/Q2001676","display_name":"Offensive","level":2,"score":0.679099977016449},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.4465999901294708},{"id":"https://openalex.org/C2987933465","wikidata":"https://www.wikidata.org/wiki/Q141130","display_name":"Image manipulation","level":3,"score":0.37880000472068787},{"id":"https://openalex.org/C38652104","wikidata":"https://www.wikidata.org/wiki/Q3510521","display_name":"Computer security","level":1,"score":0.3521000146865845},{"id":"https://openalex.org/C2777402240","wikidata":"https://www.wikidata.org/wiki/Q6783436","display_name":"Masking (illustration)","level":2,"score":0.3407999873161316},{"id":"https://openalex.org/C140547941","wikidata":"https://www.wikidata.org/wiki/Q7797194","display_name":"Threat model","level":2,"score":0.3310000002384186},{"id":"https://openalex.org/C31972630","wikidata":"https://www.wikidata.org/wiki/Q844240","display_name":"Computer vision","level":1,"score":0.31610000133514404},{"id":"https://openalex.org/C99498987","wikidata":"https://www.wikidata.org/wiki/Q2210247","display_name":"Noise (video)","level":3,"score":0.29670000076293945},{"id":"https://openalex.org/C115961682","wikidata":"https://www.wikidata.org/wiki/Q860623","display_name":"Image (mathematics)","level":2,"score":0.2838999927043915},{"id":"https://openalex.org/C2776674983","wikidata":"https://www.wikidata.org/wiki/Q545981","display_name":"Image editing","level":3,"score":0.27239999175071716},{"id":"https://openalex.org/C2776760102","wikidata":"https://www.wikidata.org/wiki/Q5139990","display_name":"Code (set theory)","level":3,"score":0.259799987077713},{"id":"https://openalex.org/C9417928","wikidata":"https://www.wikidata.org/wiki/Q1070689","display_name":"Image processing","level":3,"score":0.2581999897956848},{"id":"https://openalex.org/C65856478","wikidata":"https://www.wikidata.org/wiki/Q3991682","display_name":"Attack model","level":2,"score":0.2556000053882599},{"id":"https://openalex.org/C26517878","wikidata":"https://www.wikidata.org/wiki/Q228039","display_name":"Key (lock)","level":2,"score":0.25529998540878296}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2603.16576","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.16576","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2603.16576","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.16576","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Recent":[0],"progress":[1],"in":[2,53,133],"image":[3,75],"generation":[4,23],"models":[5],"(IGMs)":[6],"enables":[7],"high-fidelity":[8],"content":[9,20],"creation":[10],"but":[11],"also":[12],"amplifies":[13],"risks,":[14],"including":[15],"the":[16,22,45,139],"reproduction":[17],"of":[18,24],"copyrighted":[19],"and":[21,81,98,107,122,137],"offensive":[25],"content.":[26],"Image":[27],"Generation":[28],"Model":[29],"Unlearning":[30],"(IGMU)":[31],"mitigates":[32],"these":[33],"risks":[34],"by":[35],"removing":[36],"harmful":[37],"concepts":[38],"without":[39],"full":[40],"retraining.":[41],"Despite":[42],"growing":[43],"attention,":[44],"robustness":[46,72],"under":[47],"adversarial":[48,74,146],"inputs,":[49],"particularly":[50],"image-side":[51],"threats":[52],"black-box":[54,66],"settings,":[55],"remains":[56],"underexplored.":[57],"To":[58],"bridge":[59],"this":[60],"gap,":[61],"we":[62],"present":[63],"REFORGE,":[64],"a":[65,85],"red-teaming":[67],"framework":[68],"that":[69,89,110],"evaluates":[70],"IGMU":[71,135],"via":[73],"prompts.":[76],"REFORGE":[77,111],"initializes":[78],"stroke-based":[79],"images":[80],"optimizes":[82],"perturbations":[83],"with":[84],"cross-attention-guided":[86],"masking":[87],"strategy":[88],"allocates":[90],"noise":[91],"to":[92],"concept-relevant":[93],"regions,":[94],"balancing":[95],"attack":[96,114],"efficacy":[97],"visual":[99],"fidelity.":[100],"Extensive":[101],"experiments":[102],"across":[103],"representative":[104],"unlearning":[105,143],"tasks":[106],"defenses":[108],"demonstrate":[109],"significantly":[112],"improves":[113],"success":[115],"rate":[116],"while":[117],"achieving":[118],"stronger":[119],"semantic":[120],"alignment":[121],"higher":[123],"efficiency":[124],"than":[125],"involved":[126],"baselines.":[127],"These":[128],"results":[129],"expose":[130],"persistent":[131],"vulnerabilities":[132],"current":[134],"methods":[136],"highlight":[138],"need":[140],"for":[141],"robustness-aware":[142],"against":[144],"multi-modal":[145],"attacks.":[147],"Our":[148],"code":[149],"is":[150],"at:":[151],"https://github.com/Imfatnoily/REFORGE.":[152]},"counts_by_year":[],"updated_date":"2026-07-01T06:00:48.157686","created_date":"2026-03-20T00:00:00"}
