{"id":"https://openalex.org/W7154939597","doi":"https://doi.org/10.48550/arxiv.2604.15772","title":"Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS)","display_name":"Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS)","publication_year":2026,"publication_date":"2026-04-17","ids":{"openalex":"https://openalex.org/W7154939597","doi":"https://doi.org/10.48550/arxiv.2604.15772"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2604.15772","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.15772","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2604.15772","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5128645775","display_name":"H\u00fcrkan \u015eahin","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"\u015eahin, H\u00fcrkan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5050242881","display_name":"Van Dang","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Dang, Van Huyen","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5022288387","display_name":"Erdi Sayar","orcid":"https://orcid.org/0000-0002-5944-7291"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Sayar, Erdi","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5134053096","display_name":"Alper Yegenoglu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Yegenoglu, Alper","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5068099488","display_name":"Erdal Kayacan","orcid":"https://orcid.org/0000-0002-7143-8777"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Kayacan, Erdal","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.7576000094413757,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.7576000094413757,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10586","display_name":"Robotic Path Planning Algorithms","score":0.03700000047683716,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11133","display_name":"UAV Applications and Optimization","score":0.03200000151991844,"subfield":{"id":"https://openalex.org/subfields/2202","display_name":"Aerospace Engineering"},"field":{"id":"https://openalex.org/fields/22","display_name":"Engineering"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.7124000191688538},{"id":"https://openalex.org/keywords/fuzzy-logic","display_name":"Fuzzy logic","score":0.6524999737739563},{"id":"https://openalex.org/keywords/intuition","display_name":"Intuition","score":0.5995000004768372},{"id":"https://openalex.org/keywords/task","display_name":"Task (project management)","score":0.5135999917984009},{"id":"https://openalex.org/keywords/fuzzy-control-system","display_name":"Fuzzy control system","score":0.4065000116825104},{"id":"https://openalex.org/keywords/convergence","display_name":"Convergence (economics)","score":0.38760000467300415},{"id":"https://openalex.org/keywords/state","display_name":"State (computer science)","score":0.34450000524520874},{"id":"https://openalex.org/keywords/learning-classifier-system","display_name":"Learning classifier system","score":0.3215000033378601}],"concepts":[{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.7124000191688538},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6618000268936157},{"id":"https://openalex.org/C58166","wikidata":"https://www.wikidata.org/wiki/Q224821","display_name":"Fuzzy logic","level":2,"score":0.6524999737739563},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.6176999807357788},{"id":"https://openalex.org/C132010649","wikidata":"https://www.wikidata.org/wiki/Q189222","display_name":"Intuition","level":2,"score":0.5995000004768372},{"id":"https://openalex.org/C2780451532","wikidata":"https://www.wikidata.org/wiki/Q759676","display_name":"Task (project management)","level":2,"score":0.5135999917984009},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.44269999861717224},{"id":"https://openalex.org/C195975749","wikidata":"https://www.wikidata.org/wiki/Q1475705","display_name":"Fuzzy control system","level":3,"score":0.4065000116825104},{"id":"https://openalex.org/C2777303404","wikidata":"https://www.wikidata.org/wiki/Q759757","display_name":"Convergence (economics)","level":2,"score":0.38760000467300415},{"id":"https://openalex.org/C48103436","wikidata":"https://www.wikidata.org/wiki/Q599031","display_name":"State (computer science)","level":2,"score":0.34450000524520874},{"id":"https://openalex.org/C199190896","wikidata":"https://www.wikidata.org/wiki/Q3509276","display_name":"Learning classifier system","level":3,"score":0.3215000033378601},{"id":"https://openalex.org/C63479239","wikidata":"https://www.wikidata.org/wiki/Q7353546","display_name":"Robustness (evolution)","level":3,"score":0.2856999933719635},{"id":"https://openalex.org/C2775924081","wikidata":"https://www.wikidata.org/wiki/Q55608371","display_name":"Control (management)","level":2,"score":0.28040000796318054},{"id":"https://openalex.org/C175154964","wikidata":"https://www.wikidata.org/wiki/Q380077","display_name":"Task analysis","level":3,"score":0.27480000257492065},{"id":"https://openalex.org/C26517878","wikidata":"https://www.wikidata.org/wiki/Q228039","display_name":"Key (lock)","level":2,"score":0.2727999985218048},{"id":"https://openalex.org/C112972136","wikidata":"https://www.wikidata.org/wiki/Q7595718","display_name":"Stability (learning theory)","level":2,"score":0.26980000734329224},{"id":"https://openalex.org/C13687954","wikidata":"https://www.wikidata.org/wiki/Q4826847","display_name":"Autonomous agent","level":2,"score":0.2630000114440918},{"id":"https://openalex.org/C107464732","wikidata":"https://www.wikidata.org/wiki/Q235781","display_name":"Adaptive control","level":3,"score":0.26109999418258667},{"id":"https://openalex.org/C52970973","wikidata":"https://www.wikidata.org/wiki/Q2497134","display_name":"Adaptive system","level":2,"score":0.26100000739097595},{"id":"https://openalex.org/C21200559","wikidata":"https://www.wikidata.org/wiki/Q7451068","display_name":"Sensitivity (control systems)","level":2,"score":0.25189998745918274}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2604.15772","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.15772","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2604.15772","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2604.15772","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"grobid_xml":false,"pdf":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Reinforcement":[0],"learning":[1,64,108],"(RL)":[2],"often":[3],"struggles":[4],"in":[5,30,94,132],"real-world":[6],"tasks":[7],"with":[8,136],"high-dimensional":[9],"state":[10],"spaces":[11],"and":[12,24,57,65,91,110,125],"long":[13],"horizons,":[14],"where":[15],"sparse":[16],"or":[17],"fixed":[18],"rewards":[19],"severely":[20],"slow":[21],"down":[22],"exploration":[23],"cause":[25],"agents":[26],"to":[27,68,76,142,147],"get":[28],"trapped":[29],"local":[31],"optima.":[32],"This":[33],"paper":[34],"presents":[35],"a":[36],"fuzzy":[37,60,149],"logic":[38],"based":[39,80],"reward":[40,49,78,150],"shaping":[41],"method":[42,72,121],"that":[43],"integrates":[44],"human":[45],"intuition":[46],"into":[47,55],"RL":[48],"design.":[50],"By":[51],"encoding":[52],"expert":[53],"knowledge":[54],"adaptive":[56],"interpreable":[58],"terms,":[59],"rules":[61],"promote":[62],"stable":[63,107],"reduce":[66],"sensitivity":[67],"hyperparameters.":[69],"The":[70,119],"proposed":[71,120],"leverages":[73],"these":[74],"properties":[75],"adapt":[77],"contributions":[79],"on":[81,101],"the":[82],"agent":[83],"state,":[84],"enabling":[85],"smoother":[86],"transitions":[87],"between":[88],"fast":[89],"motion":[90],"precise":[92],"control":[93],"challenging":[95,134],"navigation":[96],"tasks.":[97],"Extensive":[98],"simulation":[99],"results":[100],"autonomous":[102],"drone":[103],"racing":[104],"benchmarks":[105],"show":[106],"behavior":[109],"consistent":[111],"task":[112],"performance":[113,127],"across":[114,129],"scenarios":[115],"of":[116],"increasing":[117],"difficulty.":[118],"achieves":[122],"faster":[123],"convergence":[124],"reduced":[126],"variability":[128],"training":[130],"seeds":[131],"more":[133],"environments,":[135],"success":[137],"rates":[138],"improving":[139],"by":[140],"up":[141],"approximately":[143],"5":[144],"percent":[145],"compared":[146],"non":[148],"formulations.":[151]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-04-21T00:00:00"}
