{"id":"https://openalex.org/W7147594738","doi":"https://doi.org/10.48550/arxiv.2603.26993","title":"On the Reliability Limits of LLM-Based Multi-Agent Planning","display_name":"On the Reliability Limits of LLM-Based Multi-Agent Planning","publication_year":2026,"publication_date":"2026-03-27","ids":{"openalex":"https://openalex.org/W7147594738","doi":"https://doi.org/10.48550/arxiv.2603.26993"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2603.26993","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.26993","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2603.26993","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5069808887","display_name":"Ruicheng Ao","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Ao, Ruicheng","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5132643561","display_name":"Siyang Gao","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Gao, Siyang","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5127870930","display_name":"David Simchi-Levi","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Simchi-Levi, David","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T12031","display_name":"Speech and dialogue systems","score":0.21449999511241913,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T12031","display_name":"Speech and dialogue systems","score":0.21449999511241913,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11303","display_name":"Bayesian Modeling and Causal Inference","score":0.15070000290870667,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.06859999895095825,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/reliability","display_name":"Reliability (semiconductor)","score":0.669700026512146},{"id":"https://openalex.org/keywords/logarithm","display_name":"Logarithm","score":0.4925000071525574},{"id":"https://openalex.org/keywords/bayes-theorem","display_name":"Bayes' theorem","score":0.4514999985694885},{"id":"https://openalex.org/keywords/set","display_name":"Set (abstract data type)","score":0.40950000286102295},{"id":"https://openalex.org/keywords/telecommunications-network","display_name":"Telecommunications network","score":0.40639999508857727},{"id":"https://openalex.org/keywords/value","display_name":"Value (mathematics)","score":0.3991999924182892},{"id":"https://openalex.org/keywords/divergence","display_name":"Divergence (linguistics)","score":0.3808000087738037},{"id":"https://openalex.org/keywords/decision-theory","display_name":"Decision theory","score":0.3792000114917755},{"id":"https://openalex.org/keywords/expected-value","display_name":"Expected value","score":0.3628000020980835}],"concepts":[{"id":"https://openalex.org/C43214815","wikidata":"https://www.wikidata.org/wiki/Q7310987","display_name":"Reliability (semiconductor)","level":3,"score":0.669700026512146},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.5837000012397766},{"id":"https://openalex.org/C39927690","wikidata":"https://www.wikidata.org/wiki/Q11197","display_name":"Logarithm","level":2,"score":0.4925000071525574},{"id":"https://openalex.org/C207201462","wikidata":"https://www.wikidata.org/wiki/Q182505","display_name":"Bayes' theorem","level":3,"score":0.4514999985694885},{"id":"https://openalex.org/C177264268","wikidata":"https://www.wikidata.org/wiki/Q1514741","display_name":"Set (abstract data type)","level":2,"score":0.40950000286102295},{"id":"https://openalex.org/C192126672","wikidata":"https://www.wikidata.org/wiki/Q1068715","display_name":"Telecommunications network","level":2,"score":0.40639999508857727},{"id":"https://openalex.org/C2776291640","wikidata":"https://www.wikidata.org/wiki/Q2912517","display_name":"Value (mathematics)","level":2,"score":0.3991999924182892},{"id":"https://openalex.org/C207390915","wikidata":"https://www.wikidata.org/wiki/Q1230525","display_name":"Divergence (linguistics)","level":2,"score":0.3808000087738037},{"id":"https://openalex.org/C28901747","wikidata":"https://www.wikidata.org/wiki/Q177571","display_name":"Decision theory","level":2,"score":0.3792000114917755},{"id":"https://openalex.org/C141042865","wikidata":"https://www.wikidata.org/wiki/Q200125","display_name":"Expected value","level":2,"score":0.3628000020980835},{"id":"https://openalex.org/C201729545","wikidata":"https://www.wikidata.org/wiki/Q2193887","display_name":"Reliability theory","level":3,"score":0.33640000224113464},{"id":"https://openalex.org/C162392398","wikidata":"https://www.wikidata.org/wiki/Q272404","display_name":"Finite set","level":2,"score":0.33500000834465027},{"id":"https://openalex.org/C33724603","wikidata":"https://www.wikidata.org/wiki/Q812540","display_name":"Bayesian network","level":2,"score":0.3303000032901764},{"id":"https://openalex.org/C98045186","wikidata":"https://www.wikidata.org/wiki/Q205663","display_name":"Process (computing)","level":2,"score":0.3248000144958496},{"id":"https://openalex.org/C92424840","wikidata":"https://www.wikidata.org/wiki/Q7912772","display_name":"Value of information","level":2,"score":0.3154999911785126},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.31040000915527344},{"id":"https://openalex.org/C205706631","wikidata":"https://www.wikidata.org/wiki/Q2319304","display_name":"Expected utility hypothesis","level":2,"score":0.30709999799728394},{"id":"https://openalex.org/C115988155","wikidata":"https://www.wikidata.org/wiki/Q3262192","display_name":"Decision problem","level":2,"score":0.3012000024318695},{"id":"https://openalex.org/C8272713","wikidata":"https://www.wikidata.org/wiki/Q176737","display_name":"Stochastic process","level":2,"score":0.2987000048160553},{"id":"https://openalex.org/C113336015","wikidata":"https://www.wikidata.org/wiki/Q574010","display_name":"Complete information","level":2,"score":0.2971999943256378},{"id":"https://openalex.org/C2776505523","wikidata":"https://www.wikidata.org/wiki/Q4785468","display_name":"Plan (archaeology)","level":2,"score":0.2888000011444092},{"id":"https://openalex.org/C44492722","wikidata":"https://www.wikidata.org/wiki/Q327069","display_name":"Conditional probability","level":2,"score":0.28850001096725464},{"id":"https://openalex.org/C42475967","wikidata":"https://www.wikidata.org/wiki/Q194292","display_name":"Operations research","level":1,"score":0.28610000014305115},{"id":"https://openalex.org/C2984634286","wikidata":"https://www.wikidata.org/wiki/Q1331926","display_name":"Decision process","level":2,"score":0.260699987411499},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.2563000023365021},{"id":"https://openalex.org/C186116695","wikidata":"https://www.wikidata.org/wiki/Q5249226","display_name":"Decision analysis","level":2,"score":0.2533999979496002},{"id":"https://openalex.org/C59594135","wikidata":"https://www.wikidata.org/wiki/Q5249242","display_name":"Decision model","level":2,"score":0.25099998712539673}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2603.26993","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.26993","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2603.26993","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2603.26993","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"score":0.7265658974647522,"id":"https://metadata.un.org/sdg/16","display_name":"Peace, Justice and strong institutions"}],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"This":[0],"technical":[1],"note":[2],"studies":[3],"the":[4,18,70,74,101,107,119,122,127,153,159],"reliability":[5,161],"limits":[6,162],"of":[7,163],"LLM-based":[8,19],"multi-agent":[9,20,82],"planning":[10],"as":[11,22,94],"a":[12,23,62,87,96,171],"delegated":[13,56,164],"decision":[14,26,65],"problem.":[15],"We":[16,48,104],"model":[17],"architecture":[21],"finite":[24,88],"acyclic":[25,84],"network":[27,57],"in":[28],"which":[29,137],"multiple":[30],"stages":[31],"process":[32],"shared":[33,102],"model-context":[34],"information,":[35],"communicate":[36],"through":[37],"language":[38],"interfaces":[39],"with":[40,67,168],"limited":[41],"capacity,":[42],"and":[43,112,126,146],"may":[44],"invoke":[45],"human":[46],"review.":[47],"show":[49],"that,":[50],"without":[51],"new":[52],"exogenous":[53],"signals,":[54],"any":[55],"is":[58],"decision-theoretically":[59],"dominated":[60],"by":[61,110],"centralized":[63,123],"Bayes":[64,124],"maker":[66],"access":[68],"to":[69,139,147],"same":[71],"information.":[72],"In":[73],"common-evidence":[75],"regime,":[76],"this":[77],"implies":[78],"that":[79],"optimizing":[80],"over":[81],"directed":[83],"graphs":[85],"under":[86,143,152],"communication":[89,111,130],"budget":[90],"can":[91],"be":[92],"recast":[93],"choosing":[95],"budget-constrained":[97],"stochastic":[98],"experiment":[99],"on":[100,170],"signal.":[103],"also":[105],"characterize":[106,158],"loss":[108,145],"induced":[109],"information":[113,142],"compression.":[114],"Under":[115],"proper":[116],"scoring":[117],"rules,":[118],"gap":[120],"between":[121],"value":[125,128],"after":[129],"admits":[131],"an":[132],"expected":[133,148],"posterior":[134,150],"divergence":[135],"representation,":[136],"reduces":[138],"conditional":[140],"mutual":[141],"logarithmic":[144],"squared":[149],"error":[151],"Brier":[154],"score.":[155],"These":[156],"results":[157],"fundamental":[160],"LLM":[165],"planning.":[166],"Experiments":[167],"LLMs":[169],"controlled":[172],"problem":[173],"set":[174],"further":[175],"demonstrate":[176],"these":[177],"characterizations.":[178]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-04-02T00:00:00"}
