{"id":"https://openalex.org/W7164838959","doi":"https://doi.org/10.48550/arxiv.2606.13710","title":"Hybrid Open-Ended Tri-Evolution Makes Better Deep Researcher","display_name":"Hybrid Open-Ended Tri-Evolution Makes Better Deep Researcher","publication_year":2026,"publication_date":"2026-06-10","ids":{"openalex":"https://openalex.org/W7164838959","doi":"https://doi.org/10.48550/arxiv.2606.13710"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2606.13710","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.13710","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2606.13710","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5035521063","display_name":"Hongming Piao","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Piao, Hongming","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5138688481","display_name":"Chi Liu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Liu, Chi","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5138673016","display_name":"Mengzhuo Chen","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Chen, Mengzhuo","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5138667495","display_name":"Yan Shu","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Shu, Yan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":null,"display_name":"Wang, Xidong","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wang, Xidong","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5138634109","display_name":"Derek Li","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Li, Derek","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5138630926","display_name":"Ying Wei","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Wei, Ying","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":null,"display_name":"Dai, Bryan","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Dai, Bryan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.5393999814987183,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T10462","display_name":"Reinforcement Learning in Robotics","score":0.5393999814987183,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T11307","display_name":"Domain Adaptation and Few-Shot Learning","score":0.08569999784231186,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10775","display_name":"Generative Adversarial Networks and Image Synthesis","score":0.053300000727176666,"subfield":{"id":"https://openalex.org/subfields/1707","display_name":"Computer Vision and Pattern Recognition"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/deep-learning","display_name":"Deep learning","score":0.6247000098228455},{"id":"https://openalex.org/keywords/verifiable-secret-sharing","display_name":"Verifiable secret sharing","score":0.6180999875068665},{"id":"https://openalex.org/keywords/reinforcement-learning","display_name":"Reinforcement learning","score":0.5764999985694885},{"id":"https://openalex.org/keywords/bridge","display_name":"Bridge (graph theory)","score":0.5292999744415283},{"id":"https://openalex.org/keywords/autonomous-agent","display_name":"Autonomous agent","score":0.4912000000476837},{"id":"https://openalex.org/keywords/solver","display_name":"Solver","score":0.43290001153945923},{"id":"https://openalex.org/keywords/deep-neural-networks","display_name":"Deep neural networks","score":0.36559998989105225}],"concepts":[{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.7368999719619751},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.670799970626831},{"id":"https://openalex.org/C108583219","wikidata":"https://www.wikidata.org/wiki/Q197536","display_name":"Deep learning","level":2,"score":0.6247000098228455},{"id":"https://openalex.org/C85847156","wikidata":"https://www.wikidata.org/wiki/Q59015987","display_name":"Verifiable secret sharing","level":3,"score":0.6180999875068665},{"id":"https://openalex.org/C97541855","wikidata":"https://www.wikidata.org/wiki/Q830687","display_name":"Reinforcement learning","level":2,"score":0.5764999985694885},{"id":"https://openalex.org/C100776233","wikidata":"https://www.wikidata.org/wiki/Q2532492","display_name":"Bridge (graph theory)","level":2,"score":0.5292999744415283},{"id":"https://openalex.org/C13687954","wikidata":"https://www.wikidata.org/wiki/Q4826847","display_name":"Autonomous agent","level":2,"score":0.4912000000476837},{"id":"https://openalex.org/C2778770139","wikidata":"https://www.wikidata.org/wiki/Q1966904","display_name":"Solver","level":2,"score":0.43290001153945923},{"id":"https://openalex.org/C2984842247","wikidata":"https://www.wikidata.org/wiki/Q197536","display_name":"Deep neural networks","level":3,"score":0.36559998989105225},{"id":"https://openalex.org/C117251300","wikidata":"https://www.wikidata.org/wiki/Q1849855","display_name":"Parametric statistics","level":2,"score":0.3492000102996826},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.33899998664855957},{"id":"https://openalex.org/C19273510","wikidata":"https://www.wikidata.org/wiki/Q263847","display_name":"Artificial life","level":2,"score":0.32429999113082886},{"id":"https://openalex.org/C3018790387","wikidata":"https://www.wikidata.org/wiki/Q869010","display_name":"Hybrid learning","level":2,"score":0.32030001282691956},{"id":"https://openalex.org/C2777826224","wikidata":"https://www.wikidata.org/wiki/Q5250404","display_name":"Deep integration","level":2,"score":0.31360000371932983},{"id":"https://openalex.org/C2778464652","wikidata":"https://www.wikidata.org/wiki/Q309849","display_name":"Open research","level":2,"score":0.3118000030517578},{"id":"https://openalex.org/C50644808","wikidata":"https://www.wikidata.org/wiki/Q192776","display_name":"Artificial neural network","level":2,"score":0.2630000114440918}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2606.13710","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.13710","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2606.13710","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2606.13710","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":null,"issn":null,"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Deep":[0],"research":[1,34,45,86,138,163],"and":[2,24,116,130,170],"agent":[3,48],"evolution":[4,111,175],"serve":[5],"as":[6,155,157],"de-facto":[7],"tasks":[8,77,129],"for":[9],"AI":[10],"agents":[11,53,126],"in":[12,28,127,180],"real-world":[13],"applications":[14],"toward":[15,123],"artificial":[16],"general":[17],"intelligence.":[18],"The":[19,50],"former":[20],"enables":[21],"autonomous":[22,124],"retrieval":[23],"integration":[25],"of":[26,47,112,176],"information":[27],"open-ended":[29,33,85,128],"environments":[30],"to":[31,54,60,107],"tackle":[32],"tasks,":[35,93],"yet":[36],"it":[37],"is":[38,182],"constrained":[39],"by":[40,160],"the":[41,58,96,109,142,149,174],"static":[42,151],"parametric":[43],"deep":[44,137,162],"capabilities":[46],"systems.":[49],"latter":[51],"allows":[52],"autonomously":[55],"interact":[56],"with":[57,78,84,166],"environment":[59],"gain":[61],"experiences":[62],"that":[63,141,173],"evolve":[64],"model":[65,144],"capabilities.":[66],"However,":[67],"its":[68],"effectiveness":[69],"has":[70],"been":[71],"widely":[72],"validated":[73],"only":[74],"on":[75,119,134],"verifiable":[76],"standard":[79],"answers,":[80],"leaving":[81],"a":[82,113],"gap":[83],"tasks.":[87],"To":[88],"bridge":[89],"these":[90],"two":[91],"critical":[92],"we":[94],"propose":[95],"Hybrid":[97],"Open-Ended":[98],"Tri-Evolution":[99],"(HOTE)":[100],"framework,":[101],"which":[102],"leverages":[103],"hybrid-mode":[104],"reinforcement":[105],"learning":[106],"facilitate":[108],"collaborative":[110],"proposer,":[114],"solver":[115],"judge":[117],"based":[118],"web-scale":[120],"knowledge,":[121],"moving":[122],"evolving":[125],"environments.":[131],"Extensive":[132],"experiments":[133],"three":[135,178],"long-form":[136],"benchmarks":[139],"demonstrate":[140],"8B":[143],"trained":[145,159],"via":[146],"HOTE":[147,181],"surpasses":[148],"strongest":[150],"open":[152],"8-32B":[153],"models":[154],"well":[156],"those":[158],"state-of-the-art":[161],"training":[164],"methods":[165],"less":[167],"time":[168],"overhead,":[169],"further":[171],"verify":[172],"all":[177],"modules":[179],"indispensable.":[183]},"counts_by_year":[],"updated_date":"2026-07-21T08:15:58.654021","created_date":"2026-06-16T00:00:00"}
