{"id":"https://openalex.org/W7161125821","doi":"https://doi.org/10.48550/arxiv.2605.13595","title":"Inducing Artificial Uncertainty in Language Models","display_name":"Inducing Artificial Uncertainty in Language Models","publication_year":2026,"publication_date":"2026-05-13","ids":{"openalex":"https://openalex.org/W7161125821","doi":"https://doi.org/10.48550/arxiv.2605.13595"},"language":null,"primary_location":{"id":"doi:10.48550/arxiv.2605.13595","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.13595","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"type":"preprint","indexed_in":["datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://doi.org/10.48550/arxiv.2605.13595","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5113264755","display_name":"Sophia Hager","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Hager, Sophia","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"middle","author":{"id":"https://openalex.org/A5129249592","display_name":"Simon Zeng","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Zeng, Simon","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5136106478","display_name":"Nicholas Andrews","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Andrews, Nicholas","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11689","display_name":"Adversarial Robustness in Machine Learning","score":0.7519999742507935,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11689","display_name":"Adversarial Robustness in Machine Learning","score":0.7519999742507935,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12026","display_name":"Explainable Artificial Intelligence (XAI)","score":0.06679999828338623,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10028","display_name":"Topic Modeling","score":0.04039999842643738,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/calibration","display_name":"Calibration","score":0.6377999782562256},{"id":"https://openalex.org/keywords/uncertainty-quantification","display_name":"Uncertainty quantification","score":0.5041999816894531},{"id":"https://openalex.org/keywords/language-model","display_name":"Language model","score":0.4530999958515167},{"id":"https://openalex.org/keywords/training-set","display_name":"Training set","score":0.4408000111579895},{"id":"https://openalex.org/keywords/uncertainty-analysis","display_name":"Uncertainty analysis","score":0.4334999918937683},{"id":"https://openalex.org/keywords/measurement-uncertainty","display_name":"Measurement uncertainty","score":0.351500004529953},{"id":"https://openalex.org/keywords/synthetic-data","display_name":"Synthetic data","score":0.33309999108314514}],"concepts":[{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.6883000135421753},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6546000242233276},{"id":"https://openalex.org/C165838908","wikidata":"https://www.wikidata.org/wiki/Q736777","display_name":"Calibration","level":2,"score":0.6377999782562256},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.6011000275611877},{"id":"https://openalex.org/C32230216","wikidata":"https://www.wikidata.org/wiki/Q7882499","display_name":"Uncertainty quantification","level":2,"score":0.5041999816894531},{"id":"https://openalex.org/C137293760","wikidata":"https://www.wikidata.org/wiki/Q3621696","display_name":"Language model","level":2,"score":0.4530999958515167},{"id":"https://openalex.org/C51632099","wikidata":"https://www.wikidata.org/wiki/Q3985153","display_name":"Training set","level":2,"score":0.4408000111579895},{"id":"https://openalex.org/C177803969","wikidata":"https://www.wikidata.org/wiki/Q29205","display_name":"Uncertainty analysis","level":2,"score":0.4334999918937683},{"id":"https://openalex.org/C137209882","wikidata":"https://www.wikidata.org/wiki/Q1403517","display_name":"Measurement uncertainty","level":2,"score":0.351500004529953},{"id":"https://openalex.org/C160920958","wikidata":"https://www.wikidata.org/wiki/Q7662746","display_name":"Synthetic data","level":2,"score":0.33309999108314514},{"id":"https://openalex.org/C176147448","wikidata":"https://www.wikidata.org/wiki/Q1889114","display_name":"Sensitivity analysis","level":3,"score":0.3280999958515167},{"id":"https://openalex.org/C9357733","wikidata":"https://www.wikidata.org/wiki/Q6878417","display_name":"Missing data","level":2,"score":0.3050000071525574},{"id":"https://openalex.org/C55037315","wikidata":"https://www.wikidata.org/wiki/Q5421151","display_name":"Experimental data","level":2,"score":0.28630000352859497},{"id":"https://openalex.org/C67186912","wikidata":"https://www.wikidata.org/wiki/Q367664","display_name":"Data modeling","level":2,"score":0.273499995470047},{"id":"https://openalex.org/C204321447","wikidata":"https://www.wikidata.org/wiki/Q30642","display_name":"Natural language processing","level":1,"score":0.26089999079704285},{"id":"https://openalex.org/C2781170535","wikidata":"https://www.wikidata.org/wiki/Q30587856","display_name":"Noisy data","level":2,"score":0.2597000002861023},{"id":"https://openalex.org/C94361409","wikidata":"https://www.wikidata.org/wiki/Q7882500","display_name":"Uncertainty reduction theory","level":2,"score":0.25540000200271606}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.48550/arxiv.2605.13595","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.13595","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"doi:10.48550/arxiv.2605.13595","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2605.13595","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":null,"is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"Preprint"},"sustainable_development_goals":[{"display_name":"Quality Education","score":0.43084654211997986,"id":"https://metadata.un.org/sdg/4"}],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"In":[0],"safety-critical":[1],"applications,":[2],"language":[3,33,108],"models":[4,34,80],"should":[5],"be":[6,83],"able":[7],"to":[8,72,134],"characterize":[9],"their":[10],"uncertainty":[11,16,54,71,75,106,116,137,150,156],"with":[12,168],"meaningful":[13],"probabilities.":[14],"Many":[15],"quantification":[17,55,76],"approaches":[18],"require":[19],"supervised":[20,74],"data;":[21],"however,":[22],"finding":[23],"suitable":[24],"unseen":[25],"challenging":[26,125],"data":[27,67,120,126,167],"is":[28,45],"increasingly":[29],"difficult":[30],"for":[31,78],"large":[32],"trained":[35,133,147,153],"on":[36,61,117,138,148,165,173],"vast":[37],"amounts":[38],"of":[39,103,113,124,171],"scraped":[40],"data.":[41,65,175],"If":[42],"the":[43,53,101,122,139],"model":[44],"consistently":[46,58],"(and":[47],"correctly)":[48],"confident":[49],"in":[50,88,107,121,157],"its":[51],"predictions,":[52],"method":[56],"may":[57,81],"overestimate":[59],"confidence":[60],"new":[62],"and":[63,85,142],"unfamiliar":[64],"Finding":[66],"which":[68],"exhibits":[69],"enough":[70],"train":[73],"methods":[77,112],"high-performance":[79],"therefore":[82],"challenging,":[84],"will":[86],"increase":[87],"difficulty":[89],"as":[90],"LLMs":[91],"saturate":[92],"datasets.":[93],"To":[94],"address":[95],"this":[96],"issue,":[97],"we":[98],"first":[99],"introduce":[100],"problem":[102],"inducing":[104,114],"artificial":[105,115,136,149,155],"models,":[109],"then":[110],"investigate":[111],"trivially":[118],"easy":[119,174],"absence":[123],"at":[127],"training":[128],"time.":[129],"We":[130],"use":[131],"probes":[132,146,152],"recognize":[135],"original":[140],"model,":[141],"find":[143],"that":[144],"these":[145],"outperform":[151],"without":[154],"recognizing":[158],"real":[159],"uncertainty,":[160],"achieving":[161],"notably":[162],"higher":[163],"calibration":[164],"hard":[166],"minimal":[169],"loss":[170],"performance":[172]},"counts_by_year":[],"updated_date":"2026-07-28T07:46:37.118299","created_date":"2026-05-15T00:00:00"}
