{"id":"https://openalex.org/W4414405507","doi":"https://doi.org/10.1109/clusterworkshops65972.2025.11164196","title":"FastEM: an efficient EM algorithm for learning Gaussian mixture models on compute clusters","display_name":"FastEM: an efficient EM algorithm for learning Gaussian mixture models on compute clusters","publication_year":2025,"publication_date":"2025-09-02","ids":{"openalex":"https://openalex.org/W4414405507","doi":"https://doi.org/10.1109/clusterworkshops65972.2025.11164196"},"language":"en","primary_location":{"id":"doi:10.1109/clusterworkshops65972.2025.11164196","is_oa":false,"landing_page_url":"https://doi.org/10.1109/clusterworkshops65972.2025.11164196","pdf_url":null,"source":null,"license":null,"license_id":null,"version":"publishedVersion","is_accepted":true,"is_published":true,"raw_source_name":"2025 IEEE International Conference on Cluster Computing Workshops (CLUSTER Workshops)","raw_type":"proceedings-article"},"type":"conference-paper","indexed_in":["crossref"],"open_access":{"is_oa":false,"oa_status":"closed","oa_url":null,"any_repository_has_fulltext":false},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5015365508","display_name":"Wojciech Kwedlo","orcid":"https://orcid.org/0000-0002-5040-2302"},"institutions":[{"id":"https://openalex.org/I1323121030","display_name":"Bialystok University of Technology","ror":"https://ror.org/02bzfsy61","country_code":"PL","type":"education","lineage":["https://openalex.org/I1323121030"]}],"countries":["PL"],"is_corresponding":true,"raw_author_name":"Wojciech Kwedlo","raw_affiliation_strings":["Bialystok University of Technology, Wiejska 45A,Faculty of Computer Science,Bialystok,Poland,15-351"],"raw_orcid":null,"affiliations":[{"raw_affiliation_string":"Bialystok University of Technology, Wiejska 45A,Faculty of Computer Science,Bialystok,Poland,15-351","institution_ids":["https://openalex.org/I1323121030"]}]}],"institutions":[],"countries_distinct_count":1,"institutions_distinct_count":1,"corresponding_author_ids":["https://openalex.org/A5015365508"],"corresponding_institution_ids":["https://openalex.org/I1323121030"],"apc_list":null,"apc_paid":null,"fwci":0.0,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":{"value":0.21490443,"is_in_top_1_percent":false,"is_in_top_10_percent":false},"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":"1","last_page":"2"},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T11901","display_name":"Bayesian Methods and Mixture Models","score":0.9807999730110168,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T11901","display_name":"Bayesian Methods and Mixture Models","score":0.9807999730110168,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T12814","display_name":"Gaussian Processes and Bayesian Inference","score":0.9243000149726868,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/mixture-model","display_name":"Mixture model","score":0.8797000050544739},{"id":"https://openalex.org/keywords/expectation\u2013maximization-algorithm","display_name":"Expectation\u2013maximization algorithm","score":0.7142999768257141},{"id":"https://openalex.org/keywords/cluster-analysis","display_name":"Cluster analysis","score":0.5927000045776367},{"id":"https://openalex.org/keywords/probability-density-function","display_name":"Probability density function","score":0.565500020980835},{"id":"https://openalex.org/keywords/covariance-matrix","display_name":"Covariance matrix","score":0.5525000095367432},{"id":"https://openalex.org/keywords/pattern-recognition","display_name":"Pattern recognition (psychology)","score":0.5408999919891357},{"id":"https://openalex.org/keywords/multivariate-normal-distribution","display_name":"Multivariate normal distribution","score":0.5019999742507935},{"id":"https://openalex.org/keywords/gaussian","display_name":"Gaussian","score":0.45649999380111694},{"id":"https://openalex.org/keywords/function","display_name":"Function (biology)","score":0.4429999887943268},{"id":"https://openalex.org/keywords/covariance","display_name":"Covariance","score":0.4410000145435333}],"concepts":[{"id":"https://openalex.org/C61224824","wikidata":"https://www.wikidata.org/wiki/Q2260434","display_name":"Mixture model","level":2,"score":0.8797000050544739},{"id":"https://openalex.org/C182081679","wikidata":"https://www.wikidata.org/wiki/Q1275153","display_name":"Expectation\u2013maximization algorithm","level":3,"score":0.7142999768257141},{"id":"https://openalex.org/C73555534","wikidata":"https://www.wikidata.org/wiki/Q622825","display_name":"Cluster analysis","level":2,"score":0.5927000045776367},{"id":"https://openalex.org/C33923547","wikidata":"https://www.wikidata.org/wiki/Q395","display_name":"Mathematics","level":0,"score":0.5759000182151794},{"id":"https://openalex.org/C197055811","wikidata":"https://www.wikidata.org/wiki/Q207522","display_name":"Probability density function","level":2,"score":0.565500020980835},{"id":"https://openalex.org/C185142706","wikidata":"https://www.wikidata.org/wiki/Q1134404","display_name":"Covariance matrix","level":2,"score":0.5525000095367432},{"id":"https://openalex.org/C153180895","wikidata":"https://www.wikidata.org/wiki/Q7148389","display_name":"Pattern recognition (psychology)","level":2,"score":0.5408999919891357},{"id":"https://openalex.org/C11413529","wikidata":"https://www.wikidata.org/wiki/Q8366","display_name":"Algorithm","level":1,"score":0.5256999731063843},{"id":"https://openalex.org/C177384507","wikidata":"https://www.wikidata.org/wiki/Q1149000","display_name":"Multivariate normal distribution","level":3,"score":0.5019999742507935},{"id":"https://openalex.org/C163716315","wikidata":"https://www.wikidata.org/wiki/Q901177","display_name":"Gaussian","level":2,"score":0.45649999380111694},{"id":"https://openalex.org/C14036430","wikidata":"https://www.wikidata.org/wiki/Q3736076","display_name":"Function (biology)","level":2,"score":0.4429999887943268},{"id":"https://openalex.org/C178650346","wikidata":"https://www.wikidata.org/wiki/Q201984","display_name":"Covariance","level":2,"score":0.4410000145435333},{"id":"https://openalex.org/C167928553","wikidata":"https://www.wikidata.org/wiki/Q1376021","display_name":"Estimation theory","level":2,"score":0.435699999332428},{"id":"https://openalex.org/C61326573","wikidata":"https://www.wikidata.org/wiki/Q1496376","display_name":"Gaussian process","level":3,"score":0.4178999960422516},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.4120999872684479},{"id":"https://openalex.org/C106487976","wikidata":"https://www.wikidata.org/wiki/Q685816","display_name":"Matrix (chemical analysis)","level":2,"score":0.38749998807907104},{"id":"https://openalex.org/C189508267","wikidata":"https://www.wikidata.org/wiki/Q17088227","display_name":"Density estimation","level":3,"score":0.3788999915122986},{"id":"https://openalex.org/C114289077","wikidata":"https://www.wikidata.org/wiki/Q3284399","display_name":"Statistical model","level":2,"score":0.37779998779296875},{"id":"https://openalex.org/C56672385","wikidata":"https://www.wikidata.org/wiki/Q17157111","display_name":"Mixture distribution","level":3,"score":0.37070000171661377},{"id":"https://openalex.org/C161584116","wikidata":"https://www.wikidata.org/wiki/Q1952580","display_name":"Multivariate statistics","level":2,"score":0.365200012922287},{"id":"https://openalex.org/C115961682","wikidata":"https://www.wikidata.org/wiki/Q860623","display_name":"Image (mathematics)","level":2,"score":0.3495999872684479},{"id":"https://openalex.org/C89106044","wikidata":"https://www.wikidata.org/wiki/Q45284","display_name":"Likelihood function","level":3,"score":0.3400000035762787},{"id":"https://openalex.org/C149441793","wikidata":"https://www.wikidata.org/wiki/Q200726","display_name":"Probability distribution","level":2,"score":0.3346000015735626},{"id":"https://openalex.org/C180877172","wikidata":"https://www.wikidata.org/wiki/Q5401390","display_name":"Estimation of covariance matrices","level":3,"score":0.32989999651908875},{"id":"https://openalex.org/C149872217","wikidata":"https://www.wikidata.org/wiki/Q5265701","display_name":"Determining the number of clusters in a data set","level":5,"score":0.3244999945163727},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.32330000400543213},{"id":"https://openalex.org/C28826006","wikidata":"https://www.wikidata.org/wiki/Q33521","display_name":"Applied mathematics","level":1,"score":0.30480000376701355},{"id":"https://openalex.org/C49781872","wikidata":"https://www.wikidata.org/wiki/Q1045555","display_name":"Maximum likelihood","level":2,"score":0.304500013589859},{"id":"https://openalex.org/C18912344","wikidata":"https://www.wikidata.org/wiki/Q866810","display_name":"Generalized inverse Gaussian distribution","level":5,"score":0.2955999970436096},{"id":"https://openalex.org/C7218915","wikidata":"https://www.wikidata.org/wiki/Q1054475","display_name":"Gaussian function","level":3,"score":0.28600001335144043},{"id":"https://openalex.org/C126255220","wikidata":"https://www.wikidata.org/wiki/Q141495","display_name":"Mathematical optimization","level":1,"score":0.257999986410141},{"id":"https://openalex.org/C51267290","wikidata":"https://www.wikidata.org/wiki/Q5527848","display_name":"Gaussian random field","level":4,"score":0.2547999918460846},{"id":"https://openalex.org/C67186912","wikidata":"https://www.wikidata.org/wiki/Q367664","display_name":"Data modeling","level":2,"score":0.2547999918460846}],"mesh":[],"locations_count":1,"locations":[{"id":"doi:10.1109/clusterworkshops65972.2025.11164196","is_oa":false,"landing_page_url":"https://doi.org/10.1109/clusterworkshops65972.2025.11164196","pdf_url":null,"source":null,"license":null,"license_id":null,"version":"publishedVersion","is_accepted":true,"is_published":true,"raw_source_name":"2025 IEEE International Conference on Cluster Computing Workshops (CLUSTER Workshops)","raw_type":"proceedings-article"}],"best_oa_location":null,"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":5,"referenced_works":["https://openalex.org/W1531802798","https://openalex.org/W1981367467","https://openalex.org/W2149381887","https://openalex.org/W4231665431","https://openalex.org/W4400907330"],"related_works":[],"abstract_inverted_index":{"Gaussian":[0,37],"mixture":[1],"models":[2],"[1]":[3],"(GMMs)":[4],"are":[5],"commonly":[6],"used":[7],"to":[8],"model":[9],"complex":[10],"probability":[11,22],"distributions.":[12],"Recent":[13],"large-scale":[14],"applications":[15,63],"include":[16],"clustering":[17],"and":[18,52,106],"image":[19],"processing.":[20],"The":[21],"density":[23],"function":[24],"f":[25],"of":[26,33,61,64,71,95,101,121],"a":[27,30,84],"GMM":[28],"is":[29,48,54,66,125],"weighted":[31],"sum":[32],"K":[34],"multivariate":[35],"(d-dimensional)":[36],"densities:":[38],"$f(\\mathbf{x}":[39],"\\mid":[40],"\\Theta)=\\sum_{j=1}^{K}":[41],"\\alpha_{j}":[42],"\\mathcal{N}\\left(\\mathbf{x};":[43],"\\boldsymbol{\\mu}_{j},":[44,74],"\\boldsymbol{\\Sigma}_{j}\\right)$,":[45],"where":[46],"$\\boldsymbol{\\mu}_{j}$":[47],"the":[49,55,67,79,110,113],"mean":[50],"vector":[51],"$\\boldsymbol{\\Sigma}_{j}$":[53],"covariance":[56],"matrix.":[57],"A":[58],"crucial":[59],"part":[60],"most":[62],"GMMs":[65,98],"maximum":[68],"likelihood":[69],"estimation":[70],"parameters":[72],"$\\alpha_{j},":[73],"\\boldsymbol{\\Sigma}_{j}(j=1,":[75],"\\ldots,":[76],"K)$":[77],"by":[78,87],"expectation-maximization":[80],"(EM)":[81],"algorithm":[82],"given":[83,112],"dataset":[85,114],"represented":[86],"$N":[88,117],"\\times":[89,118],"d$":[90],"matrix":[91,120],"X.":[92],"An":[93],"iteration":[94],"EM":[96],"for":[97],"[2]":[99],"consists":[100],"two":[102],"steps:":[103],"an":[104,107,116],"E-step":[105],"M-Step.":[108],"In":[109],"E-Step,":[111],"X,":[115],"K$":[119],"responsibilities":[122],"$\\mathbf{P}=\\left[p_{i,":[123],"j}\\right]$":[124],"obtained":[126],"using:":[127]},"counts_by_year":[],"updated_date":"2026-07-29T14:22:42.915294","created_date":"2025-10-10T00:00:00"}
