{"id":{"repo_id":"milano","oai_identifier":"oai:air.unimi.it:2434/1119700"},"canonical_url":"https://search.dev.ndltd.org/etd/milano/oai:air.unimi.it:2434/1119700","repository":{"repo_id":"milano","name":"Università degli Studi di Milano","base_url":"https://air.unimi.it/oai/request"},"display":{"title":"CUSTOMIZING IMMERSIVE SPATIAL AUDIO: FROM INDIVIDUALIZED BINAURAL RENDERING TO REAL-VIRTUAL ACOUSTIC BLENDING","abstract":"La simulazione accurata del suono spaziale è essenziale per creare esperienze audio immersive, con applicazioni che spaziano dalla realtà virtuale e aumentata, agli apparecchi acustici, alle teleconferenze e ai videogiochi. Questa tesi discute diversi contributi al campo dell'audio spaziale immersivo, con particolare attenzione all'ascolto personalizzato. I temi affrontati da questi contributi sono due: la personalizzazione della sintesi binaurale e il miscelamento acustico tra reale e virtuale. Nel dominio della sintesi binaurale, la tesi discute alcuni approcci per replicare l'interazione acustica tra i suoni e il padiglione auricolare, il quale ha una forma unica. Ciò è necessario per ottenere simulazione dell'audio audio spaziale che imiti fedelmente le sorgenti sonore reali. A questo proposito, viene presentato un metodo per personalizzare le funzioni di trasferimento legate alla testa (head-related transfer functions, HRTF) in base ai parametri antropometrici del padiglione auricolare. La tesi presenta anche nuovi parametri del padiglione auricolare per caratterizzarne più in dettaglio l'anatomia, migliorando così l'individualizzazione delle HRTF. Inoltre, viene presentato un metodo per stimare l'accoppiamento acustico personale tra il padiglione auricolare e le cuffie in base all'antropometria del padiglione. L'obiettivo è quello di fornire una compensazione personalizzata delle risposte delle cuffie per garantirne la trasparenza. Per quanto riguarda il miscelamento acustico tra reale e virtuale, la tesi presenta un metodo per far avvicinare automaticamente un effetto di riverberazione artificiale a una risposta all'impulso della stanza (room impulse response, RIR) di riferimento. In questo modo, la riverberazione di sorgenti sonore virtuali arbitrarie è coerente con le proprietà acustiche di un ambiente esistente. Il metodo è stato valutato in un esperimento di co-immersione di sorgenti sonore virtuali all'interno di un ambiente di virtualità aumentata. Infine, la tesi propone strumenti e dataset pertinenti alla ricerca sull'audio spaziale. In particolare, viene presentato un riverberatore artificiale appartenente alla classe delle scattering delay network (SDN). Inoltre, vengono discussi un due dataset per la simulazione di ambienti sonori virtuali ecologici, tra cui un dataset di RIR e un dataset di voci per la generazione di conversazioni.","abstract_html":"La simulazione accurata del suono spaziale è essenziale per creare esperienze audio immersive, con applicazioni che spaziano dalla realtà virtuale e aumentata, agli apparecchi acustici, alle teleconferenze e ai videogiochi. Questa tesi discute diversi contributi al campo dell&#x27;audio spaziale immersivo, con particolare attenzione all&#x27;ascolto personalizzato. I temi affrontati da questi contributi sono due: la personalizzazione della sintesi binaurale e il miscelamento acustico tra reale e virtuale. Nel dominio della sintesi binaurale, la tesi discute alcuni approcci per replicare l&#x27;interazione acustica tra i suoni e il padiglione auricolare, il quale ha una forma unica. Ciò è necessario per ottenere simulazione dell&#x27;audio audio spaziale che imiti fedelmente le sorgenti sonore reali. A questo proposito, viene presentato un metodo per personalizzare le funzioni di trasferimento legate alla testa (head-related transfer functions, HRTF) in base ai parametri antropometrici del padiglione auricolare. La tesi presenta anche nuovi parametri del padiglione auricolare per caratterizzarne più in dettaglio l&#x27;anatomia, migliorando così l&#x27;individualizzazione delle HRTF. Inoltre, viene presentato un metodo per stimare l&#x27;accoppiamento acustico personale tra il padiglione auricolare e le cuffie in base all&#x27;antropometria del padiglione. L&#x27;obiettivo è quello di fornire una compensazione personalizzata delle risposte delle cuffie per garantirne la trasparenza. Per quanto riguarda il miscelamento acustico tra reale e virtuale, la tesi presenta un metodo per far avvicinare automaticamente un effetto di riverberazione artificiale a una risposta all&#x27;impulso della stanza (room impulse response, RIR) di riferimento. In questo modo, la riverberazione di sorgenti sonore virtuali arbitrarie è coerente con le proprietà acustiche di un ambiente esistente. Il metodo è stato valutato in un esperimento di co-immersione di sorgenti sonore virtuali all&#x27;interno di un ambiente di virtualità aumentata. Infine, la tesi propone strumenti e dataset pertinenti alla ricerca sull&#x27;audio spaziale. In particolare, viene presentato un riverberatore artificiale appartenente alla classe delle scattering delay network (SDN). Inoltre, vengono discussi un due dataset per la simulazione di ambienti sonori virtuali ecologici, tra cui un dataset di RIR e un dataset di voci per la generazione di conversazioni.","abstract_has_math":false,"creators":["FANTINI, DAVIDE"],"institution":"Università degli Studi di Milano","degree_name":null,"degree_level":null,"degree_discipline":null,"degree_department":null,"school":null,"contributors":["supervisor: F. Avanzini ; co-supervisor: S. Ntalampiras ; PhD coordinator: R. Sassi","D. Fantini","AVANZINI, FEDERICO","NTALAMPIRAS, STAVROS","SASSI, ROBERTO"],"advisors":[],"committee_chairs":[],"committee_members":[],"year":2024,"date_issued":"2024-12-04","date_published":"2024-12-04","updated_at":"2026-07-27T20:18:51Z","subjects":["spatial audio","head-related transfer function","headphone transfer function","binaural","artificial reverberation","Ambisonic","extended reality","virtual reality","audio augmented reality","audio augmented virtuality","Settore INFO-01/A - Informatica"],"languages":["eng"],"rights":["info:eu-repo/semantics/openAccess"],"rights_urls":[],"identifier_entries":[{"key":"dc:identifier","label":"Identifier","values":["http://dx.doi.org/10.13130/fantini-davide_phd2024-12-04","10.13130/fantini-davide_phd2024-12-04"],"render_values":[{"text":"http://dx.doi.org/10.13130/fantini-davide_phd2024-12-04","href":"http://dx.doi.org/10.13130/fantini-davide_phd2024-12-04","code":true},{"text":"10.13130/fantini-davide_phd2024-12-04","href":"https://doi.org/10.13130/fantini-davide_phd2024-12-04","code":true}]}]},"links":{"outbound_url":"https://hdl.handle.net/2434/1119700","outbound_label":"Handle","outbound_source":"dc:identifier"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:contributor","label":"Contributor","values":["supervisor: F. Avanzini ; co-supervisor: S. Ntalampiras ; PhD coordinator: R. Sassi","D. Fantini","AVANZINI, FEDERICO","NTALAMPIRAS, STAVROS","SASSI, ROBERTO"]},{"key":"dc:creator","label":"Author","values":["FANTINI, DAVIDE"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:date","label":"Dc Date","values":["2024-12-04"]},{"key":"dc:publisher","label":"Institution","values":["Università degli Studi di Milano","place:Milano"]},{"key":"dc:relation","label":"Dc Relation","values":["numberofpages:370"]},{"key":"dc:type","label":"Dc Type","values":["info:eu-repo/semantics/doctoralThesis"]}]},{"id":"subjects_keywords","label":"Subjects and Keywords","entries":[{"key":"dc:subject","label":"Dc Subject","values":["spatial audio","head-related transfer function","headphone transfer function","binaural","artificial reverberation","Ambisonic","extended reality","virtual reality","audio augmented reality","audio augmented virtuality","Settore INFO-01/A - Informatica"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language","label":"Dc Language","values":["eng"]},{"key":"dc:rights","label":"Dc Rights","values":["info:eu-repo/semantics/openAccess"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier","label":"Identifier","values":["https://hdl.handle.net/2434/1119700","http://dx.doi.org/10.13130/fantini-davide_phd2024-12-04","10.13130/fantini-davide_phd2024-12-04"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description","label":"Description","values":["La simulazione accurata del suono spaziale è essenziale per creare esperienze audio immersive, con applicazioni che spaziano dalla realtà virtuale e aumentata, agli apparecchi acustici, alle teleconferenze e ai videogiochi. Questa tesi discute diversi contributi al campo dell'audio spaziale immersivo, con particolare attenzione all'ascolto personalizzato. I temi affrontati da questi contributi sono due: la personalizzazione della sintesi binaurale e il miscelamento acustico tra reale e virtuale. Nel dominio della sintesi binaurale, la tesi discute alcuni approcci per replicare l'interazione acustica tra i suoni e il padiglione auricolare, il quale ha una forma unica. Ciò è necessario per ottenere simulazione dell'audio audio spaziale che imiti fedelmente le sorgenti sonore reali. A questo proposito, viene presentato un metodo per personalizzare le funzioni di trasferimento legate alla testa (head-related transfer functions, HRTF) in base ai parametri antropometrici del padiglione auricolare. La tesi presenta anche nuovi parametri del padiglione auricolare per caratterizzarne più in dettaglio l'anatomia, migliorando così l'individualizzazione delle HRTF. Inoltre, viene presentato un metodo per stimare l'accoppiamento acustico personale tra il padiglione auricolare e le cuffie in base all'antropometria del padiglione. L'obiettivo è quello di fornire una compensazione personalizzata delle risposte delle cuffie per garantirne la trasparenza. Per quanto riguarda il miscelamento acustico tra reale e virtuale, la tesi presenta un metodo per far avvicinare automaticamente un effetto di riverberazione artificiale a una risposta all'impulso della stanza (room impulse response, RIR) di riferimento. In questo modo, la riverberazione di sorgenti sonore virtuali arbitrarie è coerente con le proprietà acustiche di un ambiente esistente. Il metodo è stato valutato in un esperimento di co-immersione di sorgenti sonore virtuali all'interno di un ambiente di virtualità aumentata. Infine, la tesi propone strumenti e dataset pertinenti alla ricerca sull'audio spaziale. In particolare, viene presentato un riverberatore artificiale appartenente alla classe delle scattering delay network (SDN). Inoltre, vengono discussi un due dataset per la simulazione di ambienti sonori virtuali ecologici, tra cui un dataset di RIR e un dataset di voci per la generazione di conversazioni.","The accurate simulation of spatial sound is essential for creating immersive audio experiences, with applications spanning virtual and augmented reality, hearing aids, teleconferencing, and gaming. This thesis discusses several contributions to the field of immersive spatial audio with a focus on customized listening. The topics addressed by these contributions are twofold: individualizing binaural rendering and real-virtual acoustic blending. In the domain of binaural rendering, the thesis discusses some approaches to replicate the acoustic interaction between sounds and the pinna, which has a unique shape. This is needed to obtain spatial audio simulations that closely mimic real sound sources. In this regard, a method for personalizing head-related transfer functions (HRTFs) based on pinna anthropometric parameters is presented. The thesis also presents novel pinna parameters to better characterize the pinna anatomy, thus improving HRTF individualization. Furthermore, it presents a method to estimate the personal acoustic coupling between the pinna and headphones based on pinna anthropometry. The objective is to provide personalized compensation for headphones responses to ensure their transparency. With regard to real-virtual acoustic blending, the thesis presents a method to automatically match artificial reverberation to a target room impulse response (RIR). This enables the reverberation of arbitrary virtual sound sources to match the acoustical properties of an existing environment. The method was evaluated in an experiment assessing the co-immersion of virtual sound sources within an audio augmented virtuality framework. Finally, the thesis proposes tools and datasets relevant to spatial audio research. Specifically, an artificial reverberator from the class of scattering delay networks (SDN) is presented. Moreover, a couple of datasets for the simulation of ecologically-valid virtual auditory environments are discussed, including an RIR dataset and a speech dataset for the generation of turn-taking conversations."]},{"key":"dc:title","label":"Title","values":["CUSTOMIZING IMMERSIVE SPATIAL AUDIO: FROM INDIVIDUALIZED BINAURAL RENDERING TO REAL-VIRTUAL ACOUSTIC BLENDING"]}]}],"canonical_facts":{"dc:contributor":["supervisor: F. Avanzini ; co-supervisor: S. Ntalampiras ; PhD coordinator: R. Sassi","D. Fantini","AVANZINI, FEDERICO","NTALAMPIRAS, STAVROS","SASSI, ROBERTO"],"dc:creator":["FANTINI, DAVIDE"],"dc:date":["2024-12-04"],"dc:description":["La simulazione accurata del suono spaziale è essenziale per creare esperienze audio immersive, con applicazioni che spaziano dalla realtà virtuale e aumentata, agli apparecchi acustici, alle teleconferenze e ai videogiochi. Questa tesi discute diversi contributi al campo dell'audio spaziale immersivo, con particolare attenzione all'ascolto personalizzato. I temi affrontati da questi contributi sono due: la personalizzazione della sintesi binaurale e il miscelamento acustico tra reale e virtuale. Nel dominio della sintesi binaurale, la tesi discute alcuni approcci per replicare l'interazione acustica tra i suoni e il padiglione auricolare, il quale ha una forma unica. Ciò è necessario per ottenere simulazione dell'audio audio spaziale che imiti fedelmente le sorgenti sonore reali. A questo proposito, viene presentato un metodo per personalizzare le funzioni di trasferimento legate alla testa (head-related transfer functions, HRTF) in base ai parametri antropometrici del padiglione auricolare. La tesi presenta anche nuovi parametri del padiglione auricolare per caratterizzarne più in dettaglio l'anatomia, migliorando così l'individualizzazione delle HRTF. Inoltre, viene presentato un metodo per stimare l'accoppiamento acustico personale tra il padiglione auricolare e le cuffie in base all'antropometria del padiglione. L'obiettivo è quello di fornire una compensazione personalizzata delle risposte delle cuffie per garantirne la trasparenza. Per quanto riguarda il miscelamento acustico tra reale e virtuale, la tesi presenta un metodo per far avvicinare automaticamente un effetto di riverberazione artificiale a una risposta all'impulso della stanza (room impulse response, RIR) di riferimento. In questo modo, la riverberazione di sorgenti sonore virtuali arbitrarie è coerente con le proprietà acustiche di un ambiente esistente. Il metodo è stato valutato in un esperimento di co-immersione di sorgenti sonore virtuali all'interno di un ambiente di virtualità aumentata. Infine, la tesi propone strumenti e dataset pertinenti alla ricerca sull'audio spaziale. In particolare, viene presentato un riverberatore artificiale appartenente alla classe delle scattering delay network (SDN). Inoltre, vengono discussi un due dataset per la simulazione di ambienti sonori virtuali ecologici, tra cui un dataset di RIR e un dataset di voci per la generazione di conversazioni.","The accurate simulation of spatial sound is essential for creating immersive audio experiences, with applications spanning virtual and augmented reality, hearing aids, teleconferencing, and gaming. This thesis discusses several contributions to the field of immersive spatial audio with a focus on customized listening. The topics addressed by these contributions are twofold: individualizing binaural rendering and real-virtual acoustic blending. In the domain of binaural rendering, the thesis discusses some approaches to replicate the acoustic interaction between sounds and the pinna, which has a unique shape. This is needed to obtain spatial audio simulations that closely mimic real sound sources. In this regard, a method for personalizing head-related transfer functions (HRTFs) based on pinna anthropometric parameters is presented. The thesis also presents novel pinna parameters to better characterize the pinna anatomy, thus improving HRTF individualization. Furthermore, it presents a method to estimate the personal acoustic coupling between the pinna and headphones based on pinna anthropometry. The objective is to provide personalized compensation for headphones responses to ensure their transparency. With regard to real-virtual acoustic blending, the thesis presents a method to automatically match artificial reverberation to a target room impulse response (RIR). This enables the reverberation of arbitrary virtual sound sources to match the acoustical properties of an existing environment. The method was evaluated in an experiment assessing the co-immersion of virtual sound sources within an audio augmented virtuality framework. Finally, the thesis proposes tools and datasets relevant to spatial audio research. Specifically, an artificial reverberator from the class of scattering delay networks (SDN) is presented. Moreover, a couple of datasets for the simulation of ecologically-valid virtual auditory environments are discussed, including an RIR dataset and a speech dataset for the generation of turn-taking conversations."],"dc:identifier":["https://hdl.handle.net/2434/1119700","http://dx.doi.org/10.13130/fantini-davide_phd2024-12-04","10.13130/fantini-davide_phd2024-12-04"],"dc:language":["eng"],"dc:publisher":["Università degli Studi di Milano","place:Milano"],"dc:relation":["numberofpages:370"],"dc:rights":["info:eu-repo/semantics/openAccess"],"dc:subject":["spatial audio","head-related transfer function","headphone transfer function","binaural","artificial reverberation","Ambisonic","extended reality","virtual reality","audio augmented reality","audio augmented virtuality","Settore INFO-01/A - Informatica"],"dc:title":["CUSTOMIZING IMMERSIVE SPATIAL AUDIO: FROM INDIVIDUALIZED BINAURAL RENDERING TO REAL-VIRTUAL ACOUSTIC BLENDING"],"dc:type":["info:eu-repo/semantics/doctoralThesis"]},"updated_at":"2026-07-27T20:18:51Z"}