Séparation de sources audio, état de l'art et application à la séparation de la voix chantée

0:00/0:00

Les médias liés à cet évènement

Mettre en temps une structure musicale : l'activité de composition de Voi(rex) par Philippe Leroux - Nicolas Donin, Jacques Theureau

undefined 01 h 01 min

Mettre en temps une structure musicale : l'activité de composition de Voi(rex) par Philippe Leroux - Nicolas Donin, Jacques Theureau

undefined 24 min

L'estimation de fréquences fondamentales multiples

undefined 52 min

La harpe électroacoustique

undefined 01 h 18 min

Utilisation de Modalys pour le projet VoxStruments, lutherie numérique intuitive et expressive - Nicholas Ellis, Joël Bensoam

undefined 49 min

Présentation des travaux l'équipe PdS dans le cadre du projet européen CLOSED : "Closing the Loop of Sound Evaluation and Design" - Olivier Houix

undefined 01 h 12 min

Sparse overcomplete methods, matching pursuit and basis pursuit - Bob L. Sturm

undefined 48 min

Transformations de type et de nature de la voix - Snorre Farner, Axel Roebel, Xavier Rodet

undefined 01 h 07 min

Segmentations et reconnaissances automatiques de phonèmes de la voix, temps différé, temps réel - Pierre Lanchantin, Julien Bloit, Xavier Rodet

undefined 01 h 13 min

Synthèse de la parole à partir du texte et construction d'une base de données d'unités de la voix - Christophe Veaux, Grégory Beller, Xavier Rodet

undefined 01 h 00 min

Projet ECOUTE - Jerome Barthelemy, Nicolas Donin, Geoffroy Peeters, Samuel Goldszmidt

undefined 01 h 12 min

Projet MusicDiscover - David Fenech Saint Genieys

undefined 01 h 10 min

Projet CASPAR - Jerome Barthelemy, Alain Bonardi

undefined 50 min

Projet CONSONNES 1ère partie - René Caussé, Vincent Freour, David Roze

undefined 57 min

Je décrirai en premier lieu un cadre probabiliste Bayésien pour la séparation de sources, et je montrerai comment de nombreuses méthodes de l'état de l'art y apparaissent comme des déclinaisons particulières.
Après ce tour d'horizon, je me focaliserai sur le cas des sources audio, qui sont caractérisées par une stationnarité locale. Je présenterai ainsi les différents modèles les plus récents qui ont été proposés pour la modélisation et la séparation de la voix chantée au sein d'un mélange audio multicanal.
Cette description sera l'occasion d'aborder les modèles de mélange diffus, qui sont une généralisation récente des mélanges instantanés et convolutifs.
Pour finir, je présenterai une technique de séparation de la voix basée sur la séparation de motifs répétitifs. Cette technique suppose que le fonds musical est localement répétitif et permet de très efficacement séparer la voix de la musique dans les productions grand public.

intervenants

informations

Type
Conférence scientifique et/ou technique
Lieu de représentation
Ircam, Salle Igor-Stravinsky (Paris)
durée
47 min

Séparation de sources audio, état de l'art et application à la séparation de la voix chantée

Antoine LIUTKUS, invité par l'équipe Analyse et synthèse du son, dans le cadre de l'offre de poste 0580 en section 61 d'enseignant chercheur, présente :
"Séparation de sources audio, état de l'art et application à la séparation de la voix chantée"

Cet exposé se fera en trois parties.
Je décrirai en premier lieu un cadre probabiliste Bayésien pour la séparation de sources, et je montrerai comment de nombreuses méthodes de l'état de l'art y apparaissent comme des déclinaisons particulières.
Après ce tour d'horizon, je me focaliserai sur le cas des sources audio, qui sont caractérisées par une stationnarité locale. Je présenterai ainsi les différents modèles les plus récents qui ont été proposés pour la modélisation et la séparation de la voix chantée au sein d'un mélange audio multicanal.
Cette description sera l'occasion d'aborder les modèles de mélange diffus, qui sont une généralisation récente des mélanges instantanés et convolutifs.
Pour finir, je présenterai une technique de séparation de la voix basée sur la séparation de motifs répétitifs. Cette technique suppose que le fonds musical est localement répétitif et permet de très efficacement séparer la voix de la musique dans les productions grand public.

IRCAM

1, place Igor-Stravinsky
75004 Paris
+33 1 44 78 48 43

heures d'ouverture

Du lundi au vendredi de 9h30 à 19h
Fermé le samedi et le dimanche

accès en transports

Hôtel de Ville, Rambuteau, Châtelet, Les Halles

Institut de Recherche et de Coordination Acoustique/Musique

Copyright © 2022 Ircam. All rights reserved.