Soutenance de thèse – Mohamed Arnouss – 17/07/2026

13 juillet 2026

Titre : Allocation des ressources dans l’économie des épidémies Lieu: Salle de thèse (Hannah Arendt) Date: 17 Juillet 2026 à 14h00 Le jury sera composé de : RÉSUMÉ Les épidémies sont autant influencées par les choix humains que par la biologie. Aller travailler, porter un masque, serrer la main ou se faire vacciner : ces décisions, cumulées à l’échelle de millions d’individus, déterminent la trajectoire d’une épidémie. Lorsque les individus décident de s’isoler, de se faire vacciner ou de réduire leurs contacts, ils arbitrent entre coûts personnels et risques d’infection, générant des externalités que les politiques doivent corriger. Cette thèse développe des politiques stratégiques d’allocation de ressources pour le contrôle des épidémies, en intégrant les dynamiques économiques. L’analyse s’articule autour de quatre axes interconnectés. Premièrement, nous concevons une politique de rétroaction adaptative pour l’isolement ciblé (i.e. quarantaine) qui minimise le pic infectieux sous contrainte budgétaire cumulative. La politique, dérivée analytiquement, atteint la même efficacité qu’une réduction large de la transmission (i.e. confinement) tout en résolvant l’épidémie plus rapidement et en réduisant le nombre total d’infections de 23%. Deuxièmement, nous caractérisons la stratégie d’isolement privée optimale d’un individu égoïste et la comparons à la politique socialement optimale, quantifiant les différences découlant Plus d'infos

Soutenance de thèse – Ryan Whetten – 10/07/2026

9 juillet 2026

Titre : Apprentissage autosupervisé efficace pour le traitement de la parole Lieu: Amphi Blaise Pascal, CERI Date: 10 Juillet 2026 à 13h00 Le jury sera composé de : Résumé : L’un des objectifs fondamentaux de l’intelligence artificielle est le développement de systèmes capables d’interagir avec les humains par la parole, notre forme de communication la plus naturelle. Ces dernières années, des progrès considérables ont été réalisés grâce à l’apprentissage auto-supervisé (SSL, self-supervised learning) —un paradigme d’apprentissage automatique dans lequel les cibles d’entraînement d’un modèle sont dérivées directement des données d’entrée elles-mêmes, réduisant ainsi la dépendance aux données annotées par des humains. Bien que les modèles de parole auto-supervisés aient atteint des performances de pointe dans diverses tâches—notamment la reconnaissance automatique de la parole, la vérification du locuteur et la traduction parole-texte—ils sont notoirement gourmands en ressources. Leur entraînement requiert d’immenses quantités de mémoire, des centaines de milliers d’heures d’audio, ainsi qu’un temps considérable, même sur des infrastructures de calcul haute performance. Ces exigences en ressources constituent des obstacles majeurs, limitant le développement et le déploiement de tels modèles. De plus, même pour ceux disposant d’un accès suffisant à ces ressources, le coût prohibitif de l’entraînement restreint la liberté d’expérimentation et Plus d'infos

Séminaire SLG – Hugo Leguillier – 19/06/2026

16 juin 2026

Date: Friday, June 19, from 1:00 p.m. Place: room S5 Speaker: Hugo Leguillier Title: On Low-Bit Quantization Errors in Speaker Verification: Diagnostic and Mitigation Abstract: Although low-bit quantization provides practical means to deploy speaker verification on resource-constrained devices, its effects on speaker verification performance remain poorly understood. In this paper, we study uniform K-means quantization-aware training of ResNet-36 and ResNet-200 through joint layer-wise and score-level analyses. Our layer-wise analysis highlights fragile components and shows that score degradation is not fully explained by weight distortion alone. We identify a clear knee point at 2 bits, with larger score drift and harmful decision flips concentrated near the FP32 threshold. Our score-level analysis reveals where and how score errors emerge under extreme quantization. Building on these findings, we propose a calibrated multi-precision cascade that resolves most trials at 2 bits and escalates only ambiguous cases, achieving performance close to FP32 while preserving the efficiency benefits of low-bit inference with substantially lower compute and memory costs.

Séminaire CORNET – Caina Figueiredo Pereira – 16/06/2026

10 juin 2026

Date: Mardi 16 Juin 2026, 11h00 Lieu: salle C057 Title: FedStaleAsync: Efficiently Reusing Historical Updates to Enhance Asynchronous Federated Learning _________________________________________________________ Résumé : Federated learning (FL) enables clients to collaboratively train a shared model without exchanging local data. While asynchronous federated learning (AFL) improves training efficiency under high device heterogeneity by removing the synchronization bottlenecks of standard FL, it introduces stale updates and may exacerbate participation imbalance among heterogeneous clients. To mitigate this issue, prior work has proposed reusing historical updates to increase the contribution of slower clients. We theoretically show that existing AFL methods relying on this mechanism tend to underutilize newly received updates, placing excessive emphasis on increasingly stale information. Although strictly unbiased aggregation can correct this issue, it often incurs a substantial increase in variance. To address this trade-off, we propose FedStaleAsync, a principled weakly unbiased aggregation method that better exploits newly transmitted updates without significantly increasing variance. Experiments across diverse heterogeneous settings demonstrate that FedStaleAsync consistently outperforms existing asynchronous methods, achieving faster convergence and higher final accuracy. _________________________________________________________

Séminaire SLG – Hugo Daumain – 12/06/2026

10 juin 2026

Date: Friday, June 12, from 1:00 p.m. Lieu : Salle S5 Speaker: Hugo Daumain Title: From Self-Supervised Speech Models to Mixture-of-Experts for Robust Anti-Spoofing Abstract: Recent advances in speech generation have significantly improved the naturalness of synthetic speech, making spoofing detection increasingly challenging. A key limitation of current anti-spoofing systems is their limited robustness to unseen synthesis methods. In this work, we transform a self-supervised speech representation model into a Mixture-of-Experts (MoE) architecture to improve generalization. Feed-forward blocks in selected encoder layers are replaced by multiple expert networks controlled by a layer-wise gating mechanism, allowing experts to capture complementary acoustic patterns while preserving the representations learned during self-supervised pretraining. We further analyze the architectural choices affecting the performance of this MoE conversion and investigate the activation behavior of the experts. The proposed approach is evaluated on 14 spoofing datasets and reduces the macro EER from 5.46% to 4.81%, corresponding to 11.9% relative improvement over the baseline.

Séminaire SLG – Orane Dufour – 12/06/2026

10 juin 2026

Date: Friday, June 12, from 1:00 p.m. Lieu: Salle S5 Speaker: Orane Dufour Title: A Large-Scale Per-Speaker Analysis of Re-identification Risk in Speech Anonymization Abstract: Speech anonymization is commonly evaluated using average-case metrics such as the equal error rate, which can hide large disparities in re-identification risks across individuals. In this paper, we conduct a large-scale per-speaker privacy analysis using a linkability-based metric under a worst-case scenario. Nearly 5,000 speakers are evaluated across multiple anonymization systems, attacker architectures, and conversation lengths. While linkability scores are highly polarized at the speaker level, the sets of easy to re-identify and hard to re-identify speakers vary substantially across configurations. We show that no single factor explains speaker vulnerability. Instead, the re-identification risk emerges from the interaction between the attacker, the anonymizer, and the amount of available speech. These results challenge the notion of intrinsic speaker-level privacy risks and emphasize the need for evaluation protocols that are explicitly conditioned on the attacker and anonymizer.

Séminaire CORNET – Cleque Marlain Mboulou Moutoubi – 22/05/2026

22 mai 2026

Date: 22 Mai 2026, 11h30 Lieu: Salle C057 Titre: Repeated Multi-Resource Proportional Allocation Auction Games Résumé : In the multi-resource Kelly mechanism, players obtain a share of each resource in proportion to the bids they place on it. They thus engage in a non-cooperative game where they distribute their budgets across multiple resources. In this paper, we study the repeated variant of this game under standard no-regret algorithms, namely Online Gradient Descent (OGD) and Dual Averaging (DA) algorithms. More specifically, we investigate an additive utility framework with heterogeneous valuations across resources, where each resource-specific utility can be either logarithmic or linear. In this setting, we prove uniqueness of the Nash equilibrium. Moreover, we prove convergence of OGD and DA in the repeated game to this unique Nash Equilibrium. Extensive numerical simulations validate the theoretical results and measure convergence speed across different settings.

Séminaire CORNET – Remy Kessler – 29/04/2026

13 avril 2026

TITRE: Désambiguïsation sémantique d’ontologie par LLM Date: 29 Avril 2026, 11h30 Lieu: C057 Résumé : Je présenterais dans ce séminaire les travaux réalisés l’an dernier par Anastasiia Ribova. Je présenterais une approche qui explore le potentiel des grands modèles de langage (LLM) pour automatiser la validation et l’enrichissement d’ontologies et de graphes de connaissances. À partir d’un prompt simple et en exploitant des modèles de langage de taille intermédiaire, nous avons expérimenté plusieurs stratégies, notamment l’apprentissage zero-shot, le few-shot, le raisonnement par chaîne de pensée (CoT) et le décodage par auto-cohérence (SC). Notre méthode d’ensemble a systématiquement surpassé tous les modèles individuels sur deux domaines distincts de l’ontologie. Les résultats soulignent la capacité des LLM à opérer des distinctions nuancées et à évaluer les relations dérivées de l’ontologie avec un haut niveau de précision.

Séminaire SLG – Matthew Wiesner – 26/03/2026

26 mars 2026

Salle 5 – 12h00 Titre: Modélisation Extensible de Langues et d’Accents Résumé: Les modèles d’identification de langue (LID) à l’état de l’art fonctionnent de manière fiable pour une centaine de langues. Cependant, derrière le concept de langue se cache de nombreuses variations émanant d’accents et de dialectes divers. Il est tout simplement impossible d’annoter les données en prenant compte de toutes ces variations. De plus, la parole accentuée engendre un comportement inattendu des modèles de LID et très peu de données annotées existent pour pallier le problème. Ce manque d’annotation empêche aussi l’augmentation de donnée via la synthèse de parole accentuée. Ce séminaire aborde ces problématiques et propose une ébauche de solution fondée sur une collecte de données à grande échelle à partir de diffusions radiophoniques. Cela permet d’associer aux données des annotations indirectes sous forme de géolocalisations. Le séminaire explore ensuite le lien entre la robustesse aux accents et la capacité à modéliser des séquences. Enfin, nous montrons comment ces modèles permettent d’améliorer les modèles de LID, en particulier sur la parole accentuée, et de faciliter l’extraction automatique de données accentuées pour entrainer des systèmes de synthèse vocale.Bio: Matthew Wiesner est un chercheur à Johns Hopkins University et chercheur  at Plus d'infos

Soutenance de thèse – Manh Tuan NGUYEN – 25/03/2026

19 mars 2026

Date: mercredi 25 mars à 14h Lieu: amphithéâtre Blaise du CERI.  La présentation se déroulera en anglais.  Le jury sera composé de:  Titre: Évaluation perceptive des troubles de la parole et de la voix et son intégration dans un système automatique d’aide à la décision.Résumé: Les jugements perceptifs sont largement utilisés dans des domaines dépourvus de critères objectifs clairs ou de méthodes de mesure fiables, ce qui nécessite le recours à l’évaluation par des experts humains. Toutefois, ces jugements sont intrinsèquement subjectifs, ce qui entraîne souvent un manque de concordance et, par conséquent, une variabilité lorsque plusieurs experts évaluent le même matériau. Cette variabilité, appelée variabilité inter-juges, est généralement traitée par l’agrégation des scores ou par un vote majoritaire afin de produire une décision consensuelle. Bien qu’e!cace pour obtenir une décision finale, cette approche laisse largement inexplorées les causes sous-jacentes de la variabilité inter-juges.Cette thèse vise à expliquer la variabilité inter-juges plutôt que de considérer les décisions consensuelles comme une référence absolue. Nous soutenons que cette variabilité peut résulter de différences systématiques entre les experts, notamment en termes de parcours professionnel, de formation, mais également de dimensions perceptives privilégiées lors de l’évaluation. En réduisant les jugements individuels à un score consensuel unique, les approches traditionnelles Plus d'infos

1 2 3 13