EPFL@NeurIPS 2026

NeurIPS logo© 2026 EPFL

NeurIPS logo© 2026 EPFL

The following EPFL papers have been accepted to this year conference on Neural Information Processing Systems (NeurIPS). Congratulatations!
40th (main) edition of NeurIPS will take place in Sydney, Australia, from December 6th to December 12th, 2026. The other two venues are Atlanta and Paris. 

  1. Optimistic Dual Averaging Unifies Modern Optimizers by Thomas Pethick, Wanyun Xie, Roman Machacek, Volkan Cevher
  2. AcceleGrad#: Adaptive Geometry-Aware Acceleration by Hanka Goralija*, Francesco Tonin*, Kimon Antonakopoulos, Alp Yurtsever, Volkan Cevher
  3. Constrained Stochastic Spectral Preconditioning Converges for Nonconvex Objectives by Konstantinos Oikonomidis, Jan Quan, Kimon Antonakopoulos, Tony Silveti-Falls, Volkan Cevher*, Panagiotis Patrinos*
  4. When Does Interaction Help? Representational Tradeoffs in Value-Based Imitation Learning by Luca Viano, Antoine Moulin, Audrey Huang, Volkan Cevher, Philip Amortila, Dylan J Foster
  5. Why Routers Freeze: Infinite Width Learning Dynamics for Mixture of Experts by Anish Dhir, Volkan Cevher, Leena Chennuru Vankadara
  6. Split the Differences, Pool the Rest: Provably Efficient Multi-Objective Imitation by Ziyad Sheebaelhamd, Luca Viano, Volkan Cevher, Claire Vernade
  7. Raven: High-Recall Sequence Modeling via Sparse Memory Routing by Arshia Afzal, Aviv Bick, Eric P. Xing, Volkan Cevher, Albert Gu
  8. Attention-Discounted Adaptive Sampler for Masked Diffusion Language Models by Yusuf Sahin, Ahmed R. Saikia, Volkan Cevher, Paolo Favaro
  9. Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity by Ammar Mahran, Artavazd Maranjyan, Peter Richtárik
  10. LOSCAR-SGD: Local SGD with Communication-Computation Overlap and Delay-Corrected Sparse Model Averaging by Yassine Maziane, Ammar Mahran, Artavazd Maranjyan, Peter Richtárik
  11. TempoPFN: Synthetic Pre-training of Linear RNNs for Zero-shot Time Series Forecasting by Vladyslav Moroshan, Julien Siems, Arber Zela, Timur Carstensen, Frank Hutter
  12. Scaling Laws for Multimodal Data Mixtures by Aditi Khandelwal*, Ayush Kumar Tarun*, Yixuan Xu, Imanol Schlag, Golnoosh Farnadi, Siva Reddy, Luke Zettlemoyer, Antoine Bosselut
  13. On Reparameterizing the Score Function by Mohammad Hossein Amani, Leonardo Bocchieri, Maxime Peyrard, Clément Hongler, Robert West
  14. The Future of Facts: Tracing the Factual Generation-Verification Gap by Tim R. Davidson*, Anja Surina*, Caglar Gulcehre
  15. Consolidating Reasoning with Test-Time Learning by Haotian Wu, Zeming Chen, Hao Zhao, Antoine Bosselut
  16. Tracing Persona Vectors Through LLM Pretraining by Viktor Moskvoretskii, Dominik Glandorf, Jorge Medina Moreira, Tanja Käser, Robert West
  17. Rethinking Projector Training in Multimodal LLMs by Fabian Gröger*, Naël Ouerghemi*, Shuo, Wen*, Maria Brbić
  18. To Align or Not to Align: Check Your COMPASS Before You Train by Fabian Gröger*, Petar Damjanović*, Maria Brbić
  19. MUX: Continuous Reasoning via Multiplexed Tokens by Ayhan Suleymanzade, Halil Alperen Gozeten, Michael M. Bronstein, Ismail Ilkan Ceylan, Jinwoo Kim
  20. Causal heteroscedastic structure learning from incomplete temporal data by Abdellah Rahmani, Pascal Frossard
  21. Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping by Hsun-Yu Kuo, El Mahdi Chayti, Patrik Reizinger, Wieland Brendel, Martin Jaggi
  22. Stochastic Optimization with Random Search by El Mahdi Chayti, Taha El Bakkali El Kadi, Omar Saadi, Martin Jaggi
  23. Stochastic Zeroth-Order Optimization Under Heavy-Tailed Noise by Taha El Bakkali El Kadi, El Mahdi Chayti, Qiuyi Zhang, Imane Rahali, Omar Saadi
  24. Joint Consistency: A Unified Test-Time Aggregation Framework via Energy Minimization by Yunzhen Yao, Hongye Wang, Yahong Wang, Michael Gastpar, Bo Jiang, Lie He
  25. PriFT: Prior-Support Guided Supervised Fine-Tuning by Ke Wang*, Shuangqi Li*, Mathieu Salzmann, Pascal Frossard
  26. LoRIF: Low-Rank Influence Functions for Scalable Training Data Attribution by Shuangqi Li, Hieu Le, Jingyi Xu, Mathieu Salzmann
  27. Support Before Frequency in Discrete Diffusion by Adrian Müller, Antoine Gonon, Zebang Shen, Ya-Ping Hsieh, Niao He
  28. Fixed-Point Masked Generative Modeling by Andrea Miele, Yiming QIN, Alba Carballo-Castro, Justin Deschenaux, Pascal Frossard
  29. It's All Training: A Fully Synthetic Single-Stage Recipe for LLMs by Pierre-Carl Langlais, Pieter Delobelle, Yannick Detrois, Pavel Chizhov, Carlos Rosas Hinostroza, Neil Si Smail, Benjamin Burtin, Hanna Shcharbakova, Ivan P. Yamshchikov, Anastasia Stasenko
  30. Breaking Adversarial Transferability in Fine-Tuned Speech Recognition by Mojtaba Nafez*, Aref Mousavi*, Mohammad Ebrahim Mahdavi, Mobina Poulaei, Kiarash Kiani Feriz, Mohammad Hossein Rohban
  31. Your Neighbors Know: Leveraging Local Neighborhoods for Backdoor Detection in Decentralized Learning by Sayan Biswas, Antoine Boutet, Davide Frey, Romaric Gaudel, Rachid Guerraoui, Maxime Jacovella, Anne-Marie Kermarrec, Dimitri Lerévérend, Francois Taiani, Martijn de Vos
  32. AgentWeave: Efficient Distributed Agent Serving via Flow Decomposition by Kaibin Guo, Pengtu Li, Zicong Hong*, Zhiyuan Fang, Wuhui Chen, Rachid Guerraoui, Anne-Marie Kermarrec
  33. Drift-React: One-step Generation of Reaction Pathways via SE(3) Drifting Fields by Rémi Schlama, Philippe Schwaller
  34. Robust and Scalable Collaborative Learning via Pull-Based Epidemic Communication by Abdellah El Mrini, Sadegh Farhadkhani, Rachid Guerraoui
  35. Zeroth-Order Stackelberg Control in Combinatorial Congestion Games by Saeed Masiha, Sepehr Elahi, Negar Kiyavash, Patrick Thiran
  36. Select-then-differentiate: Solving Bilevel Optimization with Manifold Lower-level Solution Sets by Saeed Masiha, Zebang Shen, Negar Kiyavash, Niao He
  37. RePercENT: Scaling Disentangled Representation Learning Beyond Two Modalities by Vasiliki Rizou, Pascal Frossard, Dorina Thanou
  38. Hierarchical Regime-Conditioned Dynamics for Spatiotemporal Graphs by Jeremy Baffou, Pascal Frossard, Dorina Thanou
  39. Hierarchical Graph Representation Learning with Pooling-Induced Substructures by Luca Sbicego, Xiaowen Dong, Dorina Thanou
  40. Benchmarking Optimizers for Large Language Model Pretraining by Andrei Semenov, Matteo Pagliardini, Martin Jaggi
  41. Learn from your own latents and not from tokens: A sample-complexity theory by Daniel Korchinski, Alessandro Favero, Matthieu Wyart
  42. EverAnimate: Minute-Scale Human Animation via Latent Flow Restoration by Wuyang Li*, Yang Gao*, Mariam Hassan, Lan Feng, Wentao Pan, Po-Chien Luan, Alexandre Alahi
  43. Drift-Resistant Navigation World Model with Anchored Epipolar Guidance by Po-Chien Luan, Zimin Xia, Wuyang Li, Yang Gao, Alexandre Alahi
  44. Pure Exploration Beyond Reward Feedback: The Role of Post-Action Context by Mohammad Shahverdikondori, Amir Mohammad Abouei, Alireza Rezaeimoghadam, Negar Kiyavash
  45. Active Context Selection Improves Simple Regret in Contextual Bandits by Mohammad Shahverdikondori, Jalal Etesami, Negar Kiyavash
  46. NEvo: Neural-Guided Evolutionary Video Synthesis for Dynamic Visual Selectivity by Yingtian Tang, Sogand Salehi, Ming Zhou, Amir Zamir, Leyla Isik, Martin Schrimpf
  47. Accuracy of Noise Ceiling Estimators for Brain Scores by Aude Maier, Lucas Gruaz, Martin Schrimpf, Johanni Brea
  48. MIRAGE: Adaptive Multimodal Gating for Whole-Brain fMRI Encoding by Abdulkadir Gokce, Badr AlKhamissi, Martin Schrimpf
  49. Post-Processing Guarantees for Classification under Linear-Fractional Performance Metrics by Andrea Della Vecchia
  50. Learning What to Forget: Improving LLM Unlearning via Learned Token-Level Importance by Gizem Yüce*, Giorgos Nikolaou*, Nicolas Flammarion
  51. WildBox: A Dataset and Benchmark for Aerial Monocular 3D Detection of African Savanna Wildlife by Vandita Shukla, Kilian Meier, Lucie Laporte-Devylder, Camille Rondeau Saint-Jean, Jenna Marie Kline, Blair Roberts Costelloe, Devis Tuia, Fabio Remondino, Benjamin Risse
  52. MARBLE: an Agent Benchmark for Spatial Reasoning and Visual Abstraction by Yulun Jiang*, Naël Ouerghemi*, Yekun Chai, Maria Brbic, Michael Moor
  53. Scaling Genomic Language Modeling with Unified Corpus and Evaluation in Bacteria by Maciej Wiatrak, Samuel T. Horsfield, Aaron Weimann, Ramon Viñas Torné, Maria Ntemourtsidou, David Abelson, Adam Dinan, John A. Lees, Maria Brbic, R. Andres Floto
  54. Flow-Corrected Shape Optimization: Taming Manifold Drift in High-Dimensional 3D Models by Emilien Seiler, Nicolas Talabot, Yingxuan You, Federico Stella, Pascal Fua
  55. MoBayes: A Modular Bayesian Framework for Separating Reasoning from Language in Conversational Clinical Decision Support by Yusuf Kesmen*, Fay Elhassan*, Jiayi Ma*, Julien Stalhandske, Yena Chang, Alexandra V. Kulinkina, David Sasu, Akhil Arora, Lars Henning Klein, Mary-Anne Hartley
  56. Revisiting Multi-View Stereo: A Sequence-to-Sequence Formulation by Aoxiang Fan, Corentin Dumery, Nicolas Talabot, Pascal Fua
  57. Proprio: Latent Self-Scoring and Inference-Time Refinement for Physically Plausible Video Generation by Mariam Hassan, Kaouther Messaoud, Wuyang Li, Alexandre Alahi
  58. S2MDF: A Plug-And-Play Layer for Intersection-Free Multi-Object Signed Distance Fields by Deniz Sayin Mercadier*, Federico Stella*, Aurel Bizeau, Nicolas Talabot, Pascal Fua
  59. Extracting Governing Equations from Latent Dynamics via Multi-View Contrastive Learning by Paolo Muratore, Mackenzie Weygandt Mathis
  60. Beyond Accuracy: A Diagnostic Benchmark for Hypothesis-Driven Experiment Planning in LLM Agents by Ryo Kuroki, Amin Mansouri, Philippe Schwaller
  61. Fed-SB: A Silver Bullet for Extreme Communication Efficiency and Performance in (Private) Federated LoRA Fine-Tuning by Raghav Singhal*, Kaustubh Ponkshe*, Rohit Vartak, Lav R. Varshney, Praneeth Vepakomma
  62. Brenier Meets Adversarial Training: Optimal Transport Geometry for Robust Learning by Alireza Abdollahpoorrostam*, Ehsan Sharifian*, Buse Şen*, Marco Cuturi, Daniel Kuhn
  63. Soft-Radial Projection for Constrained End-to-End Learning by Philipp J. Schneider, Daniel Kuhn
  64. Hierarchical Concept Geometry in Language Representations Emerges from Word Co-occurrence by Andres Nava, Matthieu Wyart
  65. Diffuse AI Control on Fuzzy Tasks by Mikhail Terekhov, Caglar Gulcehre, Vivek Hebbar, Joe Benton
  66. Geometric Latent Reasoning Induces Shorter Generations in LLM by Shashi Kumar*, Yacouba Kaloga*, Petr Motlicek, Ina Kodrasi, Andrea Cavallaro
  67. Better Language Models Require Better Domain-Specific Inductive Biases by Damien Teney, Liangze Jiang, Zachary Shinnick, Hemanth Saratchandran, Simon Lucey
  68. Recovering the Apresjan Hierarchy Using Linkage-Based Clustering by Maximilien Dreveton, Daichi Kuroda, Matthias Grossglauser, Patrick Thiran