Calcul GPU × LLM
FlashKernel
Kernels CUDA et Triton pour l’inférence de transformeurs, avec profilage sur GPU NVIDIA T4.
Des projets open source en inférence GPU, robotique, décodage EEG et optimisation énergétique. Chaque projet présente son architecture, ses expériences et son code.
Kernels CUDA et Triton pour l’inférence de transformeurs, avec profilage sur GPU NVIDIA T4.
Manipulation robotique guidée par le langage : un planificateur VLM et des politiques apprises dans MuJoCo.
Pré-entraînement de transformeurs pour le décodage EEG et l’adaptation aux interfaces cerveau–ordinateur.
Optimisation hybride quantique-classique des réseaux électriques, comparée aux méthodes classiques.