FlashKernel
Kernels CUDA C++ et Triton sur mesure pour l’inférence de transformeurs — FlashAttention tilé, GeLU fusionné, RoPE, KV-cache paginé — profilés avec Nsight Compute sur T4.
Voir le projet en anglais →Abdeljalil Jliouat Applied AI Scientist · Paris
Je conçois des systèmes d’IA efficaces et fiables, des kernels GPU à l’apprentissage robotique. Je partage ici le code, les expériences et les décisions techniques qui accompagnent mon travail.
Trois domaines liés par la recherche appliquée et l’ingénierie.
Des modèles efficaces, des kernels CUDA et les systèmes qui les exécutent.
Apprendre à partir du langage, des interactions et des signaux cérébraux.
Des méthodes classiques et quantiques confrontées aux contraintes pratiques.
L’architecture, les expériences et le code de quatre systèmes à explorer.
Kernels CUDA C++ et Triton sur mesure pour l’inférence de transformeurs — FlashAttention tilé, GeLU fusionné, RoPE, KV-cache paginé — profilés avec Nsight Compute sur T4.
Voir le projet en anglais →Manipulation robotique guidée par le langage — un planificateur VLM décompose les instructions en sous‑tâches, des politiques RL exécutent chaque étape dans une simulation MuJoCo.
Voir le projet en anglais →Modèle de fondation pour le décodage de signaux neuronaux — pré‑entraînement d’un transformeur sur des EEG à grande échelle, puis fine‑tuning pour BCI motrice avec attention par bandes de fréquences.
Voir le projet en anglais →Optimisation hybride quantique‑classique pour les réseaux électriques — QAOA et VQE appliqués au unit commitment sur données réelles ENTSO-E, comparés à des solveurs MILP.
Voir le projet en anglais →Direction de systèmes d'IA appliquée dans des startups, des ONG et la banque.
Disponible pour des collaborations, du conseil et des rôles de leadership technique.