Catégorie
Technologies
Tutoriels LLM
Tenez-vous au courant des dernières nouvelles, techniques et ressources concernant les grands modèles de langage. Nos tutoriels sont pleins d'exemples pratiques et de cas d'utilisation que vous pouvez utiliser pour vous perfectionner.
Autres technologies :
Formation de 2 personnes ou plus ?Essayer DataCamp for Business
Format GGUF : guide complet pour l’inférence LLM en local
GGUF regroupe les poids du modèle, les données du tokenizer et les métadonnées dans un fichier portable unique. Découvrez comment choisir le bon niveau de quantification et démarrer avec Ollama.
17 juin 2026
Routines Claude Code : lancez votre agent de dév selon un planning dans le cloud
Découvrez comment les routines Claude Code exécutent votre agent de développement dans le cloud selon un planning ou un événement GitHub, pour que revues de PR et audits avancent même ordinateur fermé.
17 juin 2026
Tutoriel SGLang : déployer Mistral Medium 3.5 en local
Mettez en place un environnement Docker multi‑GPU avec parallélisme tensoriel et décodage spéculatif EAGLE pour servir Mistral Medium 3.5 128B via une API compatible OpenAI.
1 juin 2026
Tutoriel Multi-Token Prediction : comment accélérer les LLM
Exécutez Qwen3.6 27B sur une RTX 3090 et découvrez comment la Multi-Token Prediction (MTP) avec llama.cpp peut presque doubler la vitesse d'inférence locale sans changer de GPU.
14 mai 2026
Tutoriel DeepSeek V4 API : créer une arène des modes de réflexion
Découvrez le fonctionnement des trois modes de raisonnement de DeepSeek V4 et créez une appli Streamlit de comparaison qui montre, pour chaque mode, quand il l’emporte vraiment en qualité, vitesse et coût.
12 mai 2026
Tutoriel API GPT-Realtime-2 : trois tests, trois verdicts
Découvrez les différences entre gpt-realtime-2, gpt-realtime-translate et gpt-realtime-whisper d’OpenAI, puis testez chaque modèle avec du code Python WebSocket prêt à l’emploi.
12 mai 2026
Comment exécuter DeepSeek V4 Flash en local
Apprenez à faire tourner l'intégralité du modèle DeepSeek V4 Flash sur un seul GPU à l'aide d'une version modifiée de llama.cpp et d'un fichier GGUF compatible dans ce tutoriel pratique.
5 mai 2026
Ajuster NVIDIA Nemotron-3-Nano sur des données de Q&R en psychologie
Apprenez à affiner NVIDIA Nemotron-3-Nano-4B sur un jeu de données Q&R en psychologie avec un GPU RTX 3090 en utilisant LoRA et TRL après téléchargement du modèle depuis Hugging Face.
29 avril 2026
Tutoriel API Qwen 3.6 Plus : créer une chaîne de traitement de factures en Python
Apprenez à utiliser Qwen 3.6 Plus d'Alibaba, Python et le SDK OpenAI pour créer une chaîne automatisée de traitement des factures avec vision native et appel d’outils.
27 avril 2026
Nano Banana 2 : guide complet avec Python
Découvrez tout ce qu’il faut savoir sur le dernier modèle de génération d’images de Google, Nano Banana 2, y compris comment créer un éditeur d’images itératif en chat via l’API avec Python.
22 avril 2026
Exécuter GLM-5 en local pour un codage agentique
Exécutez GLM-5, le meilleur modèle d’IA open-weight, sur un seul GPU avec llama.cpp, et connectez-le à Aider pour en faire un agent de codage local puissant.
22 avril 2026
Ajuster finement Qwen3.6 sur un jeu de données de Q&R médicales
Apprenez à ajuster finement Qwen3.6 sur un GPU H100 NVL avec SFT, de la préparation des données et du chargement en 4 bits jusqu’à l’entraînement et l’évaluation.
21 avril 2026