Accéder au contenu principal
Catégorie
Technologies

Tutoriels LLM

Tenez-vous au courant des dernières nouvelles, techniques et ressources concernant les grands modèles de langage. Nos tutoriels sont pleins d'exemples pratiques et de cas d'utilisation que vous pouvez utiliser pour vous perfectionner.
Autres technologies :
Actualités IAAgents d'intelligence artificielleAirflowAWSAzureBases de donnéesChatGPTdbtDockerExcelFeuilles de calculFlocon de neigeGitGoogle Cloud PlatformIA générativeIntelligence artificielleIntelligence économiqueJavaJuliaKafkaKubernetesMongoDBMySQLNoSQLOpenAIPostgreSQLPower BIPySparkPythonRScalaSQLSQLiteTableauVisage étreint
GroupFormation de 2 personnes ou plus ?Essayer DataCamp for Business

Format GGUF : guide complet pour l’inférence LLM en local

GGUF regroupe les poids du modèle, les données du tokenizer et les métadonnées dans un fichier portable unique. Découvrez comment choisir le bon niveau de quantification et démarrer avec Ollama.

17 juin 2026

Routines Claude Code : lancez votre agent de dév selon un planning dans le cloud

Découvrez comment les routines Claude Code exécutent votre agent de développement dans le cloud selon un planning ou un événement GitHub, pour que revues de PR et audits avancent même ordinateur fermé.

17 juin 2026

Tutoriel SGLang : déployer Mistral Medium 3.5 en local

Mettez en place un environnement Docker multi‑GPU avec parallélisme tensoriel et décodage spéculatif EAGLE pour servir Mistral Medium 3.5 128B via une API compatible OpenAI.

1 juin 2026

Tutoriel Multi-Token Prediction : comment accélérer les LLM

Exécutez Qwen3.6 27B sur une RTX 3090 et découvrez comment la Multi-Token Prediction (MTP) avec llama.cpp peut presque doubler la vitesse d'inférence locale sans changer de GPU.

14 mai 2026

Tutoriel DeepSeek V4 API : créer une arène des modes de réflexion

Découvrez le fonctionnement des trois modes de raisonnement de DeepSeek V4 et créez une appli Streamlit de comparaison qui montre, pour chaque mode, quand il l’emporte vraiment en qualité, vitesse et coût.

12 mai 2026

Tutoriel API GPT-Realtime-2 : trois tests, trois verdicts

Découvrez les différences entre gpt-realtime-2, gpt-realtime-translate et gpt-realtime-whisper d’OpenAI, puis testez chaque modèle avec du code Python WebSocket prêt à l’emploi.

12 mai 2026

Comment exécuter DeepSeek V4 Flash en local

Apprenez à faire tourner l'intégralité du modèle DeepSeek V4 Flash sur un seul GPU à l'aide d'une version modifiée de llama.cpp et d'un fichier GGUF compatible dans ce tutoriel pratique.

5 mai 2026

Ajuster NVIDIA Nemotron-3-Nano sur des données de Q&R en psychologie

Apprenez à affiner NVIDIA Nemotron-3-Nano-4B sur un jeu de données Q&R en psychologie avec un GPU RTX 3090 en utilisant LoRA et TRL après téléchargement du modèle depuis Hugging Face.

29 avril 2026

Tutoriel API Qwen 3.6 Plus : créer une chaîne de traitement de factures en Python

Apprenez à utiliser Qwen 3.6 Plus d'Alibaba, Python et le SDK OpenAI pour créer une chaîne automatisée de traitement des factures avec vision native et appel d’outils.

27 avril 2026

Nano Banana 2 : guide complet avec Python

Découvrez tout ce qu’il faut savoir sur le dernier modèle de génération d’images de Google, Nano Banana 2, y compris comment créer un éditeur d’images itératif en chat via l’API avec Python.

22 avril 2026

Exécuter GLM-5 en local pour un codage agentique

Exécutez GLM-5, le meilleur modèle d’IA open-weight, sur un seul GPU avec llama.cpp, et connectez-le à Aider pour en faire un agent de codage local puissant.

22 avril 2026

Ajuster finement Qwen3.6 sur un jeu de données de Q&R médicales

Apprenez à ajuster finement Qwen3.6 sur un GPU H100 NVL avec SFT, de la préparation des données et du chargement en 4 bits jusqu’à l’entraînement et l’évaluation.

21 avril 2026