Vai al contenuto principale
Categoria
Tecnologie

Tutorial sui LLM

Resta aggiornato su novità, tecniche e risorse per i Large Language Models. I nostri tutorial sono ricchi di guide pratiche e casi d’uso per migliorare le tue competenze.
Altre tecnologie:
GroupVuoi formare 2 o più persone?Prova DataCamp for Business

Esegui GLM-5 in locale per il coding agentico

Esegui GLM-5, il miglior modello AI open-weight, su una singola GPU con llama.cpp e collegalo ad Aider per trasformarlo in un potente agente di coding locale.
Abid Ali Awan's photo

Abid Ali Awan

3 giugno 2026

Usare Claude Code con i modelli locali di Ollama

Esegui GLM 4.7 Flash in locale (RTX 3090) con Claude Code e Ollama in pochi minuti: niente cloud, niente lock-in, solo velocità e controllo.
Abid Ali Awan's photo

Abid Ali Awan

3 giugno 2026

Tutorial SGLang: servire Mistral Medium 3.5 in locale

Configura un ambiente Docker multi-GPU con parallelismo di tensori e decoding speculativo EAGLE per servire Mistral Medium 3.5 128B tramite un’API compatibile con OpenAI.
Abid Ali Awan's photo

Abid Ali Awan

1 giugno 2026

Tutorial sulla Multi-Token Prediction: come velocizzare gli LLM

Esegui Qwen3.6 27B su una RTX 3090 e scopri come la Multi-Token Prediction (MTP) con llama.cpp può quasi raddoppiare l'inferenza locale degli LLM senza aggiornare la tua GPU.
Abid Ali Awan's photo

Abid Ali Awan

14 maggio 2026

Tutorial sull'API GPT-Realtime-2: tre test, tre verdetti

Scopri le differenze tra gpt-realtime-2, gpt-realtime-translate e gpt-realtime-whisper di OpenAI, poi mettile alla prova con codice Python WebSocket funzionante.
Khalid Abdelaty's photo

Khalid Abdelaty

12 maggio 2026

Come eseguire DeepSeek V4 Flash in locale

Scopri come eseguire l’intero modello DeepSeek V4 Flash su una singola GPU usando una build modificata di llama.cpp e un file GGUF compatibile in questo tutorial pratico.
Abid Ali Awan's photo

Abid Ali Awan

5 maggio 2026

Fine-tuning di NVIDIA Nemotron-3-Nano su dati di Q&A di psicologia

Impara a fare fine-tuning di NVIDIA Nemotron-3-Nano-4B su un dataset di Q&A di psicologia con una GPU RTX 3090 usando LoRA e TRL dopo aver scaricato il modello da Hugging Face.
Abid Ali Awan's photo

Abid Ali Awan

29 aprile 2026

Tutorial API Qwen 3.6 Plus: costruire una pipeline di elaborazione fatture in Python

Scopri come usare Qwen 3.6 Plus di Alibaba, Python e l’SDK OpenAI per costruire una pipeline automatizzata di elaborazione fatture con visione nativa e tool calling.
Bex Tuychiev's photo

Bex Tuychiev

27 aprile 2026

Nano Banana 2: guida completa con Python

Scopri tutto quello che devi sapere sul nuovo modello di generazione di immagini di Google, Nano Banana 2, incluso come creare un editor di immagini iterativo in chat usando l’API con Python.
François Aubry's photo

François Aubry

22 aprile 2026