Ir al contenido principal
Categoría
Technologies

Tutorías LLM

Mantente al día de las últimas noticias, técnicas y recursos para los Grandes Modelos Lingüísticos. Nuestros tutoriales están llenos de ejemplos prácticos y casos de uso que puedes utilizar para mejorar tus conocimientos.
Otras tecnologías:
Agentes de IAAirflowAWSAzureCara de abrazoChatGPTDatabricksdbtDockerExcelGitHojas de cálculoIA GenerativaInteligencia empresarialJavaJuliaKafkaKubernetesMongoDBMySQLNoSQLOpenAIPlataforma en la nube de GooglePostgreSQLPower BIPySparkPythonRScalaSnowflakeSQLSQLiteTableau
Group¿Formar a 2 o más personas?Probar DataCamp for Business

Cómo ejecutar Kimi K2.7 Code en local con llama.cpp

Aprende a ejecutar Kimi K2.7 Code en local en cinco minutos con el binario precompilado de llama.cpp en cuatro GPU RTX PRO 6000, y luego úsalo con su interfaz web y el agente de código Pi a través de una API compatible con OpenAI.

25 de junio de 2026

Cómo acelerar LLM locales con DFlash y decodificación especulativa

Aprende a acelerar la inferencia local de Gemma 4 31B en una única RTX 4090 usando decodificación especulativa DFlash y Flash Attention frente a una configuración de referencia.

17 de junio de 2026

Formato GGUF: guía completa para la inferencia local de LLM

GGUF empaqueta los pesos del modelo, los datos del tokenizador y los metadatos en un único archivo portátil. Aprende a elegir el nivel de cuantización adecuado y a empezar con Ollama.

17 de junio de 2026

Rutinas de Claude Code: ejecuta tu agente de código con una programación en la nube

Descubre cómo las rutinas de Claude Code ejecutan tu agente de código en la nube con una programación o un evento de GitHub, para que las revisiones de PR y auditorías terminen con el portátil cerrado.

17 de junio de 2026

Tutorial de SGLang: sirve Mistral Medium 3.5 en local

Configura un entorno Docker multi‑GPU con paralelismo tensorial y decodificación especulativa EAGLE para servir Mistral Medium 3.5 128B mediante una API compatible con OpenAI.

1 de junio de 2026

Tutorial de Multi-Token Prediction: cómo acelerar los LLM

Ejecuta Qwen3.6 27B en una RTX 3090 y descubre cómo Multi-Token Prediction (MTP) con llama.cpp puede casi duplicar la inferencia local de LLM sin cambiar de GPU.

14 de mayo de 2026

Tutorial de la API GPT-Realtime-2: tres pruebas, tres veredictos

Aprende en qué se diferencian gpt-realtime-2, gpt-realtime-translate y gpt-realtime-whisper de OpenAI, y pon a prueba cada uno con código WebSocket de Python totalmente funcional.

12 de mayo de 2026

Cómo ejecutar DeepSeek V4 Flash en local

Aprende a ejecutar el modelo completo DeepSeek V4 Flash en una sola GPU usando una build modificada de llama.cpp y un archivo GGUF compatible en este tutorial práctico.

5 de mayo de 2026

Ajuste fino de NVIDIA Nemotron-3-Nano con datos de Q&A de psicología

Aprende a ajustar NVIDIA Nemotron-3-Nano-4B con un dataset de Q&A de psicología en una GPU RTX 3090 usando LoRA y TRL tras descargar el modelo de Hugging Face.

29 de abril de 2026

Tutorial de la API de Qwen 3.6 Plus: crea una canalización de procesamiento de facturas en Python

Aprende a usar Qwen 3.6 Plus de Alibaba, Python y el SDK de OpenAI para crear una canalización automática de procesamiento de facturas con visión nativa y llamadas a herramientas.

27 de abril de 2026

Nano Banana 2: guía completa con Python

Descubre todo lo que necesitas saber sobre el nuevo modelo de generación de imágenes de Google, Nano Banana 2, incluido cómo crear un editor de imágenes conversacional e iterativo usando la API con Python.

22 de abril de 2026

Ejecuta GLM-5 en local para programación con agentes

Ejecuta GLM-5, el mejor modelo de IA de pesos abiertos, en una sola GPU con llama.cpp y conéctalo a Aider para convertirlo en un potente agente de programación local.

22 de abril de 2026