Перейти к основному контенту
Категория
Технологии

Учебные материалы по LLM

Будьте в курсе последних новостей, методик и ресурсов по большим языковым моделям. Наши руководства полны практических разборов и кейсов, которые помогут прокачать навыки.
Другие технологии:
GroupОбучение двух или более человек?Попробуйте DataCamp for Business

Учебник по коннектору Claude Code: сортировка репозиториев GitHub за 20 минут

Прочитайте этот учебник по коннектору Claude Code и настройте GitHub через MCP. Узнайте, как автоматизировать разбор задач в open-source за 20 минут, используя локальные файлы только для чтения.

7 июля 2026 г.

Как запустить GLM-5.2 локально с помощью RunPod и llama.cpp

Запустите GLM-5.2 приватно через llama.cpp, защитите доступ собственным API-ключом, протестируйте через Web UI и cURL и подключите к OpenCode для мощного локального рабочего процесса разработки.

1 июля 2026 г.

Как запустить Kimi K2.7 Code локально с помощью llama.cpp

Узнайте, как запустить Kimi K2.7 Code локально за пять минут с предустановленным бинарником llama.cpp на четырёх RTX PRO 6000, а затем использовать её веб‑интерфейс и кодового агента Pi через совместимый с OpenAI API.

25 июня 2026 г.

Как ускорить локальные LLM с помощью спекулятивного декодирования DFlash

Узнайте, как ускорить локальный инференс Gemma 4 31B на одном RTX 4090 с помощью спекулятивного декодирования DFlash и Flash Attention по сравнению с базовой конфигурацией.

17 июня 2026 г.

Формат GGUF: полное руководство по локальному выводу LLM

GGUF упаковывает веса модели, данные токенизатора и метаданные в один переносимый файл. Узнайте, как выбрать подходящий уровень квантизации и начать работу с Ollama.

17 июня 2026 г.

Процедуры Claude Code: запускайте агента для работы с кодом по расписанию в облаке

Узнайте, как процедуры Claude Code запускают вашего агента для работы с кодом в облаке по расписанию или событию GitHub, чтобы проверки PR и аудиты завершались даже с закрытым ноутбуком.

17 июня 2026 г.

Учебник по SGLang: локальный запуск Mistral Medium 3.5

Настройте среду Docker с несколькими GPU, тензорным параллелизмом и спекулятивным декодированием EAGLE, чтобы обслуживать Mistral Medium 3.5 128B через совместимый с OpenAI API.

1 июня 2026 г.

Руководство по Multi-Token Prediction: как ускорить LLM

Запустите Qwen3.6 27B на RTX 3090 и узнайте, как Multi-Token Prediction (MTP) в llama.cpp почти в 2 раза ускоряет локальный инференс LLM без апгрейда GPU.

14 мая 2026 г.

Учебник по API GPT-Realtime-2: три теста — три вердикта

Узнайте, чем отличаются gpt-realtime-2, gpt-realtime-translate и gpt-realtime-whisper от OpenAI, а затем протестируйте каждый с рабочим Python-кодом на WebSocket.

12 мая 2026 г.

Как запустить DeepSeek V4 Flash локально

Узнайте, как запустить полноценную модель DeepSeek V4 Flash на одном GPU с помощью модифицированной сборки llama.cpp и совместимого файла GGUF в этом практическом руководстве.

5 мая 2026 г.

Тонкая настройка NVIDIA Nemotron-3-Nano на данных по психологии (Q&A)

Узнайте, как дообучить NVIDIA Nemotron-3-Nano-4B на наборе данных вопросов и ответов по психологии на GPU RTX 3090 с использованием LoRA и TRL после загрузки модели с Hugging Face.

29 апреля 2026 г.

Учебник по API Qwen 3.6 Plus: конвейер обработки счетов на Python

Узнайте, как использовать Qwen 3.6 Plus от Alibaba, Python и SDK OpenAI для построения конвейера автоматической обработки счетов с нативным зрением и вызовом инструментов.

27 апреля 2026 г.