Категория
Технологии
Учебные материалы по LLM
Будьте в курсе последних новостей, методик и ресурсов по большим языковым моделям. Наши руководства полны практических разборов и кейсов, которые помогут прокачать навыки.
Другие технологии:
Обучение двух или более человек?Попробуйте DataCamp for Business
Учебник по коннектору Claude Code: сортировка репозиториев GitHub за 20 минут
Прочитайте этот учебник по коннектору Claude Code и настройте GitHub через MCP. Узнайте, как автоматизировать разбор задач в open-source за 20 минут, используя локальные файлы только для чтения.
7 июля 2026 г.
Как запустить GLM-5.2 локально с помощью RunPod и llama.cpp
Запустите GLM-5.2 приватно через llama.cpp, защитите доступ собственным API-ключом, протестируйте через Web UI и cURL и подключите к OpenCode для мощного локального рабочего процесса разработки.
1 июля 2026 г.
Как запустить Kimi K2.7 Code локально с помощью llama.cpp
Узнайте, как запустить Kimi K2.7 Code локально за пять минут с предустановленным бинарником llama.cpp на четырёх RTX PRO 6000, а затем использовать её веб‑интерфейс и кодового агента Pi через совместимый с OpenAI API.
25 июня 2026 г.
Как ускорить локальные LLM с помощью спекулятивного декодирования DFlash
Узнайте, как ускорить локальный инференс Gemma 4 31B на одном RTX 4090 с помощью спекулятивного декодирования DFlash и Flash Attention по сравнению с базовой конфигурацией.
17 июня 2026 г.
Формат GGUF: полное руководство по локальному выводу LLM
GGUF упаковывает веса модели, данные токенизатора и метаданные в один переносимый файл. Узнайте, как выбрать подходящий уровень квантизации и начать работу с Ollama.
17 июня 2026 г.
Процедуры Claude Code: запускайте агента для работы с кодом по расписанию в облаке
Узнайте, как процедуры Claude Code запускают вашего агента для работы с кодом в облаке по расписанию или событию GitHub, чтобы проверки PR и аудиты завершались даже с закрытым ноутбуком.
17 июня 2026 г.
Учебник по SGLang: локальный запуск Mistral Medium 3.5
Настройте среду Docker с несколькими GPU, тензорным параллелизмом и спекулятивным декодированием EAGLE, чтобы обслуживать Mistral Medium 3.5 128B через совместимый с OpenAI API.
1 июня 2026 г.
Руководство по Multi-Token Prediction: как ускорить LLM
Запустите Qwen3.6 27B на RTX 3090 и узнайте, как Multi-Token Prediction (MTP) в llama.cpp почти в 2 раза ускоряет локальный инференс LLM без апгрейда GPU.
14 мая 2026 г.
Учебник по API GPT-Realtime-2: три теста — три вердикта
Узнайте, чем отличаются gpt-realtime-2, gpt-realtime-translate и gpt-realtime-whisper от OpenAI, а затем протестируйте каждый с рабочим Python-кодом на WebSocket.
12 мая 2026 г.
Как запустить DeepSeek V4 Flash локально
Узнайте, как запустить полноценную модель DeepSeek V4 Flash на одном GPU с помощью модифицированной сборки llama.cpp и совместимого файла GGUF в этом практическом руководстве.
5 мая 2026 г.
Тонкая настройка NVIDIA Nemotron-3-Nano на данных по психологии (Q&A)
Узнайте, как дообучить NVIDIA Nemotron-3-Nano-4B на наборе данных вопросов и ответов по психологии на GPU RTX 3090 с использованием LoRA и TRL после загрузки модели с Hugging Face.
29 апреля 2026 г.
Учебник по API Qwen 3.6 Plus: конвейер обработки счетов на Python
Узнайте, как использовать Qwen 3.6 Plus от Alibaba, Python и SDK OpenAI для построения конвейера автоматической обработки счетов с нативным зрением и вызовом инструментов.
27 апреля 2026 г.