Максим Наговицын
Маркетинг-стратег, IT-предприниматель, ментор по вайбкодингу
Санкт-Петербург
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
Ключевые цифры
Экспертиза
Публикации автора
Голосовой бот для Telegram 2026 расшифровка и озвучка речи
Голосовой бот телеграм принимает войс от пользователя, превращает его в текст через сервис распознавания речи и присылает ответ уже синтезированным голосом. Для расшифровки в 2026 году чаще всего берут Deepgram или Gladia. Для озвучки, ElevenLabs. Ни…
ElevenLabs Dubbing 2026 дубляж видео нейросетью без акцента
ElevenLabs Dubbing переводит видео на другой язык и озвучивает его нейросетью, сохраняя тембр и интонацию исходного голоса, без найма актера озвучки и без ручной синхронизации реплик. Сервис берет дорожку, распознает речь, переводит текст и генерируе…
Контекстное окно LLM в 2026 году сколько токенов и что влезает
Контекстное окно LLM — это объем текста, который модель держит в голове за один запрос: ваше сообщение, вся история переписки, системный промпт и прикрепленные файлы. Как только объем превышает лимит, старые куски разговора выпадают, и модель букваль…
Сжатие контекста через суммаризацию диалога в LLM 2026
Автоматическое сжатие контекста работает так: когда история диалога с агентом подходит к лимиту окна, модель не обрывает сессию, а сжимает старые сообщения в краткую сводку и продолжает работу дальше. Обновлено: сентябрь 2026. Ниже разберем, как эта…
Как подключить Mem0, слой памяти для AI-агентов, в 2026 году
Mem0 — это open source библиотека, которая дает LLM-агенту долгосрочную память: он сам вытаскивает важные факты из диалога и находит их в следующей сессии. По данным на август 2026 года у проекта на GitHub больше 64 000 звезд, лицензия Apache 2.0, а…
Ollama как API-сервер: используем локальные модели в своих скриптах и приложениях
Ollama API это не отдельная функция, которую нужно где-то включать, а обычный REST-сервер, который Ollama поднимает на localhost сразу после установки. Даже когда вы просто вводите ollama run llama3.2 и общаетесь с моделью в терминале, команда под ка…
Модели для Ollama в 2026: Qwen3-Coder, Kimi, DeepSeek и какую выбрать под своё железо
Короткий ответ: под 8 ГБ видеопамяти берите Qwen2.5-Coder 7B, под 24 ГБ — Qwen3-Coder-30B-A3B, а Kimi K2.6 и Hermes на домашнем компьютере не запустить физически, они живут только в облаке Ollama. Дальше разберем, почему именно так и что делать, если…
Ollama launch: запускаем Claude Code, Codex и другие агенты на локальной модели
Ollama launch — это команда, которая поднимает готовое окружение агентного кодинга одной строкой: Claude Code, Codex, OpenCode или Copilot CLI запускаются сразу с локальной или облачной моделью Ollama в роли бэкенда. Раньше для этого приходилось вруч…
llama.cpp: движок под капотом Ollama и LM Studio — когда нужен прямой доступ
Llama.cpp — это движок инференса на C/C++, на котором построены Ollama, LM Studio и десятки других программ для локального запуска нейросетей. Когда вы жмете кнопку "загрузить модель" в удобном интерфейсе, под капотом всё равно работает именно он. В…
GGUF: уровни квантизации Q4, Q5, Q8 — как выбрать баланс качества и размера
Открываете каталог моделей на Hugging Face, вводите название модели — и видите не один файл, а десяток вариантов с припиской вроде Q4_K_M или Q8_0. Это не разные модели. Это одна и та же нейросеть, сохраненная с разной точностью хранения весов — и в…
Локальные нейросети для генерации изображений и видео: ComfyUI, Flux, Wan
Локальные нейросети для генерации изображений и видео в 2026 году держатся на трех вещах: узловом интерфейсе ComfyUI, открытых моделях Flux, Wan и LTX и GGUF-квантовании, которое ужимает эти модели под обычную видеокарту. Разница с закрытыми сервисам…
Ollama vs LM Studio vs vLLM vs llama.cpp: что выбрать в 2026
Выбор между Ollama, LM Studio, vLLM и llama.cpp зависит не от того, какой инструмент «лучше», а от сценария. Ollama побеждает по простоте старта, LM Studio даёт визуальный интерфейс и встроенный RAG, vLLM держит продакшн-нагрузку с сотнями пользовате…