Ollama
ИИ-чат

v0.34.0-rc0

Сергей Сергеев, редактор gen-hub.ru
Сергей Сергеев
Редактор gen-hub.ru
·5 мин чтения
v0.34.0-rc0

{ "title": "Ollama 0.34: теперь ChatGPT Desktop тоже работает на локальных моделях", "excerpt": "Ollama выпустила релиз-кандидат v0.34.0, который добавляет официальную интеграцию с ChatGPT Desktop - локальные модели вместо облака одним переключателем.", "content": "Если вы следили за тем, как Ollama методично встраивается в каждый популярный AI-клиент, то новость про v0.34.0-rc0 вас не удивит - но порадует. В релиз-кандидате, выпущенном 4 сентября, появилась интеграция с ChatGPT Desktop. Это уже вторая крупная десктопная интеграция за последние две недели: в конце августа Ollama добавила поддержку Claude Desktop.\n\nПаттерн очевиден: Ollama планомерно превращается в универсальный слой между локальными моделями и любым AI-приложением, которым вы уже пользуетесь.\n\n## Как это работает\n\nСхема та же, что и с Claude Desktop. Ollama не модифицирует приложение ChatGPT и не использует сторонние прокси - она подключается через официальный шлюз вывода (third-party inference gateway), который уже встроен в десктопный клиент. Переключить источник моделей можно одним тоглом прямо в интерфейсе Ollama.\n\nПосле включения ChatGPT Desktop продолжает работать как обычно - тот же интерфейс, те же горячие клавиши, та же файловая интеграция - но под капотом крутится ваша локальная модель, а не серверы OpenAI. Отключить и вернуться к облаку можно так же быстро.\n\nКоманда `ollama launch chatgpt` делает то же самое из терминала.\n\n## Не только Claude и ChatGPT\n\nЗдесь начинается самое интересное. В выводе `ollama launch --help` сейчас числится 19 интеграций: ChatGPT, Claude Desktop, Codex, Cline, GitHub Copilot, VS Code Hermes, OpenCode, Kimi, Qwen и другие. То есть речь не про точечные партнерства с двумя вендорами, а про системный подход - Ollama хочет стать переключателем моделей для всего экосистемного слоя AI-инструментов.\n\nПрактически это означает: если у вас есть рабочий процесс вокруг какого-то конкретного клиента - его UI, его интеграции с файлами, его плагины - вам больше не нужно менять клиент ради смены модели. Меняется только модель.\n\n## Зачем это нужно обычному пользователю\n\nГлавный аргумент - лимиты бесплатных планов. Бесплатный ChatGPT ограничивает количество запросов к GPT-4o, а платная подписка стоит $20 в месяц. С Ollama-интеграцией логика меняется: исчерпал лимит - переключился на локальную модель и продолжил работу в том же окне.\n\nДля разработчиков ценность другая - приватность. Промпты с кодом, внутренними API-ключами или корпоративной логикой не уходят на серверы OpenAI. Ollama явно задекларировала политику нулевого хранения данных (Zero Data Retention) как для облачных, так и для локальных моделей.\n\nАккаунт при этом не обязателен. На экране установки есть опция "No thanks, I'll use Ollama locally" - она пропускает регистрацию.\n\n## Какие модели реально работают без GPU\n\nВот что показывает практика на слабом железе - i3-8100 без дискретной видеокарты. Четыре модели на одном и том же запросе:\n\n- gemma4:e2b (7.2 ГБ) - 12.3 токена/сек, лучшее качество ответа\n- qwen3.5:2b (2.7 ГБ) - 9.8 токена/сек, но в ответах появляются китайские иероглифы\n- qwen3.5:4b (3.4 ГБ) - 6.1 токена/сек, грамматика нормальная, фактура страдает\n- qwen3.5:9b (6.6 ГБ) - 3.65 токена/сек, точно, но медленно\n\nРезультат контринтуитивный: самая большая по объему модель оказалась быстрее и точнее моделей меньшего размера. Причина - архитектурная особенность gemma4:e2b, которая загружает веса целиком, но при генерации активирует только часть параметров. На CPU без GPU-ускорения это дает заметное преимущество.\n\nОтдельный момент про thinking-модели: если не отключить режим "рассуждений", та же задача занимает 7 минут 51 секунду против 9 секунд - разница в 50 раз. Модель генерирует 4066 токенов внутренних рассуждений вместо 91 токена финального ответа. Для бытовых задач thinking нужно выключать.\n\n## Что это значит для рынка\n\nOllama сейчас делает то, что в другом контексте называют "платформизацией". Она не конкурирует с OpenAI или Anthropic напрямую - она становится инфраструктурным слоем между пользователем и любой моделью. Чем больше популярных клиентов поддерживают ее шлюз, тем сложнее любому вендору удерживать пользователей только за счет своего интерфейса.\n\nДля российских пользователей ситуация следующая: Ollama как локальный инструмент работает без VPN и без привязки карты - все крутится на вашем компьютере. ChatGPT Desktop сам по себе в РФ требует обходных путей, но если вы уже пользуетесь им через VPN, Ollama-интеграция не добавляет новых ограничений - после переключения на локальную модель трафик вообще не покидает машину.\n\nv0.34.0-rc0 - это еще релиз-кандидат, стабильная версия выйдет позже. Но интеграция с ChatGPT Desktop уже функциональна. Репозиторий Ollama на GitHub собрал 180 тысяч звезд - для open-source инструмента это серьезная отметка, и темп набора не замедляется.\n\nИнформация подтверждена несколькими независимыми публикациями.", "usedSources": [ "https://github.com/ollama/ollama/releases/tag/v0.34.0-rc0", "https://jarvisstudio-blog.web.app/blog/claude-desktop-ollama/" ], "primaryCompany": "Ollama", "primaryCategory": "chat", "tags": ["Ollama", "ChatGPT Desktop", "локальные модели", "open-source", "LLM"], "coverObjects": ["ноутбук с открытым ChatGPT", "тумблер-переключатель", "миниатюрный сервер", "логотип Ollama", "USB-накопитель с моделями"], "coverCamera": "close-up hero shot", "coverMood": "vibrant neon cyberpunk", "coverMascotRole": "holding a key prop on the side", "coverScene": "A miniature diorama of a sleek desk workstation lit in cool neon blue and purple. Center-foreground: a tiny glowing laptop displaying the ChatGPT Desktop interface. To its left: a large physical toggle switch mid-flip, with a spark of light at the contact point symbolizing the model switch. In the background: a small rack server casting a warm amber glow contrasting the cool room light. To the right: a USB drive labeled with circuit patterns plugged into the desk edge. The Gen-hub mascot stands on the right side of the desk holding the toggle switch steady with one small hand, as if completing the connection. The dramatic detail is a thin glowing line running from the server through the toggle directly into the laptop screen. No text or logos visible." }

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно

Похожие новости