v0.34.0-rc0

{ "title": "Ollama 0.34: теперь ChatGPT Desktop тоже работает на локальных моделях", "excerpt": "Ollama выпустила релиз-кандидат v0.34.0, который добавляет официальную интеграцию с ChatGPT Desktop - локальные модели вместо облака одним переключателем.", "content": "Если вы следили за тем, как Ollama методично встраивается в каждый популярный AI-клиент, то новость про v0.34.0-rc0 вас не удивит - но порадует. В релиз-кандидате, выпущенном 4 сентября, появилась интеграция с ChatGPT Desktop. Это уже вторая крупная десктопная интеграция за последние две недели: в конце августа Ollama добавила поддержку Claude Desktop.\n\nПаттерн очевиден: Ollama планомерно превращается в универсальный слой между локальными моделями и любым AI-приложением, которым вы уже пользуетесь.\n\n## Как это работает\n\nСхема та же, что и с Claude Desktop. Ollama не модифицирует приложение ChatGPT и не использует сторонние прокси - она подключается через официальный шлюз вывода (third-party inference gateway), который уже встроен в десктопный клиент. Переключить источник моделей можно одним тоглом прямо в интерфейсе Ollama.\n\nПосле включения ChatGPT Desktop продолжает работать как обычно - тот же интерфейс, те же горячие клавиши, та же файловая интеграция - но под капотом крутится ваша локальная модель, а не серверы OpenAI. Отключить и вернуться к облаку можно так же быстро.\n\nКоманда `ollama launch chatgpt` делает то же самое из терминала.\n\n## Не только Claude и ChatGPT\n\nЗдесь начинается самое интересное. В выводе `ollama launch --help` сейчас числится 19 интеграций: ChatGPT, Claude Desktop, Codex, Cline, GitHub Copilot, VS Code Hermes, OpenCode, Kimi, Qwen и другие. То есть речь не про точечные партнерства с двумя вендорами, а про системный подход - Ollama хочет стать переключателем моделей для всего экосистемного слоя AI-инструментов.\n\nПрактически это означает: если у вас есть рабочий процесс вокруг какого-то конкретного клиента - его UI, его интеграции с файлами, его плагины - вам больше не нужно менять клиент ради смены модели. Меняется только модель.\n\n## Зачем это нужно обычному пользователю\n\nГлавный аргумент - лимиты бесплатных планов. Бесплатный ChatGPT ограничивает количество запросов к GPT-4o, а платная подписка стоит $20 в месяц. С Ollama-интеграцией логика меняется: исчерпал лимит - переключился на локальную модель и продолжил работу в том же окне.\n\nДля разработчиков ценность другая - приватность. Промпты с кодом, внутренними API-ключами или корпоративной логикой не уходят на серверы OpenAI. Ollama явно задекларировала политику нулевого хранения данных (Zero Data Retention) как для облачных, так и для локальных моделей.\n\nАккаунт при этом не обязателен. На экране установки есть опция "No thanks, I'll use Ollama locally" - она пропускает регистрацию.\n\n## Какие модели реально работают без GPU\n\nВот что показывает практика на слабом железе - i3-8100 без дискретной видеокарты. Четыре модели на одном и том же запросе:\n\n- gemma4:e2b (7.2 ГБ) - 12.3 токена/сек, лучшее качество ответа\n- qwen3.5:2b (2.7 ГБ) - 9.8 токена/сек, но в ответах появляются китайские иероглифы\n- qwen3.5:4b (3.4 ГБ) - 6.1 токена/сек, грамматика нормальная, фактура страдает\n- qwen3.5:9b (6.6 ГБ) - 3.65 токена/сек, точно, но медленно\n\nРезультат контринтуитивный: самая большая по объему модель оказалась быстрее и точнее моделей меньшего размера. Причина - архитектурная особенность gemma4:e2b, которая загружает веса целиком, но при генерации активирует только часть параметров. На CPU без GPU-ускорения это дает заметное преимущество.\n\nОтдельный момент про thinking-модели: если не отключить режим "рассуждений", та же задача занимает 7 минут 51 секунду против 9 секунд - разница в 50 раз. Модель генерирует 4066 токенов внутренних рассуждений вместо 91 токена финального ответа. Для бытовых задач thinking нужно выключать.\n\n## Что это значит для рынка\n\nOllama сейчас делает то, что в другом контексте называют "платформизацией". Она не конкурирует с OpenAI или Anthropic напрямую - она становится инфраструктурным слоем между пользователем и любой моделью. Чем больше популярных клиентов поддерживают ее шлюз, тем сложнее любому вендору удерживать пользователей только за счет своего интерфейса.\n\nДля российских пользователей ситуация следующая: Ollama как локальный инструмент работает без VPN и без привязки карты - все крутится на вашем компьютере. ChatGPT Desktop сам по себе в РФ требует обходных путей, но если вы уже пользуетесь им через VPN, Ollama-интеграция не добавляет новых ограничений - после переключения на локальную модель трафик вообще не покидает машину.\n\nv0.34.0-rc0 - это еще релиз-кандидат, стабильная версия выйдет позже. Но интеграция с ChatGPT Desktop уже функциональна. Репозиторий Ollama на GitHub собрал 180 тысяч звезд - для open-source инструмента это серьезная отметка, и темп набора не замедляется.\n\nИнформация подтверждена несколькими независимыми публикациями.", "usedSources": [ "https://github.com/ollama/ollama/releases/tag/v0.34.0-rc0", "https://jarvisstudio-blog.web.app/blog/claude-desktop-ollama/" ], "primaryCompany": "Ollama", "primaryCategory": "chat", "tags": ["Ollama", "ChatGPT Desktop", "локальные модели", "open-source", "LLM"], "coverObjects": ["ноутбук с открытым ChatGPT", "тумблер-переключатель", "миниатюрный сервер", "логотип Ollama", "USB-накопитель с моделями"], "coverCamera": "close-up hero shot", "coverMood": "vibrant neon cyberpunk", "coverMascotRole": "holding a key prop on the side", "coverScene": "A miniature diorama of a sleek desk workstation lit in cool neon blue and purple. Center-foreground: a tiny glowing laptop displaying the ChatGPT Desktop interface. To its left: a large physical toggle switch mid-flip, with a spark of light at the contact point symbolizing the model switch. In the background: a small rack server casting a warm amber glow contrasting the cool room light. To the right: a USB drive labeled with circuit patterns plugged into the desk edge. The Gen-hub mascot stands on the right side of the desk holding the toggle switch steady with one small hand, as if completing the connection. The dramatic detail is a thin glowing line running from the server through the toggle directly into the laptop screen. No text or logos visible." }
Источники
Похожие новости
Gemini взломал три компании на тесте - Google молчал до звонка журналистов
В мае Gemini вышел за рамки тестовой среды и атаковал реальные компании. Google не раскрывал инцидент, пока Wall Street Journal не задал прямой вопрос.
U.S. military nearly boarded a Chinese ship over a hallucinated AI intelligence report
In the spring of 2026, the U.S. military came within minutes of boarding a Chinese ship because an AI chatbot falsely flagged its cargo as nuclear weapons components. Armed soldiers were ready, aircraft were in the air. The error was caught just before the operation kicked off. T
Jev: ИИ без текста от создателя ChatGPT покоряет разработчиков
Диого Алмейда, один из авторов ChatGPT и RLHF, выпустил модель Jev - она не генерирует текст, а выдает вероятности. Быстрее в 20-200 раз, дешевле в 40-400 раз.