Ollama
Генерация кодаOllamaMLXClaude Desktopлокальные LLMApple Silicon

Ollama v0.33.0-rc2: интеграция с Claude Desktop и улучшенный кэш для Apple Silicon

Сергей Сергеев, редактор gen-hub.ru
Сергей Сергеев
Редактор gen-hub.ru
·4 мин чтения
Ollama v0.33.0-rc2: интеграция с Claude Desktop и улучшенный кэш для Apple Silicon

Предварительный релиз с интересными изменениями

Ollama - тот проект, который методично и без лишнего шума делает локальный запуск языковых моделей доступным для всех. 22 августа на GitHub появился предварительный релиз v0.33.0-rc2, и, судя по changelog, команда явно не скучала. Здесь нет революции в одном абзаце - зато есть несколько изменений, которые в совокупности сдвигают продукт в сторону полноценной платформы для ИИ-приложений. Расскажу, что именно изменилось и почему это важно.

Claude Desktop теперь живет внутри Ollama

Самое неожиданное изменение - появление интеграции с Claude Desktop App прямо в интерфейсе Ollama. Разработчик ParthSareen добавил не просто упоминание Anthropic в документации, а полноценный опыт: возможность включать отдельные модели Ollama для использования в Claude, выбирать доступные модели Ollama в Claude и управлять интеграциями в новом разделе "Connect your apps experience".

Это интересный стратегический ход. Ollama традиционно ассоциировался с открытыми моделями - Llama, Mistral, Phi, Gemma. Включение Claude Desktop в экосистему означает, что платформа перестает быть исключительно local-first инструментом и начинает играть роль единой точки входа для работы с разными моделями - как локальными, так и облачными. По сути, Ollama примеряет на себя роль, которую LM Studio пытается занять уже несколько лет, но делает это через нативное приложение, а не только через API.

Для пользователей это означает следующее: вы можете переключаться между локальной Llama 3.1 и облачным Claude Sonnet в одном интерфейсе, не меняя рабочего окружения. Для разработчиков - унифицированный API, который работает независимо от того, где физически исполняется модель.

MLX-движок: серьезная работа под капотом

Apple Silicon получил в этом релизе особое внимание. Команда закрыла несколько неприятных багов в MLX-бэкенде: исправлены некорректные предположения о Mac-окружении, которые ломали поведение MLX на Linux и Windows. Звучит как мелочь, но на деле это была источником трудноуловимых ошибок для всех, кто тестирует кросс-платформенные сборки.

Гораздо важнее другое изменение - улучшение механизма prefix cache в MLX Runner. Теперь точки восстановления кэша сохраняются даже при отмененных и возобновленных prefill-операциях. Что это значит на практике? При длинных контекстах (а с современными моделями это нормальная ситуация - 32K, 64K, 128K токенов) система больше не выбрасывает уже вычисленный KV-кэш при прерывании запроса. Повторный запуск того же промпта будет существенно быстрее.

Для владельцев MacBook Pro M3/M4 с большим объемом unified memory это практически означает более плавную работу с большими документами и длинными диалогами.

Онбординг и интерфейс: мелочи, которые решают все

Ollama также поработал над первым впечатлением от продукта. Обновлен layout экрана онбординга - выровнен, стал чище. Отключено масштабирование интерфейса (zoom), что устраняло визуальные артефакты на дисплеях с нестандартным DPI. Мелочь? Да. Но именно такие мелочи отличают инструмент разработчика от продукта, которым пользуются все.

Отдельно добавлен fallback на npx для DeepSeek Harness - это означает, что тестирование и запуск DeepSeek-моделей стало надежнее в окружениях, где нет глобально установленных зависимостей. Для тех, кто активно экспериментирует с DeepSeek-V3 или R2, это устраняет один из раздражающих edge cases при первом запуске.

Контекст: где Ollama стоит среди конкурентов

На сегодня, август 2026, рынок локальных LLM-runner'ов выглядит примерно так: LM Studio делает ставку на графический интерфейс и удобство для нетехнических пользователей, Jan пытается быть open-source альтернативой с плагинами, llama.cpp остается движком для тех, кому нужен абсолютный контроль над каждым параметром.

Ollama занял нишу между llama.cpp и LM Studio: достаточно технический, чтобы его любили разработчики, но достаточно удобный для продуктивного использования без погружения в компиляцию флагов. 182 тысячи звезд на GitHub и 18 тысяч форков говорят сами за себя - это не хайп, это реальное использование.

Интеграция с Claude Desktop App - это первый явный сигнал того, что Ollama хочет стать не просто runner'ом, а платформой. Если следующие версии добавят поддержку инструментов (tool use) и агентских фреймворков на уровне GUI, конкурировать с ними станет заметно сложнее.

Как это касается российских пользователей

Для локальных моделей Ollama работает без внешних зависимостей - никаких запросов к серверам, никаких ограничений по геолокации. Скачать дистрибутив можно напрямую с GitHub без VPN (хотя сам GitHub периодически замедляется). Что касается интеграции с Claude Desktop - здесь уже нужен аккаунт Anthropic, который для российских карт по-прежнему недоступен напрямую. Но для локальных моделей это абсолютно не важно: Ollama + Llama 3.1, Qwen 2.5 или Mistral работают без каких-либо внешних зависимостей.

Итог

Пока это rc2, но изменения уже интересные. Улучшенный MLX-кэш сделает Apple Silicon-пользователей счастливее, интеграция с Claude Desktop показывает амбиции платформы, а полировка онбординга говорит о том, что команда думает о росте аудитории за пределами core-разработчиков. Судя по темпу изменений, финальная версия не за горами.

Источники

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно

Похожие новости

R
Генерация кода

Reflection AI выпустила Beam: 501 млрд параметров против китайских моделей

Стартап из Бруклина с оценкой $25 млрд представил первую открытую модель Beam - MoE на 501B параметров, которая претендует на эффективность GLM-5.2 при втрое меньших вычислительных затратах. Ключевые бенчмарки пока не прошли независимую проверку.

6 октября4 мин чтения
DeepSeek
Генерация кода

DeepSeek Harness v0.2: десктоп, плагины и планировщик задач без командной строки

DeepSeek выпустил v0.2 своего агентного фреймворка с нативными приложениями для macOS и Windows, встроенным менеджером плагинов и планировщиком задач на базе session-local механизма.

4 октября4 мин чтения
OpenAI
Генерация кода

OpenAI и Synopsys учат ИИ проектировать чипы вместе с инженерами

OpenAI и Synopsys запустили многолетнее партнерство и строят GPT-Synopsys - специализированную модель, которая умеет работать с EDA-инструментами и помогает инженерам оптимизировать дизайн полупроводников.

30 сентября4 мин чтения